← Volver al archivo

Lectura / E

Redacción · IA y apps

Microsoft lanza una IA que elige opciones y no conversa: en las pruebas resultó 35 veces más rápida que GPT-6 Sol

Microsoft lanza una IA que elige opciones y no conversa: en las pruebas resultó 35 veces más rápida que GPT-6 Sol

Microsoft ha presentado Microsoft-Decision-1, un modelo de inteligencia artificial especializado que evalúa opciones de respuesta o de acción predefinidas. Según la compañía, en las pruebas de toma de decisiones estructuradas su latencia de respuesta fue 35 veces menor que la de OpenAI GPT-6 Sol. El modelo está pensado para clasificar información, verificar resultados y gestionar flujos de trabajo.

Microsoft-Decision-1

no está diseñada para generar texto libre como un chatbot convencional. Cuando recibe una pregunta y un conjunto de opciones, asigna a cada una una puntuación de probabilidad. La aplicación decide los pasos siguientes: por ejemplo, puede permitir que un agente de IA ejecute la acción propuesta, exigir un nuevo intento o derivar la tarea a una persona.

Trabajar con el modelo sale barato: 0,042 dólares por cada millón de tokens de entrada, mientras que los datos de salida no se facturan. Este esquema resulta especialmente ventajoso para aplicaciones que deben clasificar solicitudes o elegir acciones posteriores con frecuencia. Microsoft-Decision-1 también sirve para dirigir consultas a los modelos adecuados, priorizar tareas y evaluar la calidad de las respuestas de otros sistemas de IA.

Según Microsoft, la novedad ha logrado la mayor precisión entre los modelos comparados en un conjunto de 36 pruebas de referencia que abarcan casi 150.000 preguntas. Las tareas de estos test no se usaron durante el entrenamiento. La latencia mediana de respuesta fue 35 veces menor que la de GPT-6 Sol y 2,5 veces menor que la de H2O-Lightning-4B v1.1, segundo en este apartado. Estos resultados proceden de las propias pruebas de Microsoft y se refieren a tareas de elección entre opciones predefinidas.

microsoft-decision_2.png

La compañía ya ha probado el modelo en varios escenarios prácticos. Los ingenieros de Xbox Research clasificaron con él más de 10.000 comentarios de jugadores según temas predefinidos. En calidad de clasificación, Microsoft-Decision-1 resultó comparable a GPT-6 Sol, pero funcionó más de 14 veces más rápido con un coste unas 200 veces menor. En las pruebas del equipo de Microsoft Copilot para evaluar la calidad de las respuestas, logró un resultado comparable al de GPT-5.6 Luna con una ventaja de cien veces en velocidad.

Microsoft-Decision-1 se basa en Alibaba Qwen3.5-9B, que recibió un entrenamiento adicional para evaluar opciones en una sola pasada. En el futuro, Microsoft quiere crear versiones sobre otros modelos, incluidos los propios MAI y los sistemas de OpenAI. La compañía también comprobó la resistencia de las decisiones a cambios en la formulación y el formato de las consultas: en esas pruebas el modelo cambiaba su respuesta en un 1,3 % de los casos de media, y no hubo variaciones al reformular las opciones ni al alterar su orden.

Para evaluar la seguridad, Microsoft utilizó 11 pruebas de referencia con 5.250 consultas, incluidas peticiones de contenido dañino, intentos de eludir las restricciones de protección e inyecciones de instrucciones ajenas. Según la compañía, el modelo rechazaba las peticiones maliciosas y mantenía una alta utilidad en las tareas permitidas. Microsoft-Decision-1 ya está disponible en la plataforma Microsoft Foundry y a través de

OpenRouter

.

IA y apps / 03

Sigue leyendo