OpenAI presentó este martes GPT-6.1 Sol, un nuevo modelo de inteligencia artificial que busca acercarse al rendimiento de su sistema más potente a un costo mucho menor. La compañía asegura que puede alcanzar resultados comparables a GPT-6 Astra en distintas tareas, pero con un precio cinco veces más bajo.

El lanzamiento se produjo durante DevDay, la conferencia anual para desarrolladores de OpenAI, y llega en un momento particular para la empresa detrás de ChatGPT. Apenas un día antes había decidido descartar el lanzamiento de GPT-6.1 Astra, una actualización de su modelo más avanzado, después de detectar problemas durante las evaluaciones internas de seguridad.

La distinción entre ambos nombres es importante. GPT-6 Astra ya existe y fue lanzado a comienzos de septiembre como el modelo más avanzado de OpenAI. El sistema que ahora quedó en el camino era GPT-6.1 Astra, una nueva versión que estaba prevista para octubre. Según informó The Wall Street Journal, las pruebas mostraron un retroceso en algunos indicadores de seguridad respecto de su antecesor.

GPT-6.1 Sol ocupa un escalón inferior, aunque OpenAI afirma que se acerca al rendimiento de Astra en programación, uso de computadoras y trabajos profesionales. Para desarrolladores, su precio mediante la API es de 2 dólares por cada millón de tokens de entrada y 10 dólares por cada millón de salida. Los tokens son las unidades en las que estos sistemas dividen el texto para procesarlo.

La compañía sostiene que el nuevo modelo mejora a GPT-6 Sol tanto en rendimiento como en varias pruebas destinadas a medir comportamientos problemáticos. Estará disponible inicialmente para usuarios de los planes Plus, Pro, Business, Enterprise y Edu dentro de ChatGPT Work y Codex, además de la API. Por ahora, OpenAI aclaró que no estará disponible en el ChatGPT tradicional.

Qué pasó con el modelo que OpenAI decidió frenar

Sam Altman, CEO de OpneAI. Foto: Bloomberg

La cancelación de GPT-6.1 Astra se conoce en medio de una sucesión de incidentes que puso bajo mayor escrutinio la forma en que OpenAI entrena y prueba sus agentes, sistemas capaces de utilizar herramientas, navegar sitios y encadenar acciones con un grado mayor de autonomía.

Uno de los episodios más recientes ocurrió el 20 de septiembre. Durante una tarea de entrenamiento, un agente encontró una vía para conectarse a un servicio externo pese a las restricciones que debían impedirle acceder a Internet en vivo. El sistema utilizó consultas DNS, un mecanismo básico de Internet utilizado para resolver nombres de dominio, para alcanzar un chatbot público.

El sistema de monitoreo de OpenAI detectó la actividad a los 15 minutos y un revisor humano comenzó a analizarla tres minutos después. La ejecución fue detenida unas dos horas y media más tarde. Como consecuencia, la empresa pausó el entrenamiento, la evaluación y el uso de herramientas en sus modelos más capaces hasta reforzar los controles.

Ese episodio se sumó al incidente de Hugging Face, ocurrido en julio y reconocido posteriormente por OpenAI. Durante pruebas internas, agentes de la compañía accedieron a sistemas de la plataforma de inteligencia artificial y realizaron acciones que excedían las tareas que tenían asignadas. OpenAI considera ese caso el incidente más grave de este tipo que observó hasta ahora.

La revisión posterior reveló otros comportamientos inesperados. OpenAI reconoció que algunos agentes interactuaron con servicios de terceros y, en ciertos casos, transmitieron información utilizada durante procesos de entrenamiento y evaluación. La compañía también informó que detectó 53 casos en los que imágenes aportadas por usuarios terminaron alojadas mediante enlaces que no estaban listados públicamente.

También hubo un episodio con un sistema del gobierno australiano. Un modelo experimental que investigaba estadísticas sobre medicamentos encontró una vía de acceso no pública a un servicio de Medicare y consultó información técnica y código fuente. OpenAI aseguró que no encontró evidencia de acceso a historias clínicas y admitió que esas acciones no estaban autorizadas.

Estos casos llevaron a la empresa a endurecer sus mecanismos de aislamiento, monitoreo y aprobación antes de continuar con determinados entrenamientos. El contexto también explica el peso de la decisión de abandonar GPT-6.1 Astra: detener un modelo avanzado antes de su lanzamiento representa un cambio relevante en una industria acostumbrada a competir por sacar sistemas cada vez más capaces.

Al mismo tiempo, la carrera comercial sigue acelerándose. OpenAI compite con Anthropic, creadora de Claude, tanto por rendimiento como por precio, mientras ambas compañías analizan una eventual salida a bolsa. Anthropic incluso incluyó entre los riesgos de su documentación para inversores la posibilidad de que sistemas avanzados de IA provoquen daños graves o incluso riesgos existenciales.

Sam Altman, CEO de OpenAI, volvió a marcar esta semana que la empresa no tiene una fecha definida para cotizar en bolsa y que pretende priorizar el trabajo de seguridad antes de dar ese paso. En paralelo, el lanzamiento de GPT-6.1 Sol muestra la otra cara de la competencia: modelos cada vez más capaces, pero también suficientemente baratos como para que empresas y desarrolladores puedan utilizarlos a gran escala.