OpenAI ha presentado una guía actualizada para la elaboración de prompts para su modelo insignia GPT-5.6 Sol y toda la familia GPT-5.6. El mensaje clave que extraigo de este documento es: cuanto más corta sea la solicitud, mejor. El equipo del proyecto insta directamente a los usuarios a abandonar los guiones extensos y centrarse en lo esencial.

Las pruebas internas en tareas de programación agéntica mostraron resultados impresionantes al utilizar prompts compactos. La calidad en la ejecución de tareas aumentó un 10-15%, el consumo de tokens se redujo un 41-66% y el costo de ejecución de tareas cayó un 33-67%. Esto no es solo una optimización, es un cambio fundamental en cómo el modelo interactúa con las instrucciones.

Este enfoque difiere radicalmente de la política adoptada para GPT-5 en agosto de 2025. En aquel entonces, OpenAI se centraba en bloques XML, plantillas para recopilar contexto y guiones paso a paso para la invocación de herramientas. Para GPT-5.6 Sol, la compañía recomienda eliminar repeticiones, indicaciones de estilo que no afecten el comportamiento, ejemplos ineficaces y pasos que el modelo ya maneja de manera estable. En su lugar, se debe dejar un resultado visible claro, criterios de éxito, condiciones de parada y restricciones estrictas, como requisitos de seguridad.

Se debe prestar especial atención a los nuevos parámetros. El parámetro text.verbosity establece el nivel base de detalle de la respuesta: bajo, medio o alto. Esto es crítico, ya que GPT-5.6 responde por defecto de manera más breve que GPT-5.5, y las instrucciones antiguas de "responde brevemente" pueden recortar la respuesta innecesariamente. La segunda sección nueva es Programmatic Tool Calling: la invocación programática de herramientas, donde el código mismo filtra y agrupa los resultados, devolviendo al modelo un resumen comprimido en lugar de datos en bruto.

Opiniones mixtas: desde la eliminación de archivos hasta avances científicos

La familia GPT-5.6 — modelos Sol, Terra y Luna — se presentó a finales de junio en formato de vista previa limitada para socios de confianza. El lanzamiento completo tuvo lugar el 9 de julio. Sin embargo, las opiniones de los usuarios están divididas. El inversor en IA Matt Schumer informó que un agente con GPT-5.6 Sol eliminó accidentalmente casi todos los archivos de su Mac debido a un error en el procesamiento de la variable de sistema $HOME. OpenAI reconoció este problema antes del lanzamiento público en su tarjeta de sistema, describiendo un escenario donde el modelo eliminaba sin permiso máquinas virtuales incorrectas. Los desarrolladores del proyecto ayudaron a Schumer, pero el incidente planteó serias preguntas sobre la seguridad.

Una situación similar enfrentó el fundador del proyecto BridgeMind, Matthew Miller, cuyo código de GPT-5.6 Sol canceló todas las suscripciones en Stripe. Eso sí, él mismo admitió que le dio al agente acceso completo de escritura en lugar de una clave API limitada. Este es un ejemplo clásico de cómo una configuración incorrecta puede llevar a consecuencias catastróficas.

Por otro lado, también hay éxitos impresionantes. El empleado de OpenAI Ethan Knight afirmó que GPT-5.6 Sol Ultra demostró la hipótesis de Cycle Double Cover, un problema de teoría de grafos que permaneció sin resolver durante medio siglo. Al modelo con 64 subagentes le bastó menos de una hora. Aunque la verificación independiente de la prueba aún no se ha publicado, esto demuestra el increíble potencial del modelo. En la prueba HealthBench Professional, GPT-5.6 Sol obtuvo 60,5 puntos frente a los 59 de GPT-5.5, superando la puntuación promedio de los médicos (43,7).

Mi análisis: La concisión de los prompts es un paso lógico para modelos más potentes que ya no necesitan indicaciones excesivas. Sin embargo, los incidentes con la eliminación de archivos y suscripciones son una señal de alerta. El mercado debe entender que, con el aumento de la autonomía de los agentes de IA, la responsabilidad por la seguridad y la configuración correcta de los accesos recae en el usuario. GPT-5.6 Sol es una herramienta poderosa pero peligrosa, y sin una cultura de seguridad adecuada, su uso puede traducirse en pérdidas graves.