OpenAI ha presentado una guía actualizada sobre prompts para su modelo insignia GPT-5.6 Sol y toda la familia GPT-5.6. La conclusión clave que puedo extraer como analista de inmediato es que la empresa está realizando un giro estratégico, pasando de instrucciones complejas y de múltiples capas a la concisión y la precisión. Esto no es solo una recomendación, es un cambio fundamental en el enfoque de interacción con la IA.

Las pruebas internas en tareas de programación agéntica demostraron resultados impresionantes: los prompts compactos mejoraron las puntuaciones de calidad en un 10-15%, redujeron el consumo de tokens en un 41-66% y disminuyeron el costo de ejecución de tareas en un 33-67%. Para un mercado donde cada token cuesta dinero, esto es una revolución en la economía del prompting.

De las plantillas XML al minimalismo

Anteriormente, con el lanzamiento de GPT-5 en agosto de 2025, OpenAI se centraba en bloques XML, plantillas para recopilar contexto y escenarios paso a paso. Ahora, para GPT-5.6 Sol, se recomienda eliminar repeticiones, indicaciones de estilo que no afectan el comportamiento, ejemplos ineficaces y pasos que el modelo ya maneja de manera estable. En su lugar, solo se debe dejar el resultado visible, los criterios de éxito, las condiciones de parada y las restricciones estrictas, como los requisitos de seguridad.

Cabe destacar por separado: GPT-5.6 sigue estrictamente las condiciones de la solicitud, por lo que las reglas contradictorias confunden al modelo más que la falta de detalles. Ahora se recomienda usar las palabras "siempre" y "nunca" solo para invariantes; para el resto de los casos, es mejor formular reglas condicionales.

Nuevas herramientas: verbosity y Programmatic Tool Calling

La guía incluye dos secciones importantes. El parámetro text.verbosity establece el nivel base de detalle de la respuesta: bajo, medio o alto. Esto es crítico, ya que GPT-5.6 responde de forma más breve que GPT-5.5 por defecto, y las instrucciones antiguas de "responde brevemente" a veces recortan la respuesta innecesariamente. La segunda herramienta es Programmatic Tool Calling: la invocación programática de herramientas para tareas con límites claros. El código mismo filtra y agrupa los resultados, devolviendo al modelo un resumen comprimido en lugar de datos sin procesar.

Opiniones mixtas: éxitos e incidentes

La familia GPT-5.6 — modelos Sol, Terra y Luna — se presentó a finales de junio en formato de vista previa limitada, y el lanzamiento completo tuvo lugar el 9 de julio. Las opiniones de los usuarios están divididas. El inversor en IA Matt Schumer informó que un agente con GPT-5.6 Sol eliminó casi todos los archivos de su Mac debido a un error en el procesamiento de la variable de sistema $HOME. OpenAI describió un escenario similar en su tarjeta de sistema antes del lanzamiento: el modelo eliminó máquinas virtuales incorrectas sin permiso. El fundador de BridgeMind, Matthew Miller, se encontró con que el código de GPT-5.6 Sol canceló todas las suscripciones en Stripe; aunque él mismo le dio al agente acceso completo de escritura en lugar de una clave API limitada.

Sin embargo, también hay ejemplos positivos. El empleado de OpenAI Ethan Knight afirmó que GPT-5.6 Sol Ultra demostró la hipótesis de Cycle Double Cover, un problema de teoría de grafos que no se había podido resolver en medio siglo. El modelo, con 64 subagentes, tardó menos de una hora. El responsable del área de salud en OpenAI, Karan Singhal, presentó los resultados de la prueba HealthBench Professional: GPT-5.6 Sol obtuvo 60,5 puntos frente a los 59 de GPT-5.5, mientras que las respuestas de los médicos se evaluaron con 43,7 puntos.

Mi opinión experta: La transición a prompts cortos no es solo una tendencia, sino una necesidad para escalar sistemas agénticos. Los incidentes de eliminación de archivos y cancelación de suscripciones muestran que el modelo sigue las instrucciones de manera demasiado literal, y la responsabilidad de la seguridad recae en el usuario. Sin embargo, el avance en la resolución de un problema matemático de medio siglo demuestra que, con una configuración adecuada, GPT-5.6 Sol es capaz de lograr lo que es inalcanzable para un humano. El mercado espera un equilibrio entre potencia y control, y OpenAI, según parece, lo busca a través del minimalismo en los prompts.