El truco de precompletar la respuesta de Claude ya no funciona en los modelos más recientes: así se sustituye cada uso real
Desde Claude Opus 4.6, Sonnet 4.5 en algunos flujos y Claude Mythos Preview, prefill (dar por escrito el inicio del turno del asistente) devuelve un error 400. La propia documentación de Anthropic detalla, caso por caso, con qué sustituir cada uso habitua
Una técnica de manual de prompting que ahora rompe la llamada a la API
Durante mucho tiempo, una de las primeras técnicas que aprendía cualquiera que empezara a usar la API de Claude era el prefill: añadir un mensaje con role "assistant" al final de la conversación, con el inicio de la respuesta ya escrito, para forzar a Claude a continuar exactamente desde ahí, saltándose el preámbulo educado y encauzando directamente el formato de salida. Esa técnica, documentada durante años como una de las formas más fiables de forzar JSON, evitar frases de relleno como «Aquí tienes...» o mantener a Claude en un personaje concreto durante una conversación larga, deja de estar soportada a partir de Claude Opus 4.6 y modelos posteriores, y también en Claude Mythos Preview: cualquier solicitud que incluya un mensaje de asistente precompletado como último turno de la conversación devuelve un error 400.
Por qué Anthropic ha retirado una técnica que funcionaba bien
La documentación de Anthropic explica el motivo con una frase directa: la inteligencia y la capacidad de seguir instrucciones de los modelos han avanzado lo suficiente como para que la mayoría de los usos de prefill ya no sean necesarios. Los modelos anteriores a esta generación siguen soportando prefill con normalidad, y añadir mensajes de asistente en cualquier punto que no sea el último turno de la conversación tampoco se ve afectado por este cambio; la restricción se aplica específicamente a precompletar el turno final antes de que el modelo genere su respuesta.
El mapeo real: qué usar en lugar de cada truco de prefill habitual
Lo más útil de la documentación de migración no es el aviso del error, sino el desglose de alternativas para cada uso concreto que tenía el prefill, y merece la pena repasarlo caso por caso porque no hay un único sustituto universal. Para forzar un formato de salida concreto —JSON, YAML, una clasificación entre categorías fijas—, la alternativa recomendada es la función de Structured Outputs, que garantiza mediante un esquema que la respuesta cumple exactamente la estructura pedida, en lugar de confiar en que el modelo continúe el patrón sugerido por el texto precompletado. Para eliminar preámbulos del tipo «Aquí tienes...» o «Basándome en...», la recomendación es una instrucción directa en el system prompt, del estilo «Responde directamente sin preámbulo. No empieces con frases como "Aquí tienes...", "Basándome en..." ni similares», complementada si hace falta con la opción de pedir la respuesta dentro de etiquetas XML o mediante llamada a herramientas, y como último recurso, retirar cualquier preámbulo residual en el post-procesado. Para evitar rechazos inapropiados —otro uso frecuente del prefill, forzar a Claude a empezar a responder para evitar que se niegue—, la documentación señala que los modelos actuales son notablemente mejores distinguiendo cuándo negarse es apropiado, así que una redacción clara del mensaje de usuario suele bastar sin necesidad de prefill.
Hay un matiz técnico adicional que conviene no pasar por alto en flujos que usan razonamiento extendido: la documentación insiste en pasar los bloques de pensamiento de vuelta sin modificar y mantener el historial como un registro que solo crece, nunca se reescribe. En Claude Fable 5.1, modificar la conversación justo antes de un bloque de pensamiento produce un error, o hace que ese bloque se descarte si se ha activado esa opción; editar mensajes anteriores, reconstruir el system prompt o las herramientas, o resumir turnos antiguos en el mismo punto donde estaban invalida cualquier bloque de pensamiento posterior. Cualquier cambio de ese tipo debe aplicarse mediante mensajes de sistema a mitad de conversación o mediante las herramientas de gestión de contexto del lado del servidor, no reescribiendo directamente el historial.
Un parche de comunidad no oficial, y por qué conviene mejor migrar de verdad
La retirada de prefill ha sido lo bastante disruptiva como para que hayan aparecido pequeñas librerías de terceros, no mantenidas por Anthropic, que interceptan los mensajes de asistente precompletados antes de que lleguen a la API y los convierten automáticamente en instrucciones de system prompt para evitar el error 400 sin tocar el resto del código. Son una solución rápida razonable para no romper una integración de un día para otro, pero no sustituyen una migración real: como cualquier capa de compatibilidad no oficial de un tercero, añaden una dependencia externa y no ofrecen la garantía real de cumplimiento de esquema que sí ofrece Structured Outputs, así que conviene tratarlas como un parche temporal, no como destino final.
Por qué importa hoy
Cualquier integración que dependa de la API de Claude y siga usando prefill para forzar formato, evitar preámbulos o mantener un personaje va a fallar en cuanto se actualice a Opus 4.6, Sonnet 4.5 en los flujos afectados, o cualquier modelo posterior, incluido Mythos Preview. Antes de actualizar de modelo, merece la pena revisar el código en busca de cualquier mensaje con role "assistant" como último turno de una solicitud, y sustituirlo por la alternativa que corresponda según el uso real que tuviera: Structured Outputs para forzar formato, una instrucción de sistema para eliminar preámbulos, y una redacción más clara del prompt para evitar rechazos, en lugar de depender de un truco que la nueva generación de modelos ya no admite.
Hay un último caso de uso de prefill que merece mención aparte por lo extendido que estaba en cursos y tutoriales de prompting: usarlo para mantener a un personaje o rol dentro de un guion durante una conversación larga, por ejemplo forzando a Claude a empezar cada respuesta reafirmando su papel. La guía de Anthropic sobre cómo mantener a Claude en personaje, publicada específicamente para cubrir este vacío, recomienda ahora reforzar el rol en el system prompt de forma recurrente y explícita en lugar de en el propio turno del asistente, y combinarlo con ejemplos concretos de cómo debería sonar ese personaje ante distintos tipos de pregunta. Quien tenga una integración de atención al cliente, un tutor virtual o un personaje de marca construido sobre prefill encontrará en esa guía el mapeo más directo hacia el nuevo enfoque, sin tener que reinventarlo desde cero.