Iniciar Sesión

Ver la Versión Completa : 1.37.4: agentes reintentan y la KB habla tu idioma


Eslopes
28 de julio de 2026, 08:14
PowerRustCOBOL 1.37.4 corrige tres problemas encontrados a partir de un mismo fallo real: una tarea del Form Designer con 30 etiquetas que moria con "the model returned no assistant text".

1. Las respuestas vacias del modelo ahora se reintentan y explican su causa

La generacion actual de modelos Anthropic razona antes de responder. En el caso observado, el modelo gasto el presupuesto entero de 8192 tokens pensando y la respuesta visible nunca empezo. Ademas, esa variante del error no estaba clasificada como transitoria, asi que el flujo moria en el primer intento, sin reintento alguno.

- El error ahora nombra la causa exacta: razonamiento oculto, tope de max_tokens alcanzado, o ambos.
- Se clasifica como transitorio y se reintenta.
- El reintento sube el presupuesto PRIMERO y conserva las herramientas nativas; solo el segundo reintento las desconecta. Observado en vivo: un reintento sin herramientas respondio con prosa ("knowledge_search {...}") en lugar de un change-set aplicable.

2. Piso de presupuesto para los modelos que razonan

Los modelos Anthropic desde Opus 4.7 en adelante (incluidos Opus 5, Sonnet 5, Fable 5 y Mythos 5) reciben un piso de 32768 tokens de salida. El piso se deriva de la misma lista que ya retiene el parametro temperature, de modo que un modelo futuro queda cubierto el dia de su lanzamiento sin editar ninguna lista. La linea 3.x nunca recibe el piso: su tope real es menor y pedir 32k seria un HTTP 400.

3. La busqueda de la Knowledge Base ahora habla el idioma del desarrollador

La busqueda "semantica" era en la practica lexica (hash de tokens) y sesgada al ingles: una pregunta en espanol o portugues no encontraba los documentos en ingles que la responden. Ahora:

- El embedder es intfloat/multilingual-e5-small (aprox. 100 idiomas, licencia MIT, 384 dimensiones: el indice conserva su forma). Una pregunta en cualquiera de los 6 idiomas del IDE encuentra el documento correcto aunque este escrito en ingles.
- Los prefijos query/passage de E5 viven dentro del embedder; los llamadores no los ven y el fallback lexico no los recibe.
- Cada registro del indice guarda que embedder lo produjo y un hash del contenido: la sincronizacion por flujo solo re-embebe lo que cambio, y un cambio de modelo fuerza la reindexacion automatica en lugar de mezclar espacios vectoriales incomparables.
- El IDE instala el modelo (aprox. 470 MB, una sola vez, para toda la maquina) con un modal de progreso que bloquea el IDE hasta terminar: muestra el total a descargar, el avance y el motivo, traducido a los 6 idiomas. Detecta archivos corruptos y los descarga de nuevo. Sin red, se puede continuar con la busqueda lexica y bajar el modelo despues desde el Models Manager.
- De paso: el timeout de 30 segundos del cliente HTTP cubria el cuerpo entero de la descarga y habria abortado los 470 MB en cualquier conexion por debajo de aprox. 16 MB/s. Eliminado.

Tambien se corrigen mensajes de log que mentian ("max_tokens raised to" cuando el valor no cambiaba) y una pista del Models Manager que hablaba de fallos repetidos tras un unico intento cancelado.

Anthropic Claude Codex Agent