Claude Sonnet 5 sale hoy: qué modelo mueve cada botón de presupuestaIA
Publicado el 30 de junio de 2026 · 6 min de lectura
Anthropic ha lanzado hoy Claude Sonnet 5 y lo ha puesto por defecto en los planes Free y Pro. Es buen momento para explicar algo que llevamos semanas ordenando por dentro: qué modelo mueve cada agente de presupuestaIA y por qué no todos usan el mismo.
Lo que ha pasado hoy
Anthropic ha lanzado Claude Sonnet 5 y lo ha puesto por defecto en los planes Free y Pro. Es decir: cualquiera que abra Claude sin pagar nada se encuentra con el modelo nuevo. No es un detalle menor. Cuando un modelo de gama media pasa a ser el suelo del mercado, todo lo que construyes encima cambia de precio y de expectativa.
A nosotros esto nos afecta de forma muy concreta. presupuestaIA no es "un ERP con IA" en el sentido de tener un chat en una esquina. Tiene agentes que hacen trabajo: leen un PDF de proveedor, proponen partidas, revisan una memoria de RITE, contestan una llamada. Cada uno de esos agentes está atado a un modelo. Y cada vez que sale uno nuevo tenemos que decidir si movemos la pieza o la dejamos donde está.
La landing de agentes: una tarjeta y un vídeo por cada uno
El 22 de junio publicamos la landing de agentes IA. Tiene una regla sencilla y algo incómoda: sólo aparece en ella lo que ya funciona en producción. Una tarjeta por agente, con un vídeo corto donde se ve la pantalla real haciendo lo que dice que hace. Sin mockups, sin "próximamente", sin capturas de diseño.
La incomodidad viene de que la lista es más corta de lo que nos gustaría. Hay cosas en las que llevamos meses trabajando que no están ahí porque todavía no aguantan un uso diario sin supervisión. Preferimos una landing corta y verificable a una larga que te haga contratar por algo que luego no encuentras. Si abres el vídeo y ves el agente clasificando un albarán, es porque el agente clasifica albaranes hoy.
Esa landing es también la referencia interna. Cuando alguien del equipo pregunta "¿esto está listo?", la respuesta es literalmente "¿tiene tarjeta?".
Por qué no usamos un solo modelo para todo
La tentación es obvia: eliges el modelo más potente disponible y lo enchufas a todo. Es más fácil de mantener y siempre puedes decir que usas lo último. El problema es que la mayoría de tareas de un ERP no necesitan lo último. Necesitan lo correcto.
Hay tres perfiles de tarea bien distintos dentro del producto:
- Extracción y clasificación. Leer un albarán en PDF, sacar líneas, referencias, cantidades y base imponible. Es trabajo repetitivo, de alto volumen y con una respuesta correcta única. Aquí lo que manda es coste por documento y latencia, no razonamiento profundo.
- Redacción y normativa. Preparar el texto de una memoria, revisar que una partida de clima cita el apartado del RITE que toca, redactar el capítulo de un presupuesto de reforma. Aquí sí quieres un modelo que entienda matices y que no se invente un artículo del reglamento.
- Razonamiento largo. Cruzar un presupuesto con la ejecución real y explicar dónde se ha ido el margen. Poca frecuencia, mucho valor, mucha tolerancia a que tarde treinta segundos.
Meter los tres perfiles en el mismo modelo significa pagar precio de razonamiento largo por leer albaranes. Con el volumen que mueve una distribuidora en un mes, eso se nota en la factura y acaba pagándolo el cliente.
Cómo decidimos si movemos un agente a un modelo nuevo
No cambiamos por titular. El proceso es aburrido a propósito:
- Cada agente tiene un set de casos reales anonimizados. Albaranes de proveedores españoles con formatos horribles, memorias de instalación, presupuestos con capítulos mal numerados. Lo que llega de verdad, no ejemplos limpios.
- Se pasa el set por el modelo candidato y se compara contra el actual. Mismos prompts, mismas herramientas.
- Se mira el coste por ejecución y el tiempo de respuesta, no sólo el acierto.
- Si mejora, va primero a un subconjunto de cuentas y se vigila durante días, no horas.
Con Claude Sonnet 5 el proceso empieza hoy. Lo previsible, viendo cómo se han comportado los saltos anteriores de esta familia, es que los candidatos naturales sean los agentes de extracción y clasificación: son los que más se benefician de que un modelo de gama media suba de nivel. Los de razonamiento largo se quedan donde están hasta que los números digan otra cosa. No vamos a anunciar migraciones que aún no hemos medido.
Lo que significa para ti, que estás en obra
Nada de esto debería notarse en tu pantalla, y ese es el objetivo. Tú abres el módulo de Distribución, subes el albarán del proveedor y esperas que las líneas salgan bien. Que detrás haya cambiado el modelo es problema nuestro.
Lo que sí deberías notar con el tiempo es lo mismo que llevamos viendo desde el año pasado: cada salto de modelo abarata tareas que antes hacía una persona a mano. Cuando el suelo del mercado sube, funciones que hace un año eran caras pasan a ser razonables. Por eso vamos añadiendo agentes en lugar de subir el precio.
Y hay una parte que no cambia con ningún modelo: la responsabilidad sobre el documento firmado sigue siendo del técnico. El agente propone la partida, cita el apartado y deja el rastro. La revisión y la firma son tuyas. Eso lo explicamos ya al hablar de la arquitectura de tres apps y sigue igual de vigente.
Qué hacer ahora
Tres cosas concretas:
- Entra en la landing de agentes. Mira los vídeos. Si un agente que necesitas no tiene tarjeta, es que no está listo y no deberías contar con él.
- Prueba el que más te duela hoy. Si pasas dos horas semanales tecleando albaranes, empieza por ahí. Sube cinco albaranes reales de los que peor salen y mira el resultado.
- Dinos dónde falla. Los casos que nos mandáis son los que acaban en los sets de evaluación. Un albarán mal leído hoy es un agente mejor dentro de tres semanas, y ahora mismo estamos abriendo el set para medir Sonnet 5.
El titular de hoy es de Anthropic. El trabajo de mañana es comprobar si ese titular mueve algo de verdad en la pantalla de un jefe de obra en Albacete. Lo mediremos y lo contaremos.
Agentes en producción
Mira qué agentes IA funcionan hoy en tu ERP
Una tarjeta y un vídeo por cada agente que ya está en producción. Sin mockups ni promesas.
Acceder a la app →