Skip to content
DigitalNeuron
Modelos e investigación

Upstage lanza Solar Pro 4 para tareas de agentes de varios pasos

Solar Pro 4 admite el uso de herramientas, tareas de terminal y razonamiento sobre documentos extensos, con una ventana de contexto de 512K tokens y entrada y salida multilingües.

Por DigitalNeuron Desk3 min de lectura

Respuesta rápida

¿Qué anunció Upstage con Solar Pro 4?

Upstage lanzó Solar Pro 4, un modelo accesible mediante API y diseñado para tareas de agentes de varios pasos que implican documentos, herramientas y operaciones en terminal. La empresa afirma que admite una ventana de contexto de 512K tokens, genera hasta 128K tokens de salida, trabaja en inglés, coreano y japonés, e informa cuando las pruebas aportadas no permiten sustentar una respuesta.

Claves

  • Upstage afirma que Solar Pro 4 está diseñado para completar trabajos de varios pasos en documentos, herramientas y entornos de terminal.
  • El modelo admite una ventana de contexto de 512K tokens, hasta 128K tokens de salida y entrada y salida en inglés, coreano y japonés.
  • Upstage fija el precio estándar de la API en 0,30 dólares por millón de tokens de entrada, 0,06 dólares por millón de tokens de entrada almacenados en caché y 1,20 dólares por millón de tokens de salida.
  • Solar Pro 4 está disponible a través de Upstage Console, SolarChat, OpenRouter, Hermes Agent y Upstage Studio, y también se ofrecen implementaciones dedicadas y locales.
  • La empresa afirma que el modelo identifica afirmaciones sin respaldo y discrepancias, en lugar de proporcionar respuestas no verificadas.

Upstage ha lanzado Solar Pro 4, un modelo de lenguaje agéntico creado para trabajos que abarcan varios documentos, llamadas a herramientas y tareas de terminal. La empresa afirma que el modelo está concebido para llevar los encargos hasta la entrega de resultados completos e identificar los casos en los que las pruebas disponibles no permiten sustentar una respuesta.

Solar Pro 4 admite una ventana de contexto de 512K tokens y hasta 128K tokens de salida. Trabaja en inglés, coreano y japonés, tanto para la entrada como para la salida. Los usuarios también pueden ajustar el nivel de razonamiento: aumentarlo para realizar análisis más profundos o reducirlo para agilizar la interacción.

Trabajo con agentes y documentos

Upstage informó de puntuaciones de 57,0 en Terminal-Bench v2.1, 23,0 en τ³-Banking y 71,0 en AA-LCR. La empresa vincula estas evaluaciones, respectivamente, con la ejecución en terminal, el uso de herramientas en varios turnos y el razonamiento sobre documentos extensos. Indicó que las tres puntuaciones procedían de Artificial Analysis a agosto de 2026 y que próximamente se publicarían.

La empresa señaló que Solar Pro 4 se entrenó con OfficeVerse, su sistema para sintetizar tareas de oficina a partir de datos públicos de 11 sectores y 12 tipos de tareas. Las tareas reciben una calificación de aprobado o suspenso basada en el resultado final. Upstage afirmó que Ko-GDPval, su prueba de referencia para el trabajo de oficina en coreano, surgió de la misma iniciativa.

Para demostrar las capacidades del modelo, Upstage le asignó una tarea ficticia de selección de ubicación para una tienda que incluía un documento de políticas y seis archivos de datos de mercado. Según la empresa, tres instrucciones guiaron a Solar Pro 4 para evaluar 10 ubicaciones candidatas y elaborar, de forma secuencial, un libro de Excel, un informe de revisión y una presentación de diapositivas. Upstage afirmó que un valor calculado en el libro se trasladó sin cambios al informe.

Upstage también publica siete agentes de trabajo mediante Solar Pro 4 Agent Cookbook. Los ejemplos abarcan la generación de libros de Excel, informes de Word basados en pruebas y presentaciones de PowerPoint con gráficos y notas del orador. Cada uno incluye una instrucción de sistema, resultados y criterios de aprobación.

Gestión de las pruebas

Upstage afirma que Solar Pro 4 puede distinguir entre respuestas respaldadas e información ausente o contradictoria. En una prueba con un acuerdo de servicios y un presupuesto ficticios, la empresa formuló 10 preguntas, la mitad de las cuales tenían respuesta en los documentos aportados. Según indicó, el modelo citó las cláusulas existentes, señaló que el material ausente no figuraba en el documento e informó de las cifras divergentes como discrepancias.

El recetario también incluye un agente de investigación que, según Upstage, vincula cada frase con una fuente y etiqueta como no verificado el material que no puede fundamentar.

Acceso y precios

Solar Pro 4 está disponible a través de la API de Upstage Console con el nombre de modelo solar-pro4. Upstage afirma que la API es compatible con OpenAI. El modelo también se ofrece mediante SolarChat, OpenRouter, Hermes Agent y Upstage Studio. Es posible contratar implementaciones dedicadas y locales poniéndose en contacto con la empresa.

Upstage fija los precios por millón de tokens en 0,30 dólares para la entrada, 0,06 dólares para la entrada almacenada en caché y 1,20 dólares para la salida. La empresa anunció un descuento del 90 % en Upstage Console hasta el 10 de septiembre a las 23:59 UTC y también indicó que OpenRouter ofrece una promoción del 90 % hasta el 10 de septiembre. Otra oferta de Hermes Agent estará vigente hasta el 15 de septiembre.

Fuente: anuncio de Upstage «Solar Pro 4: The Agentic Model That Finishes the Job», publicado el 11 de agosto de 2026.

Preguntas frecuentes

¿Para qué está diseñado Solar Pro 4?
Upstage describe Solar Pro 4 como un modelo agéntico para trabajos de varios pasos que implican llamadas a herramientas, tareas de terminal y razonamiento sobre documentos extensos.
¿Qué límites de contexto y salida admite Solar Pro 4?
La empresa afirma que el modelo admite una ventana de contexto de 512K tokens y hasta 128K tokens de salida.
¿Qué idiomas admite Solar Pro 4?
Upstage afirma que Solar Pro 4 acepta y genera contenido en inglés, coreano y japonés.
¿Cómo pueden acceder los clientes a Solar Pro 4?
Upstage ofrece acceso mediante su API de Console, SolarChat, OpenRouter, Hermes Agent y Upstage Studio. También ofrece implementaciones dedicadas y locales.

Fuentes

  1. Solar Pro 4: The Agentic Model That Finishes the JobUpstage
Etiquetasupstagesolar-pro-4agentic-ailanguage-modelstool-usemultilingual-ai

Lecturas relacionadas

Anthropic explica cómo los laboratorios de investigación están creando agentes científicos impulsados por Claude

Anthropic publicó un caso de estudio el 15 de enero de 2026 en el que describe tres laboratorios de investigación —el proyecto Biomni de Stanford, el Cheeseman Lab del MIT y el Lundberg Lab de Stanford— que desarrollaron sistemas basados en Claude para tareas como la interpretación de clústeres genéticos, el análisis de datos biomédicos y la selección de genes para estudiar experimentalmente.

3 min de lectura

Anthropic publica su segundo informe del Índice Económico sobre el uso de Claude 3.7 Sonnet

El segundo informe del Índice Económico de Anthropic constató un aumento del uso de Claude.ai en programación, educación, ciencia y atención sanitaria tras el lanzamiento de Claude 3.7 Sonnet. El modo de pensamiento extendido fue utilizado sobre todo en profesiones técnicas. La ampliación de capacidades se mantuvo estable en el 57% del uso, y Anthropic publicó una nueva taxonomía de 630 categorías de uso, además de datos sobre automatización a nivel de tareas.

4 min de lectura

Análisis: los benchmarks públicos dejaron de predecir la calidad en producción — cómo construir un conjunto de evaluación que sí lo haga

Los benchmarks públicos miden tareas estrechas, estáticas y ampliamente publicadas, y cada vez están más contaminados por los datos de entrenamiento y optimizados de forma directa para superarlos. La calidad en producción depende de los prompts propios, los documentos propios, los esquemas de herramientas propios y la tolerancia a fallos de cada equipo, nada de lo cual mide ninguna tabla de clasificación. La respuesta práctica es un conjunto de evaluación privado de entre 50 y 300 casos reales con el comportamiento esperado registrado, que se ejecuta con cada cambio de modelo o de prompt, puntuado mediante comprobaciones exactas cuando es posible y, cuando no, mediante un modelo juez guiado por una rúbrica.

7 min de lectura