韩国 Upstage 发布 Solar Pro 4:面向 Agentic 场景的主权基础模型
2026 年 8 月 12 日,韩国 AI 实验室 Upstage 发布 Solar Pro 4,Artificial Analysis Intelligence Index 得分 42(Solar Pro 3 为 14)。模型面向 Agentic 工作流、办公生产力、文档密集型任务和编码。Upstage 称 Solar Pro 4 通过 OfficeVerse 管线从 11 个行业领域、12 种任务类型的真实公开数据合成训练,每项任务按最终交付物通过/失败评分。
Upstage 发布 Solar Pro 4
Upstage 发布。这是区域性主权基础模型的重要进展,通过 OfficeVerse 训练管线在真实任务上训练,按最终交付物评分。
核心数据
| 指标 | 数据 |
|---|---|
| Intelligence Index | 42(Solar Pro 3 为 14) |
| 场景 | Agentic 工作流、办公生产力、文档、编码 |
| 训练数据 | OfficeVerse 管线,11 行业 12 任务类型 |
| 评分 | 按最终交付物通过/失败评分 |
| 定价 | $0.30/1M input tokens, $1.20/1M output tokens |
技术策略
- OfficeVerse 管线:从真实公开数据合成办公任务
- 交付物评分:每项任务按最终交付物通过/失败评分,而非 benchmark
- 主权模型:韩国主权基础模型,降低对少数头部模型依赖
行业信号
- 从 benchmark 到交付物:反映"在真实任务上训练"的趋势
- 区域性主权:各国降低对少数头部模型依赖的选项
- Agentic 场景:办公生产力成为基础模型的重要应用方向
风险与边界
- Intelligence Index 42 仍远低于 GPT-5.6 Sol(61)和 Claude Fable 5 Max
- OfficeVerse 训练方法的具体细节和可复现性未完全披露
- 韩国主权模型的定位在其他地区的适用性有限
- 定价竞争力需与其他模型对比验证
AI Master 解读
核心事件
韩国 Upstage 发布 Solar Pro 4 主权基础模型。
行业影响
为什么重要: 这是区域性主权基础模型的重要进展。Solar Pro 4 Intelligence Index 得分从 14 跃升至 42,面向 Agentic 场景和办公生产力。Upstage 通过 OfficeVerse 管线从真实公开数据合成训练,按最终交付物评分,反映"在真实任务上训练"而非"在 benchmark 上训练"的趋势。
影响分析:
| 维度 | 影响 |
|---|---|
| 性能 | Intelligence Index 14 → 42 |
| 场景 | Agentic 工作流、办公生产力、文档、编码 |
| 训练 | OfficeVerse 管线,11 行业 12 任务类型 |
| 主权 | 韩国主权基础模型,降低对头部模型依赖 |
AI Master 建议
评估 Solar Pro 4 在 Agentic 和办公场景的适用性;关注区域性主权模型对降低头部依赖的价值;跟踪 OfficeVerse 训练方法在其他模型的推广。 **来源:** Upstage / Artificial Analysis / LLM24 / NanoGPT **链接:** https://www.upstage.ai/blog/en/solar-pro-4
