魅力生活

首页 > 魅力生活

Upstage“Solar Pro 4”上线3天Token使用量突破800亿

新闻发布 [2026-08-14 10:00] 翻译: among2008@asiatoday.co.kr
放大 缩小 打印 weibo
Upstage

韩国AI企业Upstage推出新一代大语言模型(LLM)“Solar Pro 4”,正式进军全球AI开发者市场。该模型的特点是突破单纯问答模式,强化了文档分析及调用外部工具完成复杂任务的智能体(Agent)能力。

 

Upstage14日表示,Solar Pro 4发布后,成为首个正式进入全球应用程序接口(API)分发平台“OpenRouter”的韩国AI模型,同时还可通过美国Nous Research的AI智能体“Hermes Agent”使用。

 

OpenRouter是一个连接平台,开发者可以通过统一API比较和使用多种AI模型。Upstage成为首家正式入驻该平台的韩国企业,与OpenAI、Anthropic、谷歌等美国企业,以及DeepSeek、Moonshot、MiniMax等中国企业展开竞争。

 

Solar Pro 4的初期使用量也快速增长。据公司介绍,上线OpenRouter仅3天后,Solar Pro 4累计Token使用量就超过800亿个。这意味着全球开发者已经开始在实际服务和AI智能体构建过程中使用该模型。

 

Solar Pro 4重点面向需要多个步骤的实际工作任务进行开发。该模型不仅能够完成文档理解、信息提取和基于长上下文的推理,还能将连续决策及工具调用整合在同一工作流程中。模型支持512K上下文窗口和最高128K输出Token,并能够处理韩语、英语和日语。

 

为让模型在与实际办公室工作类似的环境中接受训练,Upstage采用了自主开发的训练流水线“OfficeBus”。公司基于公开数据构建了11个行业领域和12种工作类型,让模型完成Excel分析、报告及演示资料制作等最终成果,以提升实际工作能力。

 

在多项基准测试中,Solar Pro 4也较上一代产品取得明显提升。在评估模型能否在终端环境中完成任务的“Terminal-Bench v2.1”测试中,Solar Pro 4得分从Solar Pro 3的12分提升至57分,约提高4.8倍。衡量多次调用工具能力的“τ³-Bench Banking”得分则从9分提升至23分,提高2.6倍。

 

在长文档理解和分析能力测试“AA-LCR”中,得分也从31分提升至71分,约提高2.3倍。全球AI评估机构Artificial Analysis的综合性能指数则从上一代的14分提升至42分,达到原来的3倍。

 

Solar Pro 4还成为首个进入全球主要AI模型智能体能力比较平台“Agent Arena”的韩国模型。Upstage表示,Solar Pro 4在首次评测中取得了与英伟达“NemoTron 3 Ultra”相近的性能水平。

 

Upstage首席执行官金成勋表示:“作为首个韩国模型登上全球开发者平台,这是韩国AI技术能够在全球实际应用场景中获得认可的证明。”他表示:“公司将以经过实际应用验证的技术实力为基础,持续打造具有高实用性的AI。”

 

孙康勋 记者

国际热点