事件与背景
2026 年 8 月 11 日,商汤科技旗下"日日新"宣布全新多模态智能体模型 SenseNova 6.8 Flash Lite Preview 预览版正式上线 SenseNova Token Plan。官方 GitHub 仓库 OpenSenseNova/SenseNova6.8 同步上线,IT之家、雷峰网、品玩等媒体密集报道。该模型定位"委派智能"(Delegated Intelligence):用户负责提出目标,AI 自主规划、执行完整工作流并交付最终结果,人负责结果验收。
关键事实
| 项目 | 详情 |
|---|---|
| 模型 | SenseNova 6.8 Flash Lite Preview(预览版) |
| 定位 | 委派智能(Delegated Intelligence) |
| 发布渠道 | SenseNova Token Plan(每 5 小时 1500 次免费体验) |
| 核心能力 | 数百步长程执行、十余个子 Agent 动态协作、失败回退、原生多模态操作 |
| 发布时间 | 2026 年 8 月 11 日 |
技术机制或行业解释
SenseNova 6.8 Flash Lite Preview 围绕三大支柱构建"委派智能":一是稳定长上下文与长程执行——在数百步、跨阶段的任务中维持目标与约束,可连续工作数小时,检测失败并回滚重规划;二是动态子 Agent 协作——主 Agent 动态组织并调度十多个专业子 Agent,并行执行研究、数据分析、数学推理、视觉理解与事实核查,再把中间结果整合为一致输出;三是原生多模态融合——统一理解文本、图像、图表、文档、视频、网页与应用界面,沿一条任务轨迹完成规划、推理、工具调用与结果验证。
影响与意义
对中国模型厂商,"委派智能"代表从"模型能力竞争"向"任务交付能力竞争"的转向:评估标准从 benchmark 分数变为"复杂工作流能否自主跑完并交付"。对 Agent 生态,数百步长程执行与多子 Agent 协作是当下 Agent 落地最大的工程难点,商汤以预览版形式开放这些能力,有利于推动多 Agent 架构的工程成熟度;对企业用户,模型能"给目标就能跑完整工作流"意味着 RPA 与业务流程自动化的新选项,可能改变办公自动化工具的选型逻辑。
风险边界
预览版明确标注"行为、可用性与接口可能演变",正式版 6.8 Flash Lite 与 6.8 Flash 尚未发布;"数百步长程执行"的稳定性与成本(token 消耗、失败重试)需实测验证;多子 Agent 协作的可靠性在真实复杂任务上仍存不确定性;与 Claude、GPT 等国际模型的代差需通过同任务对比确认;委派智能的误操作风险(自主执行破坏性动作)需要安全边界设计。
后续观察
关注正式版 6.8 Flash Lite 与 6.8 Flash 的发布时间与能力差异;实测长程任务的完成率、失败回退成功率与端到端成本;对比"委派智能"与 Anthropic/OpenAI agentic 能力在真实工作流上的表现;关注 SenseNova Token Plan 的定价策略与开发者生态建设。
AI Master 解读
核心事件
商汤 8/11 上线 SenseNova 6.8 Flash Lite Preview,定位"委派智能"(Delegated Intelligence)——用户给目标、AI 全流程执行并交付结果。
行业影响
为什么重要: 中国大模型厂商此前的竞争焦点在参数规模与基准分数,而 SenseNova 6.8 把差异化锚点放在"长程任务交付"这一产品体验上:数百步执行、多子 Agent 协作、失败回退与多模态操作,本质上是把 Agent 从"工具调用演示"推向"可委派的数字化员工"。这与 Anthropic、OpenAI 的 agentic 方向同频,但以预览版快速开放体验的方式抢占开发者心智;对行业而言,"委派智能"提供了一个可量化评估 Agent 完成度的新框架——不是看单轮回答质量,而是看复杂工作流能否自主跑完并交付可靠结果。
AI Master 建议
用真实长程任务(如多步骤数据分析、跨工具工作流)实测 SenseNova 6.8 Flash Lite Preview 的完成率与失败回退质量,而非只看官方 demo;把"委派智能"能力纳入多 Agent 架构选型评估,与 Claude、GPT 等国际模型做同任务对比;关注正式版 6.8 Flash 的能力边界与 API 定价。
