Sora

Sora

OpenAI 的视频生成模型

Sora 是 OpenAI 于 2024 年发布的文本生成视频扩散模型,可根据自然语言提示生成最长约一分钟的高分辨率视频,展示复杂场景运动与物理一致性,推动视频生成进入可用阶段。

核心能力

支持文本到视频、图像到视频;模型将视觉数据视为时空 patch 序列,在压缩潜空间做扩散去噪。早期访问通过 ChatGPT Plus 等渠道逐步开放。

技术路线

基于 Transformer + 扩散框架,结合大规模视频-文本对预训练。OpenAI 强调模拟物理世界运动的能力,但仍有物体恒常性、因果错误等局限。

行业影响

催生 Runway、Pika、Kling 等竞品加速迭代;影视预览、广告素材、教育演示成为首批落地场景,版权与深度伪造治理同步成为焦点。

常见误解

日常交流中容易听到的简化说法,未必准确,但能帮助理解误解从何而来。

  • 「OpenAI 的视频生成模型」
  • 「文本生成视频」
  • 「物理模拟很强」

相关术语

和本术语关联紧密的其他词条,便于串联理解。

🎯 考点练习

含该术语的高频面试题,含标准答案与追问。

延伸阅读

从知识库精选 3 篇文章,帮助深入理解该术语。

  1. 1

    AI Agent 编排模式与架构:从 ReAct 到多智能体协同的完整技术体系

    AI Agent 从单轮对话走向自主任务执行,核心挑战在于如何有效地编排 Agent 的思考、行动和协作流程。本文系统讲解 Agent 编排的完整技术体系——从经典的 ReAct 范式到 Supervisor-Agents 模式,从 Swarm 分布式协作到基于图的复杂工作流,涵盖架构原理、设计模式、代码实现、框架对比和生产实践,是构建生产级 Agent 系统的必读指南。

  2. 2

    AI Agent 编排系统设计模式:从单 Agent 到项目级自主编排的完整指南

    2026 年,AI Agent 从「单兵作战」迈入「项目级自主编排」时代。OpenAI Symphony 展示了 Agent 如何在真实代码库中自主规划、执行、审查和迭代。本文系统梳理 Agent 编排的六种核心设计模式、三种架构拓扑、通信协议选型指南,以及从零构建项目级自主编排系统的完整实战。

  3. 3

    多智能体世界模型:从 Agora-1 看共享环境的构建与协作范式

    多智能体世界模型是 AI Agent 从独立运行走向协作智能的关键基础设施。以 Odyssey 发布的 Agora-1 为切入点,系统解析共享环境建模、多 Agent 状态同步与协作推理的架构与实现路径

外部参考

维基百科:查看「Sora」词条

本页内容为本站原创撰写;维基百科链接仅作延伸参考。