Sora 是目前最接近世界模型概念的商业化产品,但 OpenAI 并没有明确把它定义为世界模型,而是称之为物理世界的模拟器… 如何识别这些物理幻觉,如何设计测试场景来暴露模型的物理盲区,如何构建评估体系来量化模型的物理理解能力 —— 这些都是世界模型时代训练师需要具备的新能力 … 用一个不太精确但很直观的比喻:如果未来的通用 AI 系统是一个人,那 LLM 是这个人的语言中枢,多模态是这个人的感知系统,而世界模型是这个人的认知中枢 —— 把感知到的信息、理解到的知识,整合成对世界的动态理解和行动规划能力。
暂无讨论,说说你的看法吧

