八年研究沉淀,原方智能试图让机器拥有关于世界的「信念」
详细介绍
近日,一家面向通用具身智能的新公司 —— 原方智能(Cirquar AI)正式启动。公司同时发布启动宣言《让机器拥有关于世界的信念》,将世界模型确立为核心技术路线。
2018 年,《World Models》提出让智能体在模型生成的「梦境」中训练策略,推动现代世界模型研究进入主流。同年,LAMDA 团队公开 Virtual-Taobao(arXiv:1805.10000),从真实电商数据中重建虚拟环境,让策略先在模型中学习,再回到真实平台接受检验。
2019 年,LAMDA 团队开始研究隐藏混杂因素下的环境重建(arXiv:1907.06584),关注环境模型是否把历史相关性误当成行动的真实效果。此后,团队陆续研究因果结构世界模型、反事实环境模型和可识别世界表征(arXiv:2206.01474、2206.04890、2306.06561)。
世界模型生成的画面逼真,并不代表它能够帮助机器作出正确决策。单步预测看似准确,也不意味着长程推演不会逐渐偏离现实。
这使世界模型不再只是预测工具,而成为策略学习和现实行动之间的桥梁。
2024 年 11 月,LAMDA 团队公开 WHALE(arXiv:2411.05619),探索可泛化、可扩展的具身世界模型。它尝试从跨任务、跨机器人数据中学习共同的世界规律,同时处理策略变化、长程误差和虚拟经验可信度等问题。
2026 年,团队进一步提出 VLA-MBPO(arXiv:2603.20607),尝试在交互式世界模型中训练视觉 — 语言 — 动作模型。
正如启动宣言所写:让有限经验生长出对世界的理解,让世界模型形成机器的信念,让机器智慧在现实中持续进化。
【开源免费】Browser-use 是一个用户AI代理直接可以控制浏览器的工具。它能够让AI 自动执行浏览器中的各种任务,如比较价格、添加购物车、回复各种社交媒体等。
项目地址:https://github.com/browser-use/browser-use
【开源免费】AutoGPT是一个允许用户创建和运行智能体的(AI Agents)项目。用户创建的智能体能够自动执行各种任务,从而让AI有步骤的去解决实际问题。
项目地址:https://github.com/Significant-Gravitas/AutoGPT
项目地址:https://github.com/geekan/MetaGPT/blob/main/docs/README_CN.md
