从炒虾到通用“大脑”,Mobile ALOHA作者带来新模型
从炒虾到通用“大脑”,Mobile ALOHA作者带来新模型近期,由斯坦福大学计算机科学博士符梓鹏(Zipeng Fu)联合创立的新团队Reward AI,正式发布通用机器人策略OM-1(Omnibody Model 1),并公布了完整的Omnibody技术栈。
搜索
近期,由斯坦福大学计算机科学博士符梓鹏(Zipeng Fu)联合创立的新团队Reward AI,正式发布通用机器人策略OM-1(Omnibody Model 1),并公布了完整的Omnibody技术栈。
在此背景下,新加坡国立大学、普林斯顿大学与斯坦福、牛津等研究团队合作提出了 Recuris(Recursive Experiential–Working Memory Evolution),作为首个将递归自我改进应用在记忆控制层内的智能体架构,Recuris 通过三项核心技术突破,无需训练即成功实现了从 3B 小模型到 Claude Opus 5 的全面提升。
随着开源模型能力不断提升,它们已经能够以极低的成本生成多个高质量候选方案,并进一步利用模型自身对这些结果进行验证、打分和筛选。斯坦福团队最新实验发现,使用 DeepSeek V4 Flash + LLM-as-a-Verifier 进行「自验证」,可以在 Terminal-Bench 2.1 上超越 Claude Fable 5,同时整体成本低约 11 倍。
最近两天,X 上网友 Max For AI@MaxForAI 的一篇帖子引发了网友热议:「太疯狂了 —— 现在你甚至可以直播围观一个 535B 大模型是如何被训练出来的。」
同样的模型,同样的任务,让它执行五遍,再让他自己挑一遍最稳的,效果能有多大提升?斯坦福把这套玩法用在了AI身上,DeepSeek V4 Flash在Terminal-Bench 2.1的成绩从79%一路涨到88%,反超了尖子生Fable 5。而且连做五遍加挑选这一通折腾,价格依然比Fable 5便宜了4-11倍。
SparkChat,就盯上了这类朋友之间很日常的社交问题,由Digipals推出,核心创始人Peggy Wang是斯坦福CS本硕,做过Lyft Level 5和Meta Reality Labs,第一次创业的Ego便进入了YC W24,并累计融资750万美元。
2026年了,大学还值得上吗?
最近来自斯坦福大学、CMU、MIT、UT Austin 等高校和科研机构的研究人员联合发布了全球首个系统提示词库 System Prompt Index(systempromptindex.ai),其中汇集了来自 Claude、ChatGPT 等 400 多款 AI 产品的 1000 余个系统提示词,是目前全球规模最大的 AI 系统提示词库。
在最近的一场访谈中,斯坦福数字经济实验室主任Erik Brynjolfsson把AI换了一个说法:Amplifying Intention,意为放大意图。模型会把一个人的行动能力放大。但方向是哪里,仍然取决于使用它的人。
AI首次造出了,自然界不存在的病毒!消息一出,瞬间引爆全网。今天,一项来自斯坦福大学与Arc Institute的颠覆性研究,登上了顶刊Science。在这项实验中,AI一口气生成了70万个病毒基因组,其中精选了285条,进行了DNA人工合成。