这个只会做选择题的Jev,却是今年我看到的最特别的大模型。
这个只会做选择题的Jev,却是今年我看到的最特别的大模型。这两天,如果说最火的大模型是什么,那可能只有一个名字。
搜索
这两天,如果说最火的大模型是什么,那可能只有一个名字。
人类真的走到AGI门口了!
灵巧手从 demo 走向真实应用,关键不只是 “会不会动”,而是能否在 noisy depth、稀疏触觉、外力扰动和未见物体下稳定泛化。现有 in-hand manipulation 往往依赖固定物体、定初始位姿或理想传感器。而一旦遇到真实深度噪声、形状变化和接触状态不可见,这些策略就容易退化成近乎开环的 “手指套路”。
小布、ColorOS 17 与「AI 硬件」
继 ICLR 2025 的 PolaFormer 之后,哈工大(深圳)与鹏城实验室合作的扩展版本 PolaFormer++ 近日被 IEEE TPAMI 正式接收。新版本在理论框架、特征映射设计和实验覆盖面上全面升级:首次给出判定特征映射是否具备「降熵尖锐性」的理论判据,并提出极性感知的通道级尖锐(PaCS)特征映射,在六大类视觉核心任务上全面验证了线性注意力的潜力。
AI完成任务之后,还能留下什么?
OpenAI还有大结果即将公布!
先理解,后生成,更懂物理规律的视频模型。
刚刚,Anthropic首次自曝绝密底牌:3万个AI正在研发下一代自己,正在疯狂自我进化。
智谱首席科学家唐杰发布 GLM-5.3-Flash 推理系统优化成果,模型仅用两周在超 10 万颗国产 AI 加速器集群上完成生产部署,端到端吞吐提升 3.2 倍,并由 GLM-5.3 驱动的 Infra Agent 参与瓶颈分析与代码修改,标志着智谱首个 RSI(递归自我改进)早期形态的落地。
用户在Code Arena的battle模式中发现疑似Gemini 4 Pro新检查点(内部代号argon)伪装为gemini-3.8-flash进行盲测,据爆料其支持256K最大输出和2M上下文窗口,原定9月发布的Gemini 4 Pro已因预训练问题推迟至10月。
Manus从Meta分拆独立后即将完成约33亿元人民币的首轮融资,估值较此前20亿美元翻倍至约268亿元人民币,融资完成后有望成为中国估值最高的通用AI智能体公司。
继“牛来”Ox Alpha 之后,OpenRouter 昨晚上又出现了一款身份不明的模型。
你敢信,曾经全力推动 AI 学着说话的人,现在做出了一个「闭嘴」的模型。
谷歌,可能已经破解了RSI!
当行业都在把AI能力往输入法壳子里做增量,腾讯正在做一套独立的AI原生输入工具。
想象一下,你正在赶一份 PPT,突然想让 AI 把一张产品图改成海报。
一笔融资、一份技术报告,让一个过去五年鲜少公开发声的团队,逐渐显露出更完整的面貌。
9 月 3 日,OpenAI 正式发布 GPT-6 Astra。在 ARC-AGI-3(一个考验 AI 能否在陌生环境中自主探索、理解规则并规划行动的 Benchmark),Astra 拿下 99.9%,并在 96% 的关卡中达到或超过人类的行动效率基准。
AI发展到今天,一个越来越扎心的事实是—— 对于手机这个终端设备来说,AI能力更强,并不意味着用户「体验更好」。
录音卡、副屏、电子纸、AI 宠物……
最近Seed-2.1-pro又更新了。
RSI,彻底火了。
真实世界的时间序列,不仅被外部事件冲击,也被人为决策持续重塑。
大模型 Agent 进入浏览器、邮件、数据库和业务系统后,安全评估如果仍只检查最终回复是否包含有害内容,覆盖面会明显不足。Agent 需要规划步骤、读取外部信息并调用工具,风险可能出现在执行过程中的任一环节。
前不久,微信视觉团队开源了WeMM-Embedding。
AI要学会自己改进自己,谷歌打算先让它做个“梦”。
什么情况?小米新模型的强化学习训练,直接开了现场直播。
两年半多,终于等到一次反转!
从今天起,Claude Cowork 和 Claude Chat 将合并为一个统一的 Claude。