三类视觉Token分配,能直接解决高压缩时序碎片化 | ECCV‘26
三类视觉Token分配,能直接解决高压缩时序碎片化 | ECCV‘26长视频理解,正在成为多模态大模型的重要能力。
搜索
长视频理解,正在成为多模态大模型的重要能力。
在刚刚落幕的2026 WAIC世界人工智能大会上,无问芯穹首次公布了其在大模型推理系统架构中的新突破——跨集群异构推理架构PDD。
近期,SemiAnalysis 创始人 Dylan Patel 先后做客红杉资本的《Training Data[1]》和 WisdomTree 的《The Next Big Thing[2]》。两期访谈从模型和芯片,一路延伸至内存、能源、数据中心与 AI 商业模式,并指向同一个变化:AI 竞赛的焦点,正从单纯比较模型能力,扩展到谁能以更低成本、更大规模,把模型能力稳定地交付出来。
这几天,关于 OpenAI 的硬件生态版图的曝光急速增加,无论是彭博社关于音箱细节的报道,还是来自供应链分析师郭明錤关于手机规格和代工名额单的详细调查,都让我们逐渐拼齐了 OpenAI 硬件这头大象的实际轮廓:
成本砍20%、效率提升15%。
“推理轻量化,训练提效 25%,前端效果同样惊艳。 ”
7月29日消息,深信服公布其AI安全智能体Sangfor AI在AI安全评测CyberGym中的最新成绩。
就是上个月我开源的让Claude Code和Codex搭配使用的Skill搭子的1.4版,当时的定位是把Claude Code出计划然后直接在当前对话调用Codex,不需要复制黏贴,由Fable5自己写交接文档自己从CodeX那读取输出。
今日,马斯克旗下SpaceXAI宣布推出新一代语音模型Grok Voice Think Fast 2.0,这是该公司迄今能力最强的语音到语音(speech-to-speech)模型。马斯克连发两条推文,第一条宣布“Grok Voice现在在智能体性能方面排名第一”,第二条则直接喊话网友“试试新的Grok Voice”。
据英国《金融时报》7 月 29 日报道,谷歌 DeepMind 已经重组了曾打造诺贝尔奖级成果 AlphaFold 的核心团队:不再保留独立的 AlphaFold 团队,而是将相关研究人员分流至多个战略项目。这一调整被视为 DeepMind 将重心进一步转向 Gemini 大模型和 AI Agent 的重要信号。