AI资讯新闻榜单内容搜索-模型

AITNT-国内领先的一站式人工智能新闻资讯网站
# 热门搜索 #
搜索: 模型
Minimax H3 之后,又来了一位狠角色:智象 HD-V1 发布,视频模型开始理解现实世界!

Minimax H3 之后,又来了一位狠角色:智象 HD-V1 发布,视频模型开始理解现实世界!

Minimax H3 之后,又来了一位狠角色:智象 HD-V1 发布,视频模型开始理解现实世界!

最近几个月,AI 视频赛道开始热起来了: Seedance2.0 发布后,AI 视频进入可用阶段,MiniMax H3 发布后,以 1/4 的价格,把 Seedance 2.0 的成本打了下去,AI 视频成本进入平价时代。

来自主题: AI技术研报
9240 点击    2026-09-16 15:10
自进化社媒Agent!浙大x北大:从多模态任务编排到反馈驱动

自进化社媒Agent!浙大x北大:从多模态任务编排到反馈驱动

自进化社媒Agent!浙大x北大:从多模态任务编排到反馈驱动

当大模型已经能够快速生成文案、图片和视频,一个更进一步的问题是:Agent 能否从执行过的任务中积累经验,并在持续交互中改进后续行为?

来自主题: AI技术研报
9552 点击    2026-09-16 14:40
把记忆交给CPU,大模型会变快

把记忆交给CPU,大模型会变快

把记忆交给CPU,大模型会变快

拿Agent做Coding,想必大家都已经很熟悉了。

来自主题: AI资讯
9957 点击    2026-09-16 14:40
复杂的Harness Evolution,甚至不如多跑几遍

复杂的Harness Evolution,甚至不如多跑几遍

复杂的Harness Evolution,甚至不如多跑几遍

一个 Agent 第一次没把任务做对。

来自主题: AI技术研报
6437 点击    2026-09-16 14:40
谷歌连发两款实时语音模型:Gemini 3.8 Live 要攻克语音 Agent 的沉默时刻

谷歌连发两款实时语音模型:Gemini 3.8 Live 要攻克语音 Agent 的沉默时刻

谷歌连发两款实时语音模型:Gemini 3.8 Live 要攻克语音 Agent 的沉默时刻

谷歌发布 Gemini 3.8 Live 与 Gemini 3.8 Live Extended Thinking 两款实时语音模型,后者支持后台异步推理与工具调用以解决语音 Agent 在任务执行中的沉默问题,两款模型已在 Gemini API 和 Google AI Studio 向开发者开放。

来自主题: AI资讯
8635 点击    2026-09-16 11:43
Meshy 胡渊鸣:GPT-6 Astra 能做 3D 之后,3D 生成产品的价值在哪里?

Meshy 胡渊鸣:GPT-6 Astra 能做 3D 之后,3D 生成产品的价值在哪里?

Meshy 胡渊鸣:GPT-6 Astra 能做 3D 之后,3D 生成产品的价值在哪里?

GPT-6 Astra 把大模型的能力边界,又向 3D 世界推了一步。它可以操作 Blender、编写代码,直接生成 3D 模型和场景。当通用模型开始学会建模,专门做 3D 生成的创业公司会被吃掉吗?

来自主题: AI资讯
9985 点击    2026-09-16 11:08
高德联合南大、清华、北大发布WorldRoamBench,定义交互式世界模型长时漫游评测新范式

高德联合南大、清华、北大发布WorldRoamBench,定义交互式世界模型长时漫游评测新范式

高德联合南大、清华、北大发布WorldRoamBench,定义交互式世界模型长时漫游评测新范式

随着 Genie 3 的发布,可交互世界模型真正走到台前:用户不再只是观看生成视频,而是可以输入动作实时改变一个持续演化的世界。世界模型开始从「生成一段视频」走向「模拟一个可交互世界」,但能走进去,不等于经得起探索。模型能否持续响应控制、维持视觉与空间一致、遵守物理规律并记住来路,仍缺少系统评测。

来自主题: AI技术研报
9022 点击    2026-09-16 10:35
刚刚,中国语音AI连拿多项全球第一!

刚刚,中国语音AI连拿多项全球第一!

刚刚,中国语音AI连拿多项全球第一!

地铁急刹,金属尖叫,广播响起「请乘客注意扶稳」,人群骚动、孩子哭声、对讲机杂音一层层涌上来···

来自主题: AI资讯
7921 点击    2026-09-16 10:09