AI资讯新闻榜单内容搜索-大模

AITNT-国内领先的一站式人工智能新闻资讯网站
# 热门搜索 #
搜索: 大模
刚刚,Gemini 4 Pro偷跑上线!碾压Astra和Fable

刚刚,Gemini 4 Pro偷跑上线!碾压Astra和Fable

刚刚,Gemini 4 Pro偷跑上线!碾压Astra和Fable

谷歌DeepMind疑似下一代旗舰模型Gemini 4 Pro以"gemini-3.8-flash"之名匿名亮相大模型竞技场Arena,在编码、智能体和推理等基准测试中全面超越Astra和Fable,并在网页设计、SVG、3D建模及游戏生成等实测中表现出色。

来自主题: AI资讯
5737 点击    2026-09-18 15:49
大模型Scaling撞上成本墙:三星提出TrOPD新方法,把前沿智能塞进数亿终端

大模型Scaling撞上成本墙:三星提出TrOPD新方法,把前沿智能塞进数亿终端

大模型Scaling撞上成本墙:三星提出TrOPD新方法,把前沿智能塞进数亿终端

三星大模型团队联合牛津大学、北京大学提出TrOPD方法,通过信任域机制让端侧模型更稳定高效地继承大模型推理能力,在数学、代码、指令遵循、STEM基准上全面超越现有OPD方法,为前沿智能以更低成本走向数亿终端提供新路径。

来自主题: AI技术研报
7837 点击    2026-09-18 15:48
豆包大模型再更新,发力多模态编程,一手实测来了

豆包大模型再更新,发力多模态编程,一手实测来了

豆包大模型再更新,发力多模态编程,一手实测来了

字节跳动发布新版豆包2.1 Pro(0915版本),重点升级多模态编程与视觉理解能力,可依据设计图、图纸和操作录屏生成代码,编辑团队通过山西3D旅行导览、小王子微缩星球等场景实测,验证其在Agent任务交付与Token效率方面的提升。

来自主题: AI资讯
7431 点击    2026-09-18 15:48
EMNLP 2026主会|北大×易鑫AI Lab:大模型明明「知道」,为什么还会答错?

EMNLP 2026主会|北大×易鑫AI Lab:大模型明明「知道」,为什么还会答错?

EMNLP 2026主会|北大×易鑫AI Lab:大模型明明「知道」,为什么还会答错?

北京大学与易鑫AI Lab合作论文被EMNLP 2026主会接收,提出大模型"读出瓶颈"(Readout Bottleneck)概念,指出模型隐藏状态已编码正确答案却被输出层偏置掩盖,仅用2个无标签参数修正即可在多项推理任务上将准确率从33.3%盲猜水平大幅恢复。

来自主题: AI技术研报
7676 点击    2026-09-18 15:48
和「豆包爱学」一起长大的孩子,会少走多少弯路?

和「豆包爱学」一起长大的孩子,会少走多少弯路?

和「豆包爱学」一起长大的孩子,会少走多少弯路?

豆包爱学2.0依托豆包多模态大模型与Seedance系列模型,将AI嵌入语数英等学科的问答、板书讲解、定制课程、听写和错题整理等学习全流程,同一对话入口即可围绕知识点不断生成完整学习内容,展现字节在AI教育场景的工程化能力。

来自主题: AI资讯
7324 点击    2026-09-18 15:46
Anthropic做药,Isomorphic补大模型,Anew带着什么走到台前?

Anthropic做药,Isomorphic补大模型,Anew带着什么走到台前?

Anthropic做药,Isomorphic补大模型,Anew带着什么走到台前?

一笔融资、一份技术报告,让一个过去五年鲜少公开发声的团队,逐渐显露出更完整的面貌。

来自主题: AI技术研报
9869 点击    2026-09-17 15:22
AI Agent安全不能只靠Prompt了:上海AI Lab探索Agent安全进化新范式

AI Agent安全不能只靠Prompt了:上海AI Lab探索Agent安全进化新范式

AI Agent安全不能只靠Prompt了:上海AI Lab探索Agent安全进化新范式

大模型 Agent 进入浏览器、邮件、数据库和业务系统后,安全评估如果仍只检查最终回复是否包含有害内容,覆盖面会明显不足。Agent 需要规划步骤、读取外部信息并调用工具,风险可能出现在执行过程中的任一环节。

来自主题: AI技术研报
6888 点击    2026-09-17 14:55