AI资讯新闻榜单内容搜索-模型训练

AITNT-国内领先的一站式人工智能新闻资讯网站
# 热门搜索 #
搜索: 模型训练
大模型Scaling撞上成本墙:三星提出TrOPD新方法,把前沿智能塞进数亿终端

大模型Scaling撞上成本墙:三星提出TrOPD新方法,把前沿智能塞进数亿终端

大模型Scaling撞上成本墙:三星提出TrOPD新方法,把前沿智能塞进数亿终端

三星大模型团队联合牛津大学、北京大学提出TrOPD方法,通过信任域机制让端侧模型更稳定高效地继承大模型推理能力,在数学、代码、指令遵循、STEM基准上全面超越现有OPD方法,为前沿智能以更低成本走向数亿终端提供新路径。

来自主题: AI技术研报
7766 点击    2026-09-18 15:48
EMNLP 2026主会|北大×易鑫AI Lab:大模型明明「知道」,为什么还会答错?

EMNLP 2026主会|北大×易鑫AI Lab:大模型明明「知道」,为什么还会答错?

EMNLP 2026主会|北大×易鑫AI Lab:大模型明明「知道」,为什么还会答错?

北京大学与易鑫AI Lab合作论文被EMNLP 2026主会接收,提出大模型"读出瓶颈"(Readout Bottleneck)概念,指出模型隐藏状态已编码正确答案却被输出层偏置掩盖,仅用2个无标签参数修正即可在多项推理任务上将准确率从33.3%盲猜水平大幅恢复。

来自主题: AI技术研报
7604 点击    2026-09-18 15:48
流式推理优化,让机器人决策延迟低至0.68秒

流式推理优化,让机器人决策延迟低至0.68秒

流式推理优化,让机器人决策延迟低至0.68秒

SimpleMemVLA由面壁智能联合华中科技大学等机构提出,将带时间戳的原生视觉历史直接作为机器人记忆上下文,在四项记忆基准取得SOTA并涌现视觉上下文学习能力,同时通过流式推理优化将60秒历史决策延迟从1.02秒降至0.68秒。

来自主题: AI技术研报
9023 点击    2026-09-18 15:47
CoRL 2026重磅开源!Sharpa世界联觉模型实现真实扰动鲁棒手内操作

CoRL 2026重磅开源!Sharpa世界联觉模型实现真实扰动鲁棒手内操作

CoRL 2026重磅开源!Sharpa世界联觉模型实现真实扰动鲁棒手内操作

灵巧手从 demo 走向真实应用,关键不只是 “会不会动”,而是能否在 noisy depth、稀疏触觉、外力扰动和未见物体下稳定泛化。现有 in-hand manipulation 往往依赖固定物体、定初始位姿或理想传感器。而一旦遇到真实深度噪声、形状变化和接触状态不可见,这些策略就容易退化成近乎开环的 “手指套路”。

来自主题: AI技术研报
10133 点击    2026-09-18 09:59
TPAMI26 | 全面升级PolaFormer++:极性感知计算流 +通道级尖峰,实现线性注意力的新天花板

TPAMI26 | 全面升级PolaFormer++:极性感知计算流 +通道级尖峰,实现线性注意力的新天花板

TPAMI26 | 全面升级PolaFormer++:极性感知计算流 +通道级尖峰,实现线性注意力的新天花板

继 ICLR 2025 的 PolaFormer 之后,哈工大(深圳)与鹏城实验室合作的扩展版本 PolaFormer++ 近日被 IEEE TPAMI 正式接收。新版本在理论框架、特征映射设计和实验覆盖面上全面升级:首次给出判定特征映射是否具备「降熵尖锐性」的理论判据,并提出极性感知的通道级尖锐(PaCS)特征映射,在六大类视觉核心任务上全面验证了线性注意力的潜力。

来自主题: AI技术研报
8319 点击    2026-09-18 09:35