AI资讯新闻榜单内容搜索-端到端

AITNT-国内领先的一站式人工智能新闻资讯网站
# 热门搜索 #
搜索: 端到端
jina-ocr-v1:在低成本 GPU 上更快解析文档

jina-ocr-v1:在低成本 GPU 上更快解析文档

jina-ocr-v1:在低成本 GPU 上更快解析文档

Jina AI 发布端到端文档解析模型 jina-ocr-v1,以 3.4B 总参数/570M 激活参数在 OmniDocBench v1.6 与 olmOCR-Bench 上刷新同级别最佳成绩,并凭借 FastMTP 推测解码与分级密集奖励在低成本 GPU 上实现无损近倍速生成,单页仅输出 1085 个 token 以 2.57 页/秒吞吐领跑 14 款主流系统。

来自主题: AI资讯
8744 点击    2026-09-18 17:29
GLM-5.3-FlashX 上线:200 tokens/s

GLM-5.3-FlashX 上线:200 tokens/s

GLM-5.3-FlashX 上线:200 tokens/s

智谱上线 GLM-5.3-FlashX 模型,推理速度最高达 200 tokens/s,较 GLM-5.3-Flash 提速 5 倍、提价 2.5 倍,API 同步开放,该模型在 10 万张国产芯片提供的推理算力基础上,由 GLM-5.3 驱动 Agent 在两周内完成端到端构建并通过 Infra 侧优化将吞吐提升至初始基线的 3 倍。

来自主题: AI资讯
8248 点击    2026-09-18 15:49
智谱唐杰突发长文曝RSI进展:Agent优化10万卡集群吞吐暴涨200%,AI造AI还远吗?

智谱唐杰突发长文曝RSI进展:Agent优化10万卡集群吞吐暴涨200%,AI造AI还远吗?

智谱唐杰突发长文曝RSI进展:Agent优化10万卡集群吞吐暴涨200%,AI造AI还远吗?

智谱创始人唐杰发文披露RSI最新进展,称由GLM-5.3驱动的Infra Agent在超过10万卡国产芯片集群上不到两周内完成GLM-5.3 Flash生产级推理服务搭建,将端到端吞吐提升至初始基线的3倍,表明RSI最小闭环已经形成但距离递归自我改进仍很遥远。

来自主题: AI资讯
8805 点击    2026-09-18 15:47
刚刚,智谱首个 RSI 成果发布,10 万国产卡用 GLM 造 GLM

刚刚,智谱首个 RSI 成果发布,10 万国产卡用 GLM 造 GLM

刚刚,智谱首个 RSI 成果发布,10 万国产卡用 GLM 造 GLM

智谱首席科学家唐杰发布 GLM-5.3-Flash 推理系统优化成果,模型仅用两周在超 10 万颗国产 AI 加速器集群上完成生产部署,端到端吞吐提升 3.2 倍,并由 GLM-5.3 驱动的 Infra Agent 参与瓶颈分析与代码修改,标志着智谱首个 RSI(递归自我改进)早期形态的落地。

来自主题: AI资讯
9033 点击    2026-09-17 22:08
独家|前DeepSeek核心研究员魏浩然出任百度文心多模态算法负责人

独家|前DeepSeek核心研究员魏浩然出任百度文心多模态算法负责人

独家|前DeepSeek核心研究员魏浩然出任百度文心多模态算法负责人

前DeepSeek核心研究员魏浩然近日带队加入百度基础模型研发部,出任文心大模型多模态算法负责人,负责端到端OCR等方向,其此前主导的Unlimited OCR模型曾在OmniDocBench评测中取得全球第一。

来自主题: AI资讯
9415 点击    2026-09-06 11:05
刚刚,Claude首次形式化证明费马大定理!清华姚班大神出手了

刚刚,Claude首次形式化证明费马大定理!清华姚班大神出手了

刚刚,Claude首次形式化证明费马大定理!清华姚班大神出手了

清华姚班出身的彭天翼带队,Anthropic旗下Claude仅用11天、消耗60亿Token和1300万行代码,首次端到端形式化证明了困扰数学界350年的费马大定理,并产出29500条可验证中间定理,成为迄今为止最大的Lean证明。

来自主题: AI资讯
8130 点击    2026-09-05 10:52
形界智能Rise模型,让我看到了全新的交互

形界智能Rise模型,让我看到了全新的交互

形界智能Rise模型,让我看到了全新的交互

看到形界智能「Era」系列的原生模型Rise正式发布了,用500ms的端到端响应延迟,让人机交互,有了新的变量。第一时间测试了一下,给大家介绍介绍。全域沉浸,一种全新的视频交互形态

来自主题: AI资讯
9609 点击    2026-08-22 14:04
解码提速15.1倍、多任务性能不降:复旦&引望WAM-Diff2打通自动驾驶VLA自回归—扩散转换

解码提速15.1倍、多任务性能不降:复旦&引望WAM-Diff2打通自动驾驶VLA自回归—扩散转换

解码提速15.1倍、多任务性能不降:复旦&引望WAM-Diff2打通自动驾驶VLA自回归—扩散转换

视觉 - 语言 - 动作(VLA)模型已成为端到端自动驾驶的主流技术路线,但基于自回归(AR)解码的现有架构面临双重结构性瓶颈:其一,逐 Token 串行生成导致推理延迟随序列长度线性增长,严重制约实时部署;其二,训练阶段依赖真实前缀的 teacher forcing 机制,使模型在推理时暴露于自身生成的误差之上,引发长时序累积的曝光偏差(exposure bias)。

来自主题: AI技术研报
7055 点击    2026-08-19 14:39
机器人也有“Aha Moment”!Zetta ζ 闭环物理智能体在线学习

机器人也有“Aha Moment”!Zetta ζ 闭环物理智能体在线学习

机器人也有“Aha Moment”!Zetta ζ 闭环物理智能体在线学习

端到端策略模型在物理世界频频失灵,研究者转向 “大模型智能体 + 工具调用” 自救,试图在动态物理世界中持续学习。然而,这条在线学习路径在物理世界仍未真正走通。

来自主题: AI技术研报
7545 点击    2026-08-18 15:27
突发!OpenAI最新模型Astra失控,奥特曼紧急补漏洞

突发!OpenAI最新模型Astra失控,奥特曼紧急补漏洞

突发!OpenAI最新模型Astra失控,奥特曼紧急补漏洞

就在刚刚,OpenAI紧急叫停Astra!OpenAI内部评估显示,Astra在智能体编码和网络性能上取得的巨大突破,或已达到网络安全的「关键」阈值!这意味着,Astra可能具备自主开发零日漏洞,甚至仅凭高级指令发动新型端到端网络攻击的恐怖能力。

来自主题: AI资讯
10433 点击    2026-08-08 10:59