老黄30亿美元押注穆拉蒂!估值冲到400亿,钱转一圈又买英伟达的卡
老黄30亿美元押注穆拉蒂!估值冲到400亿,钱转一圈又买英伟达的卡这回,老黄把AI基建的触手,伸进了模型层。
搜索
这回,老黄把AI基建的触手,伸进了模型层。
先学会画,再学会听话。 LLaDA-Image 在预训练和中期训练阶段直接从图片学习视觉先验,超过 90% 的累计生成训练样本采用 image-only 监督;图文对则集中用于后续语言对齐。模型权重、训练代码和完整配方同步开放。
在大模型的发展中,提升能力的主要手段一直是 "做大"—— 更多参数、更多数据、更多算力。如今,另一条思路开始受到关注:与其不断堆叠新的层,不如让已有的层再跑一遍。这就是 Looped Transformer。普通 Transformer 的每一层只执行一次,而 Looped Transformer 会把其中一部分层重复执行,让模型在不增加参数的情况下获得更深的计算。
杭州自9月20日起向35家市级大学生创业园每人发放一张含1万积分的千问办公token卡,这是千问办公接入Qwen3.8-Max一个月后杭州首次将算力帮扶平铺到个人,标志着其AI产业思路从支持做模型的企业转变为支持用模型的人。
进入 9 月,新一轮旗舰手机还未悉数亮相,Pro Max 的命名已先在社交平台刷了屏。
AI行业最性感的故事一直在天上:更大的模型、更聪明的Agent、更接近AGI的能力,每隔几个月就把技术的天花板再往上顶一点。
近年来,视频生成模型在清晰度、时序一致性和可控性上快速进步。给定文本、图像、相机轨迹或玩家动作,模型已经能够合成连贯的后续画面,也让「可交互视频世界」逐渐从概念走向可观看、可操作的原型。
奥特曼亲口承认,GPT-6 Astra其实早就训练完了。
AI视频生成正从质量竞争转向实时速度竞争,AI互动内容公司Yoroll基于开源MiniMax H3模型推出后训练模型Yoroll H3 Superfast,可在4秒内生成10秒768p带音频视频,并上线由其驱动的实时互动叙事产品YoLive。
文章系统梳理了机器人触觉感知的压阻式、压电式、电容式、光学式和磁感应五大技术路线,结合一目科技和亚德诺半导体的研发实践,分析了触觉数据采集面临的三大难题以及T-Rex、TacSL等模型算法的路线之争,指出机器人触觉正处于爆发前夜。