AI不一定要“聊天”,OpenAI前研究员研发只做决策的模型,绕开文本生成,响应速度快200倍
AI不一定要“聊天”,OpenAI前研究员研发只做决策的模型,绕开文本生成,响应速度快200倍大模型一定要一个 token 接一个 token 地生成文字吗?
搜索
大模型一定要一个 token 接一个 token 地生成文字吗?
9月10日,AMD 在北京举办“携手创新 共赢智能体AI时代”媒体沙龙,面向中国市场发布锐龙 AI Max PRO 400系列处理器,把客户端设备统一内存上限推升至192GB,实现本地运行3000亿参数级大模型的能力。CSDN 创始人蒋涛受邀发表题为《大模型的 PC 服务器时代》主题演讲。
10B参数以内,空间具身能力同档第一的通用多模态大模型来了!
当大模型已经能够快速生成文案、图片和视频,一个更进一步的问题是:Agent 能否从执行过的任务中积累经验,并在持续交互中改进后续行为?
拿Agent做Coding,想必大家都已经很熟悉了。
GPT-6 Astra 把大模型的能力边界,又向 3D 世界推了一步。它可以操作 Blender、编写代码,直接生成 3D 模型和场景。当通用模型开始学会建模,专门做 3D 生成的创业公司会被吃掉吗?
大模型过去几年的能力跃迁,几乎都围绕一个词:Scaling。
Token词元替代了Byte字节,但不意味着大模型都得是Token。
过去两周,AI圈最让人坐不住的三个字母,就是RSI。
北京中关村学院7名博士生,用一个暑假,从零训练出了一个7B大模型——ZGCM-1。