AI重点要闻
英伟达召开GTC2025大会
- 英伟达发布Dynamo,号称“AI工厂的操作系统”,与Grace Blackwell NVLink 72超级芯片结合,使Blackwell相比Hopper性能提升25倍,推理模型性能提升40倍。
- NVIDIABlackwell DGX系统在单个DGX系统上运行6710亿参数的DeepSeek-R1模型,实现每用户每秒超250token的响应速度,系统最高吞吐量突破每秒3万token。
- GraceBlackwell解决方案已全面投产,包括GB200和B200,采用台积电4nm工艺制造,拥有高达2080亿个晶体管。
- 英伟达发布新一代AI芯片Rubin,并声称下一代芯片架构为Feynman,将于2026年推出。
- 黄仁勋首次提出Agentic AI与机器人的Physical AI,认为目前处于生成式AI阶段,未来将进入代理式AI阶段,最终进入机器人的物理AI阶段。
昆仑万维开源SkyworkR1V视觉思维链推理模型
- SkyworkR1V是首款工业界多模态思维链推理模型,具备视觉思维链能力,能够对视觉输入进行多步逻辑推理,进行数学与科学分析,并实现跨模态理解。
腾讯混元推出全新推理大模型T1
- 混元T1是基于混元T1-Preview推理模型升级而来,使用了Hybrid-Transformer-MambaMoE大模型TurboS快思考基座,通过大规模后训练显著扩展了推理能力,并进一步对齐人类偏好。
- 混元T1在各类公开benchmark和内部人工体验集评估上表现优异,尤其在文创指令遵循、文本摘要、agent能力方面略有胜。
MistralSmall3.1登场,24B模型同级别最强
- MistralSmall3.1模型主打高效运行,可以在单张RTX4090显卡的PC或者32GB内存的Mac上本地运行,拥有128k上下文能力,适用于虚拟助手等应用。
- MistralSmall3.1在多语言理解、视觉推理、图表信息提取和图解分析等方面表现出色,推理速度最高可以实现每秒150个tokens。
企业动态
最贵大模型服务:OpenAI推出o1-pro API
- OpenAI推出o1-Pro的API服务,定价为每百万tokens输入150/输出600美元,宣称通过更高计算资源投入实现“更一致且优质的回应”。
豆包编程能力升级:支持HTML代码实时预览、交互
- 豆包宣布AI编程功能迎来三项升级:HTML实时预览与交互、Python代码直接运行+一键修复、生成完整项目。
文心大模型4.5&X1发布
- 百度文心一言发布文心大模型4.5和文心大模型X1,文心4.5具备更精进的语言能力,理解、生成、逻辑、记忆能力全面提升,去幻觉、逻辑推理、代码能力显著提升。
- 文心大模型4.5运用了FlashMask动态注意力掩码、多模态异构专家扩展技术、时空维度表征压缩技术、基于知识点的大规模数据构建技术、基于自反馈的Post-training技术等核心技术。
- 文心大模型X1是首个运用工具的深度思考模型,运用递进式强化学习方法,进行基于思维链和行动链的端到端训练,并设置了多元统一的奖励系统。
AI行业洞察
Roblox发布AI建模工具,简单提示词即可生成3D模型
- Roblox推出3D模型工具“Cube”,旨在帮助创作者利用生成式AI制作3D物体,支持直接从文本生成3D模型和环境。
技术前沿
谷歌推出全新ScalingLaws
- 谷歌团队发表论文研究了DiLoCo在固定计算预算下训练大语言模型时的缩放规律,发现DiLoCo随模型规模的扩展具有可预测性和稳健性,在多个方面优于数据并行训练。
大模型与人类交互过程中表现欠佳,反馈修正率低下
- 新加坡国立团队发表论文提出InterFeedback框架及基准测试,用于评估大型多模态模型(LMMs)在与人类交互中的智能表现,发现现有LMMs在理解和利用反馈方面能力欠佳。
借鉴DeepSeek-R1训练方法,小米团队推出7B模型登顶MMAU榜单
- 小米大模型团队对阿里的Qwen2-Audio-7B模型进行了微调,并利用DeepSeek-R1的训练方式,得到表现优秀的音频处理模型,在MMAU上的准确率为64.5%,比以前霸榜的GPT-4o还高出近10个百分点。