谷歌发布新一代图像生成模型 Nano Banana Pro:该模型基于 Gemini 3 Pro 架构,擅长处理复杂信息,具备突出的文本渲染能力,支持多元素合成和高级创意控制,可生成 4K 分辨率高清图像。所有生成或编辑的图像均嵌入 C2PA 元数据,帮助识别 AI 生成内容与深度伪造。模型集成至谷歌多款 AI 工具中,但生成速度下降,使用成本更高。
Meta 发布能识别 1600 种语言的 ASR 系统:该系统首次实现对 1600 种语言的高精度语音识别,引入“上下文学习”机制,仅需少量音频样本即可快速掌握新语言。78% 的语种词错率低于 10%,远超此前多语言 ASR 系统。Meta 完全开源模型与工具链,联合语言保护组织采集数据,推动全球语言多样性保护。