Stability AI 发布秒级单图生 3D 模型
Stability AI 推出图生 3D 模型 Stable Fast 3D,仅需 0.5 秒即可从单张图片生成完整、自然的 3D 模型,并在不同光照下呈现正确颜色。模型自带纹理及其参数,支持精确的 UV 展开,并提供四边形或三角形网格重建功能,便于后期修改。
微软 Azure AI 推出文本转语音虚拟形象服务
微软 Azure AI 推出文本转语音虚拟形象服务,支持将文本转换为人类自然说话的视频。服务提供多种预构建的逼真虚拟形象,支持实时生成和批量处理,按视频长度按秒收费。
心辰 Lingo 端到端语音大模型问世,对标 GPT-4o
西湖心辰推出国内首个端到端语音大模型心辰 Lingo,具备 GPT-4o 级别的语音能力,支持语音识别、情绪感知、对话管理、实时打断和实时指令控制等功能,实现从语音输入到语音反馈的完整交互过程。
商汤携手 SMT 打造基于 AI 动捕的赛事转播方案
商汤科技与 SMT 联合打造基于 AI 动捕的赛事转播方案,在巴黎奥运会射箭赛事转播中应用三维运动捕捉技术与 AR 特效渲染引擎,实现赛事数据采集与可视化转播,并提供 AI 解说。
美国 ASG 集团推出云制作“虚拟转播车”
美国 ASG 集团推出云端制作套件“虚拟转播车”,基于 ASG 虚拟制作控制室,支持公共、私有或混合托管方案,与多家云服务供应商和工具兼容,用户可灵活配置资源。
RADiCAL 发布单摄像头实时无标记动捕方案
RADiCAL 公司发布单摄像头实时无标记动作捕捉解决方案,专注于上半身动捕,支持手指与面部高精度追踪,无需穿戴设备,实现动作捕捉大众化。
国产 1.8 亿像素全画幅 CMOS 图像传感器成功试产
国内企业晶合集成与思特威公司合作推出 1.8 亿像素全画幅 CMOS 图像传感器,具备超高像素、高帧率及超高动态范围,满足 8K 超高清视频拍摄需求,打破国际垄断。
我国 AVS 编码标准首次应用于互联网电视直播
新一代人工智能联盟联合多家 AVS 会员单位开发了一套集成 AVS3-P2 视频、AVS3-P3 音频和 AVS-SMT 智能传输技术的解决方案,在巴黎奥运会期间与总台合作进行直播试点,实现 AVS3 标准在互联网电视上的首次直播应用。
德国 Media Broadcast 启动 5G 广播试点项目
德国 Media Broadcast 启动首个 5G 广播试点项目,旨在通过新技术高效分发电视节目,重点关注传输速度、功耗及节目质量,并计划包含灾害保护预警功能。
法国 TDF 开展基于 5G 广播的电视与广播直播测试
法国电信公司 TDF 开展使用 5G 广播技术在移动设备上进行实时地面数字电视节目和无线电广播的测试,用户可通过手机接收多个电视频道和广播电台,计划三年内实现 DTT 节目通过 5G 广播在移动端的接入。
中国版“星链”项目正式启航
中国发射首批 18 颗 G60 星链卫星,正式启动中国版“星链”项目,计划至 2030 年实现约 1.5 万颗卫星组网,并推进“GW 星座”与“鸿鹄 -3”计划,加速卫星互联网建设。
NVI 技术创新联盟成立,构建视听传输协议新生态
NVI 技术创新联盟成立,包含 21 家广电视听产业链核心单位,标志着我国在音视频传输技术领域迈出重要一步,NVI 技术是一种具有自主知识产权的超低延时传输协议,支持局域网和公网的稳定、低延迟视频数据传输。
NASA 激光通信太空试验实现 4K 视频双向传输
NASA 宣布成功实现了从飞机到国际空间站的 4K 视频双向激光通信传输,该技术提高了通信效率,具有云层穿透能力,保证了复杂天气条件下的信号稳定传输。
谷歌推出 AI 驱动的个性化内容推荐机顶盒
谷歌推出 AI 驱动的下一代个性化机顶盒 Google TVStreamer,支持 4K HDR 及杜比视界和杜比全景声,精准捕捉并分析观众的观看习惯与偏好,为不同家庭成员定制专属的观看内容推荐列表。
BBC 研发部门转型为六大专项创新团队
BBC 研发部门重组为六大核心团队,包括人工智能、媒体和基础三个面向应用研究领域的团队,以及提案、咨询、投资组合和交付三个团队,旨在确保 BBC 能够继续引领媒体行业变革,为观众提供更加个性化、便捷的观看体验。
报告:全球 76% 的听众首选广播来获取音乐
国际唱片业联合会调查显示,全球 76% 的听众首选广播来获取音乐,63% 的听众表示如果没有音乐,他们将不再收听广播;65% 的听众通过独立或车载收音机听音乐。
2030-2040 年 NHK STRL 将专注于沉浸式媒体研发
日本 NHK STRL 更新了《2030-2040 年未来愿景(2024 年版)》,专注于沉浸式媒体领域,重点研发内容制作与呈现技术,以提供身临其境的虚拟空间体验。