很抱歉,当前没有启用javascript,网站无法正常访问。请开启以便继续访问。
logo2026年02月11日 11:24:40
蚂蚁集团开源发布全模态大模型 Ming-Flash-Omni 2.0
蚂蚁集团开源发布全模态大模型 Ming-Flash-Omni 2.0,是业界首个全场景音频统一生成模型,可在同一条音轨中同时生成语音、环境音效与音乐。用户用自然语言下指令,可对音色、语速、语调、音量、情绪与方言等进行控制。模型在推理阶段实现了 3.1Hz 的极低推理帧率,实现了分钟级长音频的实时高保真生成。(记者 黄心怡)
261.55W
关联话题
1.03W 人关注
6.89W 人关注
2.47W 人关注
关于我们|网站声明|联系方式|用户反馈|网站地图|友情链接|举报电话:021-54679377转617举报邮箱:editor@cls.cn财联社举报
财联社 ©2018-2026上海界面财联社科技股份有限公司 版权所有沪ICP备14040942号-9沪公网安备31010402006047号互联网新闻信息服务许可证:31120170007沪金信备 [2021] 2号