蚂蚁集团开源发布全模态大模型 Ming-Flash-Omni 2.0

关于我们网站声明联系方式用户反馈网站地图帮助

首页

电报

话题

盯盘

VIP

FM

投研

下载

全部

加红

公司

看盘

港美股

基金

提醒

2026年02月11日 11:24:40

蚂蚁集团开源发布全模态大模型 Ming-Flash-Omni 2.0

蚂蚁集团开源发布全模态大模型 Ming-Flash-Omni 2.0，是业界首个全场景音频统一生成模型，可在同一条音轨中同时生成语音、环境音效与音乐。用户用自然语言下指令，可对音色、语速、语调、音量、情绪与方言等进行控制。模型在推理阶段实现了 3.1Hz 的极低推理帧率，实现了分钟级长音频的实时高保真生成。（记者黄心怡）

收藏

阅261.45W

我要评论

图片

欢迎您发表有价值的评论，发布广告和不和谐的评论都将会被删除，您的账号将禁止评论。

发表评论

关联话题

1.03W 人关注

6.8W 人关注

TMT行业观察

2.45W 人关注

关于我们|网站声明|联系方式|用户反馈|网站地图|友情链接|举报电话：021-54679377转617举报邮箱：editor@cls.cn

财联社举报

财联社 ©2018-2026上海界面财联社科技股份有限公司版权所有沪ICP备14040942号-9 沪公网安备31010402006047号互联网新闻信息服务许可证：31120170007沪金信备 [2021] 2号