查看: 51|回复: 0

微软推出 MAI 图像与语音模型,已进入公开预览

[复制链接]
阅读字号:

909

主题

14

回帖

2320

积分

管理员

金钱
1397
发表于 2026-7-25 19:54:48 | 显示全部楼层 |阅读模式

1b831825-6fc1-4ac8-ad34-4729d3d8bf33.png

微软在 Microsoft Foundry 推出 MAI-Image-2.5-Pro 与 MAI-Voice-2-Flash。前者支持文生图、图生图和自然语言局部编辑,可处理对象、布局与文字修改,并强调多轮编辑中的人物和风格一致性。

MAI-Voice-2-Flash 面向低延迟语音合成,支持 15 种语言和 18 个地区,用户可用 5 至 60 秒的授权声音样本创建语音,并控制语速、音高和情绪。两款模型均由微软自研,现已进入公开预览,图像能力已用于 Bing Image Creator、PowerPoint 等产品,语音模型则接入 Azure Voice Live 和 Dynamics 365 Contact Center。

文章来源:https://www.ifanr.com


回复

使用道具 举报

您需要登录后才可以回帖 登录 | 立即注册

本版积分规则

手机版|小黑屋|网站地图|文强阁

相关侵权、举报、投诉及建议等,请发 E-mail:admin@discuz.vip

Powered by Discuz! X5.0 © 2001-2026 Discuz! Team.

在本版发帖
返回顶部