查看: 86|回复: 0

微软推出 MAI 图像与语音模型,已进入公开预览

[复制链接]
  • TA的每日心情
    无聊
    6 小时前
  • 签到天数: 10 天

    [LV.3]偶尔看看II

    1830

    主题

    67

    回帖

    5357

    积分

    管理员

    🤝 贡献
    3
    🌟 威望
    0
    🪙 金币
    3457
    💎 社区币
    156

    管理员帅哥金牛座羊

    发表于 2026-7-25 19:54:48 | 查看全部 |阅读模式

    微软推出 MAI 图像与语音模型,已进入公开预览

    微软推出 MAI 图像与语音模型,已进入公开预览


    微软在 Microsoft Foundry 推出 MAI-Image-2.5-Pro 与 MAI-Voice-2-Flash。前者支持文生图、图生图和自然语言局部编辑,可处理对象、布局与文字修改,并强调多轮编辑中的人物和风格一致性。

    MAI-Voice-2-Flash 面向低延迟语音合成,支持 15 种语言和 18 个地区,用户可用 5 至 60 秒的授权声音样本创建语音,并控制语速、音高和情绪。两款模型均由微软自研,现已进入公开预览,图像能力已用于 Bing Image Creator、PowerPoint 等产品,语音模型则接入 Azure Voice Live 和 Dynamics 365 Contact Center。

    文章来源:https://www.ifanr.com


    您需要登录后才可以回帖 登录 | 立即注册

    本版积分规则

    手机版|小黑屋|网站地图|文强阁

    相关侵权、举报、投诉及建议等,请发 E-mail:hsbk@hotmail.com

    Powered by Discuz! X5.0 © 2001-2026 Discuz! Team.

    在本版发帖