微软发布三款新模型 正面抗衡OpenAI与谷歌 微软周三推出三款完全自主研发的全新基础AI模型,分别为顶尖语音转写系统、语音生成引擎及升级款图像创作模型。此举成为这家市值三万亿美元软件巨头迄今最明确的信号:其计划在模型研发层面,而非仅在分发领域,直接与OpenAI、谷歌等前沿实验室展开竞争。三款模型分别为MAI-Transcribe-1、MAI-Voice-1与MAI-Image-2,现已通过微软模型开发平台及全新MAI试用专区开放使用。它们覆盖企业AI…
微软发布三款新模型 正面抗衡OpenAI与谷歌 微软周三推出三款完全自主研发的全新基础AI模型,分别为顶尖语音转写系统、语音生成引擎及升级款图像创作模型。此举成为这家市值三万亿美元软件巨头迄今最明确的信号:其计划在模型研发层面,而非仅在分发领域,直接与OpenAI、谷歌等前沿实验室展开竞争。三款模型分别为MAI-Transcribe-1、MAI-Voice-1与MAI-Image-2,现已通过微软模型开发平台及全新MAI试用专区开放使用。它们覆盖企业AI…
汉堡王利用AI检测员工是否说了“请”“谢谢 汉堡王将推出一款AI聊天机器人,它将部署在员工使用的耳机中。这款名为 “帕蒂” 的语音聊天机器人是属于 BK Assistant 平台的一部分,该平台不仅能协助员工准备餐点,还会评估他们与顾客互动时的 “友好度”。汉堡王首席数字官蒂博·鲁表示,该公司汇集了加盟商和顾客关于如何衡量友好度的信息,从而使这家快餐连锁店能够训练其AI系统识别特定的词语和短语,例如“欢迎光临汉堡王”、“请”和“谢谢”。经理们随后可以询问…
研究:仅通过手机震动就可以解析通话内容 宾夕法尼亚州立大学的计算机科学研究人员利用毫米波雷达传感器收集智能手机震动中的对话,并采用开放存取的大规模人工智能集成语音识别模型,将震动解码成可识别的语音文本。 研究表明,通过雷达测量,可以在距离手机三米处捕捉到通话内容,准确率约为60%(词汇量高达10000)。 “当我们用手机通话时,我们往往会忽略通过耳机传来的振动,而这种振动会导致整个手机震动,”论文第一作者、计算机科学博士生苏约迪·巴萨克说。“如果我们利用…
联发科推出专为台湾设计的语音识别模型 联发科旗下的前瞻技术研究单位联发创新基地发布基于OpenAI Whisper的AI语音识别开源模型 MediaTek Research Breeze ASR 25;相较于OpenAI Whisper,更加理解台湾用语及口音,同时,在台湾常见的中、英混合的用语情境上,也达到更高的精准度。联发创新基地负责人许大山博士表示,开源语音识别模型虽逐年进步,但对于在地用语及口音的辨识度仍显不足,例如把「发生什么事」听成「花生什么…