Google发布Gemini 3.5 Transcribe:嘈杂环境精准语音转文字
admin 2026-08-28 63浏览
谷歌发布 Gemini 3.5 Transcribe:号称系列最强语音识别模型 谷歌近日正式发布 Gemini 3.5 Transcribe,将其定位为该系列迄今准确度最高的语音转文字模型。该模型面向开发者、企业及普通用户...
admin 2026-08-28 63浏览
谷歌发布 Gemini 3.5 Transcribe:号称系列最强语音识别模型 谷歌近日正式发布 Gemini 3.5 Transcribe,将其定位为该系列迄今准确度最高的语音转文字模型。该模型面向开发者、企业及普通用户...
admin 2026-08-20 166浏览
阿里巴巴发布Qwen-Audio-3.0系列语音模型 阿里巴巴近日在千问AI平台正式上线Qwen-Audio-3.0系列语音模型。该系列包含三款模型:语音识别大模型Qwen-Audio-3.0-ASR、语音合成大模型Qwen-Audio-3.0...
admin 2026-08-10 159浏览
腾讯混元发布新一代语音识别模型 Hy ASR3.0 Preview 腾讯混元正式推出新一代语音识别模型 Hy ASR3.0 Preview,标志着语音识别技术从"逐字转写"迈入"理解语境"的新阶段。该模型基于新一代大...
admin 2026-08-05 106浏览
腾讯混元发布新一代语音识别模型Hy ASR3.0preview 腾讯混元今日正式推出新一代语音识别模型Hy ASR3.0preview。该模型首次将大语言模型Hy3的深度语义理解能力与高精度语音识别进行深度融合...
admin 2026-08-05 107浏览
腾讯混元发布新一代语音识别模型 Hy ASR3.0preview 腾讯混元今日正式发布新一代语音识别模型 Hy ASR3.0preview。该模型依托最新一代大语言模型 Hy3 的语言理解能力,将高精度语音识别与深度...
admin 2026-08-03 133浏览
阿里巴巴发布语音识别大模型 Qwen-Audio-3.0-ASR-Flash 阿里巴巴正式发布新一代语音识别大模型 Qwen-Audio-3.0-ASR-Flash,重点提升 AI 在专业领域的语音识别能力。该模型针对上下文一致性、行业...
admin 2026-07-23 105浏览
OpenRouter 统一语音转录与聊天接口,开发者无需再维护独立服务 OpenRouter 近日在其平台上线语音转文本端点,允许开发者使用与 Chat Completions 相同的认证密钥完成音频转录,解决此前聊...
admin 2026-04-24 134浏览
小米发布全新语音系统:让AI说话,像真人一样有情绪 你有没有想过,未来的AI助手不只是回答问题,还能用你熟悉的声音、带着情绪、像朋友一样和你聊天?今天,小米正式推出MiMo...
admin 2026-04-22 147浏览
通义Fun-ASR1.5来了:能听懂方言、念古诗、甚至辨出爷爷的口音 你有没有试过让智能语音助手听你用四川话讲“巴适得板”,结果它回你“没听清”?或者让AI转写奶奶念的《静夜思》,...
admin 2026-04-07 214浏览
微软周三(4月2日)在官方博客宣布,在Microsoft Foundry推出三款自研AI模型,包括语音识别模型MAI-Transcribe-1、语音生成模型MAI-Voice-1,以及文本生成图像模型MAI-Image-2,表明其正扩大MAI模...
admin 2026-04-03 78浏览
微软周三(4月2日)在官方博客宣布,在Microsoft Foundry推出三款自研AI模型,包括语音识别模型MAI-Transcribe-1、语音生成模型MAI-Voice-1,以及文本生成图像模型MAI-Image-2,表明其正扩大MAI模...
admin 2026-01-27 98浏览
搜狗输入法20.0上线:更顺手、更安静、更懂你 你有没有过这样的经历:语音输入时等了三秒才出字,说了一句“明天下午三点”,结果变成“明天下班三点”?或者打字时候选词总不...
admin 2026-01-12 226浏览
人工智能深度学习系统班第七期:全面掌握AI核心技术 本套《人工智能深度学习系统班第七期》课程专为希望系统掌握人工智能核心技术的学习者打造,内容覆盖从机器学习基础到前沿...
admin 2025-12-16 112浏览
通义百聆发布“说话+听话”双核开源方案,3秒克隆声音,嘈杂环境也能听清 今天,通义百聆正式推出语音技术的“组合拳”——Fun-CosyVoice3 与 Fun-ASR 两大核心模型同步升级并全量开源...
admin 2025-11-18 222浏览
一键搞定视频翻译与配音:中英互译、字幕+配音同步生成 你是否曾为看不懂外语电影而烦恼?或者想把自家拍摄的英文教学视频,配上中文配音和字幕,发到B站、抖音?现在,这一切...
admin 2025-11-10 138浏览
课程亮点:从零基础到AI工程师的实战进阶之路 本课程——《人工智能深度学习系统班(第十期)》专为希望系统掌握AI核心技术的学习者打造,无论你是编程新手、转行工程师,还是...
admin 2025-11-07 224浏览
Adobe Speech to Text:专业级语音转文字工具,提升创作效率 Adobe Speech to Text 是 Adobe 公司推出的一款高精度语音识别解决方案,专为内容创作者、影视制作人、教育工作者及企业用户设计。...
admin 2025-11-07 174浏览
Adobe Speech to Text 是 Adobe 公司为创意专业人士打造的一款高效语音识别工具,深度集成于 Adobe Premiere Pro 2022 至 2024 版本中,能够将视频中的语音内容自动转换为精准的文字文本。该功能...