语音-的相关机构
- 机构分类:
- 机构背景: 民营
- 主营业务:汽车交通/交通出行,人工智能,智能投顾
- 注册资本: 12.8571万人民币
为您搜索到1212条结果
[3 月 21 日讯,OpenAI 昨日(3 月 20 日)发布博文,宣布推出语音转文本(speech-to-text)和文本转语音(text-to-speech)模型,提升语音处理能力,支持开发者]
[《自然》杂志15日介绍了一款人工智能(AI)模型,其宛如科幻小说里的“巴别鱼”,能直接“语音到语音”翻译多达101种语言的语音和文本。由Meta推出的这一模型名为SEAMLESSM4T,其填补了语言]
[5 月 28 日讯,Anthropic 公司开始为其 Claude 聊天机器人应用推出“语音模式”。目前该功能仍处于测试阶段,用户可以通过语音与 Claude 进行完整的对话。根据 ]
[5月28日讯,腾讯混元联合腾讯音乐天琴实验室发布并开源语音数字人模型HunyuanVideo-Avatar。该模型基于混元视频大模型(HunyuanVideo)及MuseV技术,支持头肩、半身、全身]
[5月16日讯,近日,来自上海的AI独角兽MiniMax稀宇极智发布新一代语音大模型Speech-02。该模型在国际最权威的两项语音评测榜单Artificial Analysis和Hugging ]
[4 月 9 日讯,亚马逊发布了名为 Nova Sonic 的新一代生成式 AI 模型,该模型能够原生处理语音并生成自然流畅的语音。据亚马逊声称,Nova Sonic 在速度、语音识别以及对话质量等]
[3 月 31 日讯,在今日的百度 AI DAY 上,百度发布首个基于全新互相关注意力(Cross-Attention)的端到端语音语言大模型,宣布实现超低时延与超低成本,在电话语音频道的语音问答场景]
[据报道,知情人士表示,Meta计划在其最新的开源大型语言模型Llama 4中引入改进的语音功能,预计将在未来几周内推出。(新浪财经)]
[豆包即将发布最新实时语音大模型,并将基于此模型全量上线豆包App实时语音通话功能。目前,豆包APP已小范围测试最新能力,部分用户在豆包App的实时通话界面已更新。(新浪财经)]
[1月15日讯,科大讯飞发布国内首个具备端到端语音同传能力的大模型——星火语音同传大模型。针对日常对话、商务交流、行业翻译等国际交流场景中的高难度同传翻译需求,星火语音同传大模型在内容完整度、信息]