
服务商
科大讯飞作为中国最大的智能语音技术提供商,在智能语音技术领域有着长期的研究积累,并在中文语音合成、语音识别、口语评测等多项技术上拥有国际领先的成果。
科大讯飞是我国唯一以语音技术为产业化方向的“国家863计划成果产业化基地”、“国家规划布局内重点软件企业”、“国家火炬计划重点高新技术企业”、“国家高技术产业化示范工程”,并被信息产业部确定为中文语音交互技术标准工作组组长单位,牵头制定中文语音技术标准。
产品介绍
产品优势

应用场景

常见问题
1、 “语音转写 ”与 “语音听写 ”的区别是?
产品名称 | 支持的音频时长 | 使用场景 |
语音听写 | 一分钟以内 | 人机对话,如输入法、语音搜索 |
语音转写 | 五小时以内 | 更自然地贴近日常的对话、演讲 |
2、 “已录制音频转写”和“实时音频流转写”的区别是?
已录制音频转写:将预先录制完毕的完整音频文件传输至云端,转写服务处理完成后将输出此音频对应的完整文字结果。该流程为异步&非实时;
实时音频流转写:在采集音频的同时,连续上传音频流至云端,转写服务将实时返回文字结果,实现文字和声音的同步展现。
3、语音转写支持什么语言?
答:默认支持中文、英文、中英混合识别;中文包括普通话、天津话、河北话、东北话、甘肃话、山东话、太原话;其他方言/语种需购买套餐或语种授权。目前可支持:
l 方言:广东话、河南话、西南官话(云南话、贵州话、重庆话、四川话)
l 语种:中文、英文、日语、韩语、法语、俄语、越南语、西班牙语
l 民族语言:藏语、维语
4、目前语音转写支持的音频格式为:
已录制音频(5小时内),wav,flac,opus,m4a,mp3,单声道&多声道;采样率:8KHz,16KHz
5、语音转写支不支持并发?
答:支持,要保证同一个appid每秒请求接口次数最大值在20次以下。
相关导航

基于字节跳动服务数亿用户沉淀的技术能力,为金融机构提供从底层技术架构到数据、AI等技术中台,再到内容、算法、营销、体验、运营等智能应用套件,助力金融机构实现用户增长、资产提升和管理提效

捷通华声
免费为开发者提供语音合成(TTS)、语音识别(ASR)、手写识别(HWR)、光学字符识别(OCR)、语义理解(NLU)、机器翻译(MT)等全方位智能人机交互能力

一句话识别-阿里云
一句话识别可对一分钟以内的语音进行实时识别,适用于较短的语音交互场景,如语音搜索、语音指令、语音短消息等。 可集成在各类App、智能家电、智能助手等产品中。

好未来AI开放平台
好未来AI开放平台,依托多年教育行业经验与海量行业数据优势,深耕教育领域人工智能技术创新,为广大教育行业伙伴提供领先的AI能力与解决方案,助力教育智能化发展

中英文口语评测-驰声
驰声是国内知名中英文语音评测技术供应商,在线语音识别引擎发音纠错技术、中英文口语评测、人工智能发音打分技术、AI口语训练技术、口语作业、中高考英语听说考试评分技术等面向儿童、成人、K12学生,维度全,功能多,平台稳,效率高,被誉为中国语言教育产品的智能语音工具包。

Outwrite
你的AI写作助手

语音唤醒-百度AI开放平台
支持特定语音指令唤醒,唤醒的同时执行指令操作,轻量级,低功耗,可自定义设置多个唤醒词,为您的应用打造自然流畅的对话

火山写作
让英语写作更简单