
技术领先识别准确
采用领先国际的流式端到端语音语言一体化建模方法,融合百度自然语言处理技术,近场中文普通话识别准确率达98
多语种和多方言识别
支持普通话和略带口音的中文识别;支持粤语、四川话方言识别;支持英文识别

技术领先识别准确
采用领先国际的流式端到端语音语言一体化建模方法,融合百度自然语言处理技术,近场中文普通话识别准确率达98
多语种和多方言识别
支持普通话和略带口音的中文识别;支持粤语、四川话方言识别;支持英文识别

提供多场景音库
提供风格多样的19种音库供您选择,适用于有声阅读、新闻播报、订单播报、智能硬件等应用场景,即将推出更多特色音库
语速、音调可调节
支持多种参数配置,可根据场景需求对音库的语速、音调、音量进行灵活设置,满足个性化需求

声纹(Voiceprint Recognition)简称VPR,作为一种行为特征,具有唯一性和独特性;
声纹具备不易篡改的特点,其次由于声音一般不涉及用户隐私问题,往往用户接受程度较高。

人脸检测与属性分析
精准定位人脸72个关键点,快速识别多种人脸属性信息,包括年龄、性别、情绪、是否佩戴眼镜等;能够对人脸图片进行质量控制,确保图片符合质量标准,保障后续人脸比对、人脸搜索的准确性。
人脸对比
支持5种图片类型的人脸比对,包括生活照、证件照、身份证芯片照、带网纹照、红外黑白照。能够比对图片中两张人脸的相似度,并返回相似度分值。
活体检测
提供丰富的活体检测服务,包括图片活体检测、视频动作活体检测、唇语活体检测及炫瞳活体功能。活体检测也包含合成图能力,甄别是否为后期人工合成的视频换脸、PS、人脸融合等篡改造假人脸数据,有效抵御作弊行为,保障业务安全性。

数字人定制
提供低成本快速定制2D卡通、真人形象及3D卡通、超写实数字人像。结合AI和计算机图形学,具有超写实、高精度的特点,音唇精准同步、表情丰富逼真;同时可利用先进的TTS技术定制专属声音;深度定制包括捏脸、换装、美容等打造专属数字形象资产。
视频合成
支持通用类单视频剪辑,添加动作、表情、图表等素材,对单视频快速剪辑发布,智能推荐分发路径,提高视频曝光率 ; 可进行批量视频生产,实现从播报文本/音频到虚拟主播播报视频的一键式生成。
上一页
北京优创联动科技有限公司是国内金融行业IT解决方案提供商之一,主要从事向以银行、保险为主的金融机构提供包括咨询、软件产品、软件开发和实施、运营维护、系统集成等信息化服务与业务增值服务。
公司主要软件产品和行业解决方案涵盖呼叫中心、高清视频、智慧园区、数字化服务等多个行业领域。