360°全景
 

HUS-8200M2 数字会议语音转写系统

功能参数:

语音转写服务器

1.语音识别引擎具备声学模型、语言模型、热词模型、自动标点系统。声学模型采用端到端神经网络模型对声学进行建模,语言模型采用ngramLM进行建模,用于计算搜索候选的文本概率,引擎同时支持自动智能标点,能够对识别的文本进行自动添加标点。

2.支持实时中文普通话的语音识别能力

3.实时语音识别能力:能在离线环境下通过调音台、声卡等设备采集实时会议音频流,并实时转写成文字,支持16kHz/8kHz采样率,16bit位深,单通道pcm/wav音频格式。

4.语音识别引擎性能:清晰中文普通话识别正确率≥97%;识别结果响应时间标准测试集≤500毫秒。

5.支持语音检出能力,能够在夹杂噪音的环境下连续采集语音信号,并进行过滤,保留有效语音。

6.支持逆文本标准化,将语音识别结果中的日期、数字等对象以标准化格式展示。

7.支持自动智能标点,智能判断对识别的文本添加标点。

8.可与无纸化系统连接,将采集到的音频传给语音转写服务器,显示实时转写生成的文字,并将文字发送给无纸化服务器,无纸化服务器可将文字实时的分发给会议室相关的终端设备。

9.可生成录音文件和转写的文本文件,并在停止转写时候自动将文件上传给无纸化服务器。

10.可全屏显示、可设置显示的字体大小,可设置是否自动换行。

11.硬件参数:英特尔至强E-2224(4核)CPU,内存32GB DDR4 ECC,硬盘1TB,系统ubuntu18.4系统

立即咨询