tencentcloud-sdk-python-asr 3.1.130__tar.gz → 3.1.160__tar.gz
This diff represents the content of publicly available package versions that have been released to one of the supported registries. The information contained in this diff is provided for informational purposes only and reflects changes between package versions as they appear in their respective public registries.
- {tencentcloud_sdk_python_asr-3.1.130 → tencentcloud_sdk_python_asr-3.1.160}/PKG-INFO +2 -2
- {tencentcloud_sdk_python_asr-3.1.130 → tencentcloud_sdk_python_asr-3.1.160}/setup.py +1 -1
- {tencentcloud_sdk_python_asr-3.1.130 → tencentcloud_sdk_python_asr-3.1.160}/tencentcloud/__init__.py +1 -1
- {tencentcloud_sdk_python_asr-3.1.130 → tencentcloud_sdk_python_asr-3.1.160}/tencentcloud/asr/v20190614/models.py +26 -44
- {tencentcloud_sdk_python_asr-3.1.130 → tencentcloud_sdk_python_asr-3.1.160}/tencentcloud_sdk_python_asr.egg-info/PKG-INFO +2 -2
- tencentcloud_sdk_python_asr-3.1.160/tencentcloud_sdk_python_asr.egg-info/requires.txt +1 -0
- tencentcloud_sdk_python_asr-3.1.130/tencentcloud_sdk_python_asr.egg-info/requires.txt +0 -1
- {tencentcloud_sdk_python_asr-3.1.130 → tencentcloud_sdk_python_asr-3.1.160}/README.rst +0 -0
- {tencentcloud_sdk_python_asr-3.1.130 → tencentcloud_sdk_python_asr-3.1.160}/setup.cfg +0 -0
- {tencentcloud_sdk_python_asr-3.1.130 → tencentcloud_sdk_python_asr-3.1.160}/tencentcloud/asr/__init__.py +0 -0
- {tencentcloud_sdk_python_asr-3.1.130 → tencentcloud_sdk_python_asr-3.1.160}/tencentcloud/asr/v20190614/__init__.py +0 -0
- {tencentcloud_sdk_python_asr-3.1.130 → tencentcloud_sdk_python_asr-3.1.160}/tencentcloud/asr/v20190614/asr_client.py +0 -0
- {tencentcloud_sdk_python_asr-3.1.130 → tencentcloud_sdk_python_asr-3.1.160}/tencentcloud/asr/v20190614/asr_client_async.py +0 -0
- {tencentcloud_sdk_python_asr-3.1.130 → tencentcloud_sdk_python_asr-3.1.160}/tencentcloud/asr/v20190614/errorcodes.py +0 -0
- {tencentcloud_sdk_python_asr-3.1.130 → tencentcloud_sdk_python_asr-3.1.160}/tencentcloud_sdk_python_asr.egg-info/SOURCES.txt +0 -0
- {tencentcloud_sdk_python_asr-3.1.130 → tencentcloud_sdk_python_asr-3.1.160}/tencentcloud_sdk_python_asr.egg-info/dependency_links.txt +0 -0
- {tencentcloud_sdk_python_asr-3.1.130 → tencentcloud_sdk_python_asr-3.1.160}/tencentcloud_sdk_python_asr.egg-info/top_level.txt +0 -0
|
@@ -1,6 +1,6 @@
|
|
|
1
1
|
Metadata-Version: 2.1
|
|
2
2
|
Name: tencentcloud-sdk-python-asr
|
|
3
|
-
Version: 3.1.
|
|
3
|
+
Version: 3.1.160
|
|
4
4
|
Summary: Tencent Cloud Asr SDK for Python
|
|
5
5
|
Home-page: https://github.com/TencentCloud/tencentcloud-sdk-python
|
|
6
6
|
Author: Tencent Cloud
|
|
@@ -15,7 +15,7 @@ Classifier: Programming Language :: Python :: 2.7
|
|
|
15
15
|
Classifier: Programming Language :: Python :: 3
|
|
16
16
|
Classifier: Programming Language :: Python :: 3.6
|
|
17
17
|
Classifier: Programming Language :: Python :: 3.7
|
|
18
|
-
Requires-Dist: tencentcloud-sdk-python-common<4.0.0,>=3.1.
|
|
18
|
+
Requires-Dist: tencentcloud-sdk-python-common<4.0.0,>=3.1.160
|
|
19
19
|
|
|
20
20
|
============================
|
|
21
21
|
Tencent Cloud SDK for Python
|
|
@@ -8,7 +8,7 @@ ROOT = os.path.dirname(__file__)
|
|
|
8
8
|
|
|
9
9
|
setup(
|
|
10
10
|
name='tencentcloud-sdk-python-asr',
|
|
11
|
-
install_requires=["tencentcloud-sdk-python-common>=3.1.
|
|
11
|
+
install_requires=["tencentcloud-sdk-python-common>=3.1.160,<4.0.0"],
|
|
12
12
|
|
|
13
13
|
version=tencentcloud.__version__,
|
|
14
14
|
description='Tencent Cloud Asr SDK for Python',
|
|
@@ -183,14 +183,9 @@ class CreateAsrKeyWordLibRequest(AbstractModel):
|
|
|
183
183
|
|
|
184
184
|
def __init__(self):
|
|
185
185
|
r"""
|
|
186
|
-
:param _Name:
|
|
187
|
-
仅限中英文数字-_
|
|
186
|
+
:param _Name: <p>词表名称,长度在1-20之间<br>仅限中英文数字-_</p>
|
|
188
187
|
:type Name: str
|
|
189
|
-
:param _KeyWordFile:
|
|
190
|
-
格式要求:TXT
|
|
191
|
-
每行只有一个词,不满足格式则报错无法上传
|
|
192
|
-
每个词限制**5个汉字,15个字符**,单个词库最多不超过100个词
|
|
193
|
-
注意不要有空行,尤其是最后一行
|
|
188
|
+
:param _KeyWordFile: <p>词文件(纯文本文件)的二进制base64编码,以行分隔<br>格式要求:TXT<br>每行只有一个词,不满足格式则报错无法上传<br>每个词限制<strong>5个汉字,15个字符</strong>,单个词库最多不超过100个词<br>注意不要有空行,尤其是最后一行</p>
|
|
194
189
|
:type KeyWordFile: str
|
|
195
190
|
"""
|
|
196
191
|
self._Name = None
|
|
@@ -198,8 +193,7 @@ class CreateAsrKeyWordLibRequest(AbstractModel):
|
|
|
198
193
|
|
|
199
194
|
@property
|
|
200
195
|
def Name(self):
|
|
201
|
-
r"""
|
|
202
|
-
仅限中英文数字-_
|
|
196
|
+
r"""<p>词表名称,长度在1-20之间<br>仅限中英文数字-_</p>
|
|
203
197
|
:rtype: str
|
|
204
198
|
"""
|
|
205
199
|
return self._Name
|
|
@@ -210,11 +204,7 @@ class CreateAsrKeyWordLibRequest(AbstractModel):
|
|
|
210
204
|
|
|
211
205
|
@property
|
|
212
206
|
def KeyWordFile(self):
|
|
213
|
-
r"""
|
|
214
|
-
格式要求:TXT
|
|
215
|
-
每行只有一个词,不满足格式则报错无法上传
|
|
216
|
-
每个词限制**5个汉字,15个字符**,单个词库最多不超过100个词
|
|
217
|
-
注意不要有空行,尤其是最后一行
|
|
207
|
+
r"""<p>词文件(纯文本文件)的二进制base64编码,以行分隔<br>格式要求:TXT<br>每行只有一个词,不满足格式则报错无法上传<br>每个词限制<strong>5个汉字,15个字符</strong>,单个词库最多不超过100个词<br>注意不要有空行,尤其是最后一行</p>
|
|
218
208
|
:rtype: str
|
|
219
209
|
"""
|
|
220
210
|
return self._KeyWordFile
|
|
@@ -244,7 +234,7 @@ class CreateAsrKeyWordLibResponse(AbstractModel):
|
|
|
244
234
|
|
|
245
235
|
def __init__(self):
|
|
246
236
|
r"""
|
|
247
|
-
:param _Data:
|
|
237
|
+
:param _Data: <p>词表ID数据</p>
|
|
248
238
|
:type Data: :class:`tencentcloud.asr.v20190614.models.KeyWordLibIdData`
|
|
249
239
|
:param _RequestId: 唯一请求 ID,由服务端生成,每次请求都会返回(若请求因其他原因未能抵达服务端,则该次请求不会获得 RequestId)。定位问题时需要提供该次请求的 RequestId。
|
|
250
240
|
:type RequestId: str
|
|
@@ -254,7 +244,7 @@ class CreateAsrKeyWordLibResponse(AbstractModel):
|
|
|
254
244
|
|
|
255
245
|
@property
|
|
256
246
|
def Data(self):
|
|
257
|
-
r"""
|
|
247
|
+
r"""<p>词表ID数据</p>
|
|
258
248
|
:rtype: :class:`tencentcloud.asr.v20190614.models.KeyWordLibIdData`
|
|
259
249
|
"""
|
|
260
250
|
return self._Data
|
|
@@ -801,7 +791,7 @@ class CreateRecTaskRequest(AbstractModel):
|
|
|
801
791
|
|
|
802
792
|
def __init__(self):
|
|
803
793
|
r"""
|
|
804
|
-
:param _EngineModelType: <p>引擎模型类型<br
|
|
794
|
+
:param _EngineModelType: <p>引擎模型类型<br>识别引擎采用分级计费方案,分为通用引擎、大模型1.0版引擎(原大模型版引擎)、大模型2.0版引擎。<a href="https://cloud.tencent.com/document/product/1093/35686">点击这里</a> 查看不同引擎的计费说明。</p><p><strong>大模型2.0引擎:</strong><br><strong>• 16k_zh_en_2.0:</strong>中英大模型引擎【大模型2.0版】。当前模型同时支持中文、英语、粤语、四川、陕西、河南、上海、湖南、湖北、安徽、闽南、潮汕等 <a href="https://cloud.tencent.com/document/product/1093/35682">31种方言</a> 的识别,且支持说话人分离能力。该模型参数量极大,语言模型性能增强,针对噪声大、回音大、人声小、人声远等低质量音频的识别准确率极大提升,<a href="https://console.cloud.tencent.com/asr/demonstrate">点击这里</a>对比中文普通话常规版本与中英大模型版本的识别效果;</p><p><strong>大模型1.0引擎:</strong><br><strong>• 8k_zh_large:</strong>中文电话场景专用大模型引擎【大模型1.0版】。当前模型同时支持中文、上海话、四川话、武汉话、贵阳话、昆明话、西安话、郑州话、太原话、兰州话、银川话、西宁话、南京话、合肥话、南昌话、长沙话、苏州话、杭州话、济南话、天津话、石家庄话、黑龙江话、吉林话、辽宁话、闽南语、客家话、粤语、南宁话方言识别,通过显著提升模型参数规模与语言建模能力,实现对电话音频中复杂场景(如口音干扰、背景噪声)的高精度识别,识别准确率较常规版本大幅提升。<a href="https://console.cloud.tencent.com/asr/demonstrate">点击这里</a> 对比常规版本与普方大模型效果;<br>• <strong>16k_zh_en:</strong>中英大模型引擎【大模型1.0版】。当前模型同时支持中文、英语、粤语、四川、陕西、河南、上海、湖南、湖北、安徽、闽南、潮汕等 <a href="https://cloud.tencent.com/document/product/1093/35682">31种方言</a> 的识别,模型参数量极大,语言模型性能增强,针对噪声大、回音大、人声小、人声远等低质量音频的识别准确率极大提升,<a href="https://console.cloud.tencent.com/asr/demonstrate">点击这里</a>对比中文普通话常规版本与中英大模型版本的识别效果;<br>• <strong>16k_multi_lang:</strong>多语种大模型引擎【大模型1.0版】。当前模型同时支持英语、日语、韩语、阿拉伯语、菲律宾语、法语、印地语、印尼语、马来语、葡萄牙语、西班牙语、泰语、土耳其语、越南语、德语的识别,可实现15个语种的自动识别(句子/段落级别);<br>• <strong>16k_en_large:</strong>英语大模型引擎。</p><p><strong>通用引擎:</strong><br>• 8k_zh:中文电话通讯;<br>• 8k_en:英文电话通讯;</p><p><strong>注意:电话通讯场景请务必使用8k引擎,电话通讯场景以外的其它识别场景,请务必使用16k引擎。</strong>如您有电话通讯场景识别需求,但发现需求语种仅支持16k,可将8k音频传入下方16k引擎,亦能获取识别结果。但<strong>16k引擎并非基于电话通讯数据训练,无法承诺此种调用方式的识别效果,需由您自行验证识别结果是否可用。</strong></p><p>• <strong>16k_zh:</strong>中文普通话通用引擎,支持中文普通话和少量英语,使用丰富的中文普通话语料训练,覆盖场景广泛,适用于除电话通讯外的所有中文普通话识别场景;<br>• <strong>16k_en:</strong>英语;<br>• <strong>16k_yue:</strong>粤语;<br>• <strong>16k_zh-PY:</strong>中英粤混合引擎,使用一个引擎同时识别中文普通话、英语、粤语三个语言;<br>• <strong>16k_zh-TW</strong>:中文繁体;<br>• <strong>16k_ja:</strong>日语;<br>• <strong>16k_ko:</strong>韩语;<br>• <strong>16k_vi:</strong>越南语;<br>• <strong>16k_ms:</strong>马来语;<br>• <strong>16k_id:</strong>印度尼西亚语;<br>• <strong>16k_fil:</strong>菲律宾语;<br>• <strong>16k_th:</strong>泰语;<br>• <strong>16k_pt:</strong>葡萄牙语;<br>• <strong>16k_tr:</strong>土耳其语;<br>• <strong>16k_ar:</strong>阿拉伯语;<br>• <strong>16k_es:</strong>西班牙语;<br>• <strong>16k_hi:</strong>印地语;<br>• <strong>16k_fr:</strong>法语;<br>• <strong>16k_zh_medical:</strong>中文医疗引擎;<br>• <strong>16k_de:</strong>德语;</p><p>枚举值:</p><ul><li>16k_zh_en: 中文普通话通用引擎,支持中文普通话和少量英语,使用丰富的中文普通话语料训练,覆盖场景广泛,适用于除电话通讯外的所有中文普通话识别场景</li></ul>
|
|
805
795
|
:type EngineModelType: str
|
|
806
796
|
:param _ChannelNum: <p>识别声道数<br>1:单声道(16k音频仅支持单声道,<strong>请勿</strong>设置为双声道);<br>2:双声道(仅支持8k电话音频,且双声道应分别为通话双方)</p><p>注意:<br>• 16k音频:仅支持单声道识别,<strong>需设置ChannelNum=1</strong>;<br>• 8k电话音频:支持单声道、双声道识别,<strong>建议设置ChannelNum=2,即双声道</strong>。双声道能够物理区分说话人、避免说话双方重叠产生的识别错误,能达到最好的说话人分离效果和识别效果。设置双声道后,将自动区分说话人,因此<strong>无需再开启说话人分离功能</strong>,相关参数(<strong>SpeakerDiarization、SpeakerNumber</strong>)使用默认值即可,返回的ResultDetail中的speakerId的值为0代表左声道,值为1代表右声道。</p>
|
|
807
797
|
:type ChannelNum: int
|
|
@@ -817,17 +807,17 @@ class CreateRecTaskRequest(AbstractModel):
|
|
|
817
807
|
:type Url: str
|
|
818
808
|
:param _CallbackUrl: <p>回调 URL<br>用户自行搭建的用于接收识别结果的服务URL<br>回调格式和内容详见:<a href="https://cloud.tencent.com/document/product/1093/52632">录音识别回调说明</a></p><p>注意:</p><ul><li>如果用户使用轮询方式获取识别结果,则无需提交该参数</li><li>建议在回调URL中带上您的业务ID等信息,以便处理业务逻辑</li></ul>
|
|
819
809
|
:type CallbackUrl: str
|
|
820
|
-
:param _SpeakerDiarization: <p>是否开启说话人分离<br>0:不开启;<br>1:开启(仅支持以下引擎:8k_zh/8k_zh_large/16k_zh/16k_ms/16k_en/16k_id/16k_zh_dialect/
|
|
810
|
+
:param _SpeakerDiarization: <p>是否开启说话人分离<br>0:不开启;<br>1:开启(仅支持以下引擎:8k_zh/8k_zh_large/16k_zh_en_2.0/16k_zh_en/16k_zh/16k_ms/16k_en/16k_id/16k_zh_dialect/16k_es/16k_fr/16k_ja/16k_ko,且ChannelNum=1时可用);<br>3: 开启角色分离,需配合SpeakerRoles参数使用(增值服务,仅支持16k_zh_en_2.0、16k_zh_en引擎,可支持传入声纹对录音文件内的说话人进行角色认证)<br>默认值为 0</p><p>注意:<br>8k双声道电话音频请按 <strong>ChannelNum 识别声道数</strong> 的参数描述使用默认值</p>
|
|
821
811
|
:type SpeakerDiarization: int
|
|
822
812
|
:param _SpeakerNumber: <p>说话人分离人数<br><strong>需配合开启说话人分离使用,不开启无效</strong>,取值范围:0-10<br>0:自动分离(最多分离出20个人);<br>1-10:指定人数分离;<br>默认值为 0<br>注:16k引擎不支持指定人数分离</p>
|
|
823
813
|
:type SpeakerNumber: int
|
|
824
814
|
:param _HotwordId: <p>热词表id<br>如不设置该参数,将自动生效默认热词表;<br>如设置该参数,将生效对应id的热词表;<br>点击这里查看<a href="https://cloud.tencent.com/document/product/1093/40996">热词表配置方法</a></p>
|
|
825
815
|
:type HotwordId: str
|
|
826
|
-
:param _ReinforceHotword: <p
|
|
816
|
+
:param _ReinforceHotword: <p>热词增强功能(目前仅支持中文普通话引擎)1:开启热词增强功能注意:热词增强功能开启后,将对传入的热词表id开启同音替换功能,可以在这里查看<a href="https://cloud.tencent.com/document/product/1093/40996">热词表配置方法</a>。效果举例:在热词表中配置“蜜制”一词,并开启增强功能,与“蜜制”(mìzhì)同音同调的“秘制”(mìzhì)的识别结果会被强制替换成“蜜制”。<strong>建议客户根据实际的业务需求开启该功能</strong></p>
|
|
827
817
|
:type ReinforceHotword: int
|
|
828
818
|
:param _CustomizationId: <p>自学习定制模型 id<br>如设置了该参数,将生效对应id的自学习定制模型;<br>点击这里查看<a href="https://cloud.tencent.com/document/product/1093/38416">自学习定制模型配置方法</a></p>
|
|
829
819
|
:type CustomizationId: str
|
|
830
|
-
:param _EmotionRecognition: <p><strong>【增值付费功能】</strong>情绪识别能力(目前仅支持 16k_zh , 16k_zh_en , 8k_zh
|
|
820
|
+
:param _EmotionRecognition: <p><strong>【增值付费功能】</strong>情绪识别能力(目前仅支持 16k_zh , 16k_zh_en_2.0 , 16k_zh_en , 8k_zh )0:不开启;1:开启情绪识别,但不在文本展示情绪标签;2:开启情绪识别,并且在文本展示情绪标签(<strong>该功能需要设置ResTextFormat 大于0</strong>)默认值为0支持的情绪分类为:高兴、伤心、愤怒注意:1. <strong>本功能为增值服务</strong>,需将参数设置为1或2时方可按对应方式生效;2. 如果传入参数值1或2,需确保账号已购买<a href="https://cloud.tencent.com/document/product/1093/35686#97ae4aa0-29a0-4066-9f07-ccaf8856a16b">情绪识别资源包</a>,或账号开启后付费;<strong>若当前账号已开启后付费功能,并传入参数值1或2,将<a href="https://cloud.tencent.com/document/product/1093/35686#d912167d-ffd5-41a9-8b1c-2e89845a6852">自动计费</a>)</strong>;3. 参数设置为0时,无需购买资源包,也不会消耗情绪识别对应资源</p>
|
|
831
821
|
:type EmotionRecognition: int
|
|
832
822
|
:param _EmotionalEnergy: <p>情绪能量值<br>取值为音量分贝值/10,取值范围:[1,10],值越高情绪越强烈<br>0:不开启;<br>1:开启;<br>默认值为0</p>
|
|
833
823
|
:type EmotionalEnergy: int
|
|
@@ -841,7 +831,7 @@ class CreateRecTaskRequest(AbstractModel):
|
|
|
841
831
|
:type FilterModal: int
|
|
842
832
|
:param _SentenceMaxLength: <p>单标点最多字数(目前支持中文普通话引擎)<br><strong>可控制单行字幕最大字数,适用于字幕生成场景</strong>,取值范围:[6,40]<br>0:不开启该功能;<br>默认值为0</p><p>注意:需设置ResTextFormat为3,解析返回的ResultDetail列表,通过结构中FinalSentence获取单个标点断句结果</p>
|
|
843
833
|
:type SentenceMaxLength: int
|
|
844
|
-
:param _Extra: <p
|
|
834
|
+
:param _Extra: <p>传入额外参数,默认为空字符串,如果传入必须是合法的 JSON 字符串。可用字段有:</p><p>Domain:提升特定领域识别效果</p><ul><li>0:不开启</li><li>1:科技领域</li><li>2:电影领域</li><li>3:歌曲领域</li></ul><p>默认值为0</p><p>示例: {"Domain":3}<br>增强歌曲领域识别效果</p>
|
|
845
835
|
:type Extra: str
|
|
846
836
|
:param _HotwordList: <p>临时热词表:该参数用于提升识别准确率。</p><ul><li><p>单个热词限制:"热词|权重",单个热词不超过30个字符(最多10个汉字),权重[1-11]或者100,如:“腾讯云|5” 或“ASR|11”;</p></li><li><p>临时热词表限制:多个热词用英文逗号分割,最多支持128个热词,如:“腾讯云|10,语音识别|5,ASR|11”;</p></li><li><p>参数 hotword_id(热词表) 与 hotword_list(临时热词表) 区别:</p><ul><li><p>hotword_id:热词表。需要先在控制台或接口创建热词表,获得对应hotword_id传入参数来使用热词功能;</p></li><li><p>hotword_list:临时热词表。每次请求时直接传入临时热词表来使用热词功能,云端不保留临时热词表。适用于有极大量热词需求的用户;</p></li></ul></li></ul><p>注意:</p><ul><li><p>如果同时传入了 hotword_id 和 hotword_list,只有hotword_list 生效;</p></li><li><p>热词权重设置为11时,当前热词将升级为超级热词,建议仅将重要且必须生效的热词设置到11,设置过多权重为11的热词将影响整体字准率。</p></li><li><p>热词权重设置为100时,当前热词开启热词增强同音同调替换功能(仅支持8k_zh,16k_zh),举例:热词配置“蜜制|100”时,与“蜜制”同拼音(mizhi)的“秘制”的识别结果会被强制替换成“蜜制”。因此建议客户根据自己的实际情况开启该功能。建议仅将重要且必须生效的热词设置到100,设置过多权重为100的热词将影响整体字准率。</p></li></ul>
|
|
847
837
|
:type HotwordList: str
|
|
@@ -849,7 +839,7 @@ class CreateRecTaskRequest(AbstractModel):
|
|
|
849
839
|
:type KeyWordLibIdList: list of str
|
|
850
840
|
:param _ReplaceTextId: <p>替换词汇表id, 适用于热词和自学习场景也无法解决的极端case词组, 会对识别结果强制替换。具体可参考<a href="https://console.cloud.tencent.com/asr/replaceword">配置控制台</a>;强制替换功能可能会影响正常识别结果,请谨慎使用</p><p>注意:</p><ol><li>本功能配置完成后,预计在10分钟后生效</li></ol>
|
|
851
841
|
:type ReplaceTextId: str
|
|
852
|
-
:param _SpeakerRoles: <p>开启角色分离能力配合SpeakerDiarization: 3 使用,ASR增值服务,<strong>仅可传入一组声纹信息</strong>进行角色认证,仅支持16k_zh_en引擎。需传入SpeakerRoleInfo数据组,确定说话人的角色信息,涉及RoleAudioUrl和RoleName两个参数。 RoleAudioUrl:需要认证角色的声纹音频地址,建议30s内的纯净人声,最长不能超过45s。 RoleName:需要认证角色的名称,若匹配成功,会替换话者分离中的SpeakerID。 示例: "{"EngineModelType":"16k_zh_en","ChannelNum":1,"ResTextFormat":1,"SourceType":0,"Url":"需要进行ASR识别的音频链接","SpeakerDiarization":3,"SpeakerRoles":[{"RoleAudioUrl":"需要认证角色的声纹音频地址","RoleName":"需要认证角色的名称"}]}"</p>
|
|
842
|
+
:param _SpeakerRoles: <p>开启角色分离能力配合SpeakerDiarization: 3 使用,ASR增值服务,<strong>仅可传入一组声纹信息</strong>进行角色认证,仅支持16k_zh_en_2.0和16k_zh_en引擎。需传入SpeakerRoleInfo数据组,确定说话人的角色信息,涉及RoleAudioUrl和RoleName两个参数。 RoleAudioUrl:需要认证角色的声纹音频地址,建议30s内的纯净人声,最长不能超过45s。 RoleName:需要认证角色的名称,若匹配成功,会替换话者分离中的SpeakerID。 示例: "{"EngineModelType":"16k_zh_en","ChannelNum":1,"ResTextFormat":1,"SourceType":0,"Url":"需要进行ASR识别的音频链接","SpeakerDiarization":3,"SpeakerRoles":[{"RoleAudioUrl":"需要认证角色的声纹音频地址","RoleName":"需要认证角色的名称"}]}"</p>
|
|
853
843
|
:type SpeakerRoles: list of SpeakerRoleInfo
|
|
854
844
|
"""
|
|
855
845
|
self._EngineModelType = None
|
|
@@ -880,7 +870,7 @@ class CreateRecTaskRequest(AbstractModel):
|
|
|
880
870
|
|
|
881
871
|
@property
|
|
882
872
|
def EngineModelType(self):
|
|
883
|
-
r"""<p>引擎模型类型<br
|
|
873
|
+
r"""<p>引擎模型类型<br>识别引擎采用分级计费方案,分为通用引擎、大模型1.0版引擎(原大模型版引擎)、大模型2.0版引擎。<a href="https://cloud.tencent.com/document/product/1093/35686">点击这里</a> 查看不同引擎的计费说明。</p><p><strong>大模型2.0引擎:</strong><br><strong>• 16k_zh_en_2.0:</strong>中英大模型引擎【大模型2.0版】。当前模型同时支持中文、英语、粤语、四川、陕西、河南、上海、湖南、湖北、安徽、闽南、潮汕等 <a href="https://cloud.tencent.com/document/product/1093/35682">31种方言</a> 的识别,且支持说话人分离能力。该模型参数量极大,语言模型性能增强,针对噪声大、回音大、人声小、人声远等低质量音频的识别准确率极大提升,<a href="https://console.cloud.tencent.com/asr/demonstrate">点击这里</a>对比中文普通话常规版本与中英大模型版本的识别效果;</p><p><strong>大模型1.0引擎:</strong><br><strong>• 8k_zh_large:</strong>中文电话场景专用大模型引擎【大模型1.0版】。当前模型同时支持中文、上海话、四川话、武汉话、贵阳话、昆明话、西安话、郑州话、太原话、兰州话、银川话、西宁话、南京话、合肥话、南昌话、长沙话、苏州话、杭州话、济南话、天津话、石家庄话、黑龙江话、吉林话、辽宁话、闽南语、客家话、粤语、南宁话方言识别,通过显著提升模型参数规模与语言建模能力,实现对电话音频中复杂场景(如口音干扰、背景噪声)的高精度识别,识别准确率较常规版本大幅提升。<a href="https://console.cloud.tencent.com/asr/demonstrate">点击这里</a> 对比常规版本与普方大模型效果;<br>• <strong>16k_zh_en:</strong>中英大模型引擎【大模型1.0版】。当前模型同时支持中文、英语、粤语、四川、陕西、河南、上海、湖南、湖北、安徽、闽南、潮汕等 <a href="https://cloud.tencent.com/document/product/1093/35682">31种方言</a> 的识别,模型参数量极大,语言模型性能增强,针对噪声大、回音大、人声小、人声远等低质量音频的识别准确率极大提升,<a href="https://console.cloud.tencent.com/asr/demonstrate">点击这里</a>对比中文普通话常规版本与中英大模型版本的识别效果;<br>• <strong>16k_multi_lang:</strong>多语种大模型引擎【大模型1.0版】。当前模型同时支持英语、日语、韩语、阿拉伯语、菲律宾语、法语、印地语、印尼语、马来语、葡萄牙语、西班牙语、泰语、土耳其语、越南语、德语的识别,可实现15个语种的自动识别(句子/段落级别);<br>• <strong>16k_en_large:</strong>英语大模型引擎。</p><p><strong>通用引擎:</strong><br>• 8k_zh:中文电话通讯;<br>• 8k_en:英文电话通讯;</p><p><strong>注意:电话通讯场景请务必使用8k引擎,电话通讯场景以外的其它识别场景,请务必使用16k引擎。</strong>如您有电话通讯场景识别需求,但发现需求语种仅支持16k,可将8k音频传入下方16k引擎,亦能获取识别结果。但<strong>16k引擎并非基于电话通讯数据训练,无法承诺此种调用方式的识别效果,需由您自行验证识别结果是否可用。</strong></p><p>• <strong>16k_zh:</strong>中文普通话通用引擎,支持中文普通话和少量英语,使用丰富的中文普通话语料训练,覆盖场景广泛,适用于除电话通讯外的所有中文普通话识别场景;<br>• <strong>16k_en:</strong>英语;<br>• <strong>16k_yue:</strong>粤语;<br>• <strong>16k_zh-PY:</strong>中英粤混合引擎,使用一个引擎同时识别中文普通话、英语、粤语三个语言;<br>• <strong>16k_zh-TW</strong>:中文繁体;<br>• <strong>16k_ja:</strong>日语;<br>• <strong>16k_ko:</strong>韩语;<br>• <strong>16k_vi:</strong>越南语;<br>• <strong>16k_ms:</strong>马来语;<br>• <strong>16k_id:</strong>印度尼西亚语;<br>• <strong>16k_fil:</strong>菲律宾语;<br>• <strong>16k_th:</strong>泰语;<br>• <strong>16k_pt:</strong>葡萄牙语;<br>• <strong>16k_tr:</strong>土耳其语;<br>• <strong>16k_ar:</strong>阿拉伯语;<br>• <strong>16k_es:</strong>西班牙语;<br>• <strong>16k_hi:</strong>印地语;<br>• <strong>16k_fr:</strong>法语;<br>• <strong>16k_zh_medical:</strong>中文医疗引擎;<br>• <strong>16k_de:</strong>德语;</p><p>枚举值:</p><ul><li>16k_zh_en: 中文普通话通用引擎,支持中文普通话和少量英语,使用丰富的中文普通话语料训练,覆盖场景广泛,适用于除电话通讯外的所有中文普通话识别场景</li></ul>
|
|
884
874
|
:rtype: str
|
|
885
875
|
"""
|
|
886
876
|
return self._EngineModelType
|
|
@@ -968,7 +958,7 @@ class CreateRecTaskRequest(AbstractModel):
|
|
|
968
958
|
|
|
969
959
|
@property
|
|
970
960
|
def SpeakerDiarization(self):
|
|
971
|
-
r"""<p>是否开启说话人分离<br>0:不开启;<br>1:开启(仅支持以下引擎:8k_zh/8k_zh_large/16k_zh/16k_ms/16k_en/16k_id/16k_zh_dialect/
|
|
961
|
+
r"""<p>是否开启说话人分离<br>0:不开启;<br>1:开启(仅支持以下引擎:8k_zh/8k_zh_large/16k_zh_en_2.0/16k_zh_en/16k_zh/16k_ms/16k_en/16k_id/16k_zh_dialect/16k_es/16k_fr/16k_ja/16k_ko,且ChannelNum=1时可用);<br>3: 开启角色分离,需配合SpeakerRoles参数使用(增值服务,仅支持16k_zh_en_2.0、16k_zh_en引擎,可支持传入声纹对录音文件内的说话人进行角色认证)<br>默认值为 0</p><p>注意:<br>8k双声道电话音频请按 <strong>ChannelNum 识别声道数</strong> 的参数描述使用默认值</p>
|
|
972
962
|
:rtype: int
|
|
973
963
|
"""
|
|
974
964
|
return self._SpeakerDiarization
|
|
@@ -1003,7 +993,7 @@ class CreateRecTaskRequest(AbstractModel):
|
|
|
1003
993
|
def ReinforceHotword(self):
|
|
1004
994
|
warnings.warn("parameter `ReinforceHotword` is deprecated", DeprecationWarning)
|
|
1005
995
|
|
|
1006
|
-
r"""<p
|
|
996
|
+
r"""<p>热词增强功能(目前仅支持中文普通话引擎)1:开启热词增强功能注意:热词增强功能开启后,将对传入的热词表id开启同音替换功能,可以在这里查看<a href="https://cloud.tencent.com/document/product/1093/40996">热词表配置方法</a>。效果举例:在热词表中配置“蜜制”一词,并开启增强功能,与“蜜制”(mìzhì)同音同调的“秘制”(mìzhì)的识别结果会被强制替换成“蜜制”。<strong>建议客户根据实际的业务需求开启该功能</strong></p>
|
|
1007
997
|
:rtype: int
|
|
1008
998
|
"""
|
|
1009
999
|
return self._ReinforceHotword
|
|
@@ -1027,7 +1017,7 @@ class CreateRecTaskRequest(AbstractModel):
|
|
|
1027
1017
|
|
|
1028
1018
|
@property
|
|
1029
1019
|
def EmotionRecognition(self):
|
|
1030
|
-
r"""<p><strong>【增值付费功能】</strong>情绪识别能力(目前仅支持 16k_zh , 16k_zh_en , 8k_zh
|
|
1020
|
+
r"""<p><strong>【增值付费功能】</strong>情绪识别能力(目前仅支持 16k_zh , 16k_zh_en_2.0 , 16k_zh_en , 8k_zh )0:不开启;1:开启情绪识别,但不在文本展示情绪标签;2:开启情绪识别,并且在文本展示情绪标签(<strong>该功能需要设置ResTextFormat 大于0</strong>)默认值为0支持的情绪分类为:高兴、伤心、愤怒注意:1. <strong>本功能为增值服务</strong>,需将参数设置为1或2时方可按对应方式生效;2. 如果传入参数值1或2,需确保账号已购买<a href="https://cloud.tencent.com/document/product/1093/35686#97ae4aa0-29a0-4066-9f07-ccaf8856a16b">情绪识别资源包</a>,或账号开启后付费;<strong>若当前账号已开启后付费功能,并传入参数值1或2,将<a href="https://cloud.tencent.com/document/product/1093/35686#d912167d-ffd5-41a9-8b1c-2e89845a6852">自动计费</a>)</strong>;3. 参数设置为0时,无需购买资源包,也不会消耗情绪识别对应资源</p>
|
|
1031
1021
|
:rtype: int
|
|
1032
1022
|
"""
|
|
1033
1023
|
return self._EmotionRecognition
|
|
@@ -1104,7 +1094,7 @@ class CreateRecTaskRequest(AbstractModel):
|
|
|
1104
1094
|
|
|
1105
1095
|
@property
|
|
1106
1096
|
def Extra(self):
|
|
1107
|
-
r"""<p
|
|
1097
|
+
r"""<p>传入额外参数,默认为空字符串,如果传入必须是合法的 JSON 字符串。可用字段有:</p><p>Domain:提升特定领域识别效果</p><ul><li>0:不开启</li><li>1:科技领域</li><li>2:电影领域</li><li>3:歌曲领域</li></ul><p>默认值为0</p><p>示例: {"Domain":3}<br>增强歌曲领域识别效果</p>
|
|
1108
1098
|
:rtype: str
|
|
1109
1099
|
"""
|
|
1110
1100
|
return self._Extra
|
|
@@ -1148,7 +1138,7 @@ class CreateRecTaskRequest(AbstractModel):
|
|
|
1148
1138
|
|
|
1149
1139
|
@property
|
|
1150
1140
|
def SpeakerRoles(self):
|
|
1151
|
-
r"""<p>开启角色分离能力配合SpeakerDiarization: 3 使用,ASR增值服务,<strong>仅可传入一组声纹信息</strong>进行角色认证,仅支持16k_zh_en引擎。需传入SpeakerRoleInfo数据组,确定说话人的角色信息,涉及RoleAudioUrl和RoleName两个参数。 RoleAudioUrl:需要认证角色的声纹音频地址,建议30s内的纯净人声,最长不能超过45s。 RoleName:需要认证角色的名称,若匹配成功,会替换话者分离中的SpeakerID。 示例: "{"EngineModelType":"16k_zh_en","ChannelNum":1,"ResTextFormat":1,"SourceType":0,"Url":"需要进行ASR识别的音频链接","SpeakerDiarization":3,"SpeakerRoles":[{"RoleAudioUrl":"需要认证角色的声纹音频地址","RoleName":"需要认证角色的名称"}]}"</p>
|
|
1141
|
+
r"""<p>开启角色分离能力配合SpeakerDiarization: 3 使用,ASR增值服务,<strong>仅可传入一组声纹信息</strong>进行角色认证,仅支持16k_zh_en_2.0和16k_zh_en引擎。需传入SpeakerRoleInfo数据组,确定说话人的角色信息,涉及RoleAudioUrl和RoleName两个参数。 RoleAudioUrl:需要认证角色的声纹音频地址,建议30s内的纯净人声,最长不能超过45s。 RoleName:需要认证角色的名称,若匹配成功,会替换话者分离中的SpeakerID。 示例: "{"EngineModelType":"16k_zh_en","ChannelNum":1,"ResTextFormat":1,"SourceType":0,"Url":"需要进行ASR识别的音频链接","SpeakerDiarization":3,"SpeakerRoles":[{"RoleAudioUrl":"需要认证角色的声纹音频地址","RoleName":"需要认证角色的名称"}]}"</p>
|
|
1152
1142
|
:rtype: list of SpeakerRoleInfo
|
|
1153
1143
|
"""
|
|
1154
1144
|
return self._SpeakerRoles
|
|
@@ -4463,15 +4453,11 @@ class UpdateAsrKeyWordLibRequest(AbstractModel):
|
|
|
4463
4453
|
|
|
4464
4454
|
def __init__(self):
|
|
4465
4455
|
r"""
|
|
4466
|
-
:param _KeyWordLibId:
|
|
4456
|
+
:param _KeyWordLibId: <p>关键词表ID</p>
|
|
4467
4457
|
:type KeyWordLibId: str
|
|
4468
|
-
:param _Name:
|
|
4469
|
-
仅限中英文数字-_
|
|
4458
|
+
:param _Name: <p>词表名称,长度在1-20之间<br>仅限中英文数字-_</p>
|
|
4470
4459
|
:type Name: str
|
|
4471
|
-
:param _KeyWordFile:
|
|
4472
|
-
- 格式要求:TXT 每行只有一个词,不满足格式则报错无法上传
|
|
4473
|
-
- 每个词最多5个汉字或15个字符,单个词库最多不超过100个词
|
|
4474
|
-
- 此参数为空则只更新词表名称
|
|
4460
|
+
:param _KeyWordFile: <ul><li>词文件(纯文本文件)以行分隔 ,进行二进制base64编码</li><li>格式要求:TXT 每行只有一个词,不满足格式则报错无法上传 </li><li>每个词最多5个汉字或15个字符,单个词库最多不超过100个词</li><li>此参数为空则只更新词表名称</li></ul>
|
|
4475
4461
|
:type KeyWordFile: str
|
|
4476
4462
|
"""
|
|
4477
4463
|
self._KeyWordLibId = None
|
|
@@ -4480,7 +4466,7 @@ class UpdateAsrKeyWordLibRequest(AbstractModel):
|
|
|
4480
4466
|
|
|
4481
4467
|
@property
|
|
4482
4468
|
def KeyWordLibId(self):
|
|
4483
|
-
r"""
|
|
4469
|
+
r"""<p>关键词表ID</p>
|
|
4484
4470
|
:rtype: str
|
|
4485
4471
|
"""
|
|
4486
4472
|
return self._KeyWordLibId
|
|
@@ -4491,8 +4477,7 @@ class UpdateAsrKeyWordLibRequest(AbstractModel):
|
|
|
4491
4477
|
|
|
4492
4478
|
@property
|
|
4493
4479
|
def Name(self):
|
|
4494
|
-
r"""
|
|
4495
|
-
仅限中英文数字-_
|
|
4480
|
+
r"""<p>词表名称,长度在1-20之间<br>仅限中英文数字-_</p>
|
|
4496
4481
|
:rtype: str
|
|
4497
4482
|
"""
|
|
4498
4483
|
return self._Name
|
|
@@ -4503,10 +4488,7 @@ class UpdateAsrKeyWordLibRequest(AbstractModel):
|
|
|
4503
4488
|
|
|
4504
4489
|
@property
|
|
4505
4490
|
def KeyWordFile(self):
|
|
4506
|
-
r"""
|
|
4507
|
-
- 格式要求:TXT 每行只有一个词,不满足格式则报错无法上传
|
|
4508
|
-
- 每个词最多5个汉字或15个字符,单个词库最多不超过100个词
|
|
4509
|
-
- 此参数为空则只更新词表名称
|
|
4491
|
+
r"""<ul><li>词文件(纯文本文件)以行分隔 ,进行二进制base64编码</li><li>格式要求:TXT 每行只有一个词,不满足格式则报错无法上传 </li><li>每个词最多5个汉字或15个字符,单个词库最多不超过100个词</li><li>此参数为空则只更新词表名称</li></ul>
|
|
4510
4492
|
:rtype: str
|
|
4511
4493
|
"""
|
|
4512
4494
|
return self._KeyWordFile
|
|
@@ -4537,7 +4519,7 @@ class UpdateAsrKeyWordLibResponse(AbstractModel):
|
|
|
4537
4519
|
|
|
4538
4520
|
def __init__(self):
|
|
4539
4521
|
r"""
|
|
4540
|
-
:param _Data:
|
|
4522
|
+
:param _Data: <p>关键词表ID数据</p>
|
|
4541
4523
|
:type Data: :class:`tencentcloud.asr.v20190614.models.KeyWordLibIdData`
|
|
4542
4524
|
:param _RequestId: 唯一请求 ID,由服务端生成,每次请求都会返回(若请求因其他原因未能抵达服务端,则该次请求不会获得 RequestId)。定位问题时需要提供该次请求的 RequestId。
|
|
4543
4525
|
:type RequestId: str
|
|
@@ -4547,7 +4529,7 @@ class UpdateAsrKeyWordLibResponse(AbstractModel):
|
|
|
4547
4529
|
|
|
4548
4530
|
@property
|
|
4549
4531
|
def Data(self):
|
|
4550
|
-
r"""
|
|
4532
|
+
r"""<p>关键词表ID数据</p>
|
|
4551
4533
|
:rtype: :class:`tencentcloud.asr.v20190614.models.KeyWordLibIdData`
|
|
4552
4534
|
"""
|
|
4553
4535
|
return self._Data
|
|
@@ -1,6 +1,6 @@
|
|
|
1
1
|
Metadata-Version: 2.1
|
|
2
2
|
Name: tencentcloud-sdk-python-asr
|
|
3
|
-
Version: 3.1.
|
|
3
|
+
Version: 3.1.160
|
|
4
4
|
Summary: Tencent Cloud Asr SDK for Python
|
|
5
5
|
Home-page: https://github.com/TencentCloud/tencentcloud-sdk-python
|
|
6
6
|
Author: Tencent Cloud
|
|
@@ -15,7 +15,7 @@ Classifier: Programming Language :: Python :: 2.7
|
|
|
15
15
|
Classifier: Programming Language :: Python :: 3
|
|
16
16
|
Classifier: Programming Language :: Python :: 3.6
|
|
17
17
|
Classifier: Programming Language :: Python :: 3.7
|
|
18
|
-
Requires-Dist: tencentcloud-sdk-python-common<4.0.0,>=3.1.
|
|
18
|
+
Requires-Dist: tencentcloud-sdk-python-common<4.0.0,>=3.1.160
|
|
19
19
|
|
|
20
20
|
============================
|
|
21
21
|
Tencent Cloud SDK for Python
|
|
@@ -0,0 +1 @@
|
|
|
1
|
+
tencentcloud-sdk-python-common<4.0.0,>=3.1.160
|
|
@@ -1 +0,0 @@
|
|
|
1
|
-
tencentcloud-sdk-python-common<4.0.0,>=3.1.130
|
|
File without changes
|
|
File without changes
|
|
File without changes
|
|
File without changes
|
|
File without changes
|
|
File without changes
|
|
File without changes
|
|
File without changes
|
|
File without changes
|