tencentcloud-sdk-python-asr 3.1.101__tar.gz → 3.1.130__tar.gz

This diff represents the content of publicly available package versions that have been released to one of the supported registries. The information contained in this diff is provided for informational purposes only and reflects changes between package versions as they appear in their respective public registries.
Files changed (17) hide show
  1. {tencentcloud_sdk_python_asr-3.1.101 → tencentcloud_sdk_python_asr-3.1.130}/PKG-INFO +2 -2
  2. {tencentcloud_sdk_python_asr-3.1.101 → tencentcloud_sdk_python_asr-3.1.130}/setup.py +1 -1
  3. {tencentcloud_sdk_python_asr-3.1.101 → tencentcloud_sdk_python_asr-3.1.130}/tencentcloud/__init__.py +1 -1
  4. {tencentcloud_sdk_python_asr-3.1.101 → tencentcloud_sdk_python_asr-3.1.130}/tencentcloud/asr/v20190614/asr_client.py +23 -0
  5. {tencentcloud_sdk_python_asr-3.1.101 → tencentcloud_sdk_python_asr-3.1.130}/tencentcloud/asr/v20190614/asr_client_async.py +18 -0
  6. {tencentcloud_sdk_python_asr-3.1.101 → tencentcloud_sdk_python_asr-3.1.130}/tencentcloud/asr/v20190614/models.py +106 -4
  7. {tencentcloud_sdk_python_asr-3.1.101 → tencentcloud_sdk_python_asr-3.1.130}/tencentcloud_sdk_python_asr.egg-info/PKG-INFO +2 -2
  8. tencentcloud_sdk_python_asr-3.1.130/tencentcloud_sdk_python_asr.egg-info/requires.txt +1 -0
  9. tencentcloud_sdk_python_asr-3.1.101/tencentcloud_sdk_python_asr.egg-info/requires.txt +0 -1
  10. {tencentcloud_sdk_python_asr-3.1.101 → tencentcloud_sdk_python_asr-3.1.130}/README.rst +0 -0
  11. {tencentcloud_sdk_python_asr-3.1.101 → tencentcloud_sdk_python_asr-3.1.130}/setup.cfg +0 -0
  12. {tencentcloud_sdk_python_asr-3.1.101 → tencentcloud_sdk_python_asr-3.1.130}/tencentcloud/asr/__init__.py +0 -0
  13. {tencentcloud_sdk_python_asr-3.1.101 → tencentcloud_sdk_python_asr-3.1.130}/tencentcloud/asr/v20190614/__init__.py +0 -0
  14. {tencentcloud_sdk_python_asr-3.1.101 → tencentcloud_sdk_python_asr-3.1.130}/tencentcloud/asr/v20190614/errorcodes.py +0 -0
  15. {tencentcloud_sdk_python_asr-3.1.101 → tencentcloud_sdk_python_asr-3.1.130}/tencentcloud_sdk_python_asr.egg-info/SOURCES.txt +0 -0
  16. {tencentcloud_sdk_python_asr-3.1.101 → tencentcloud_sdk_python_asr-3.1.130}/tencentcloud_sdk_python_asr.egg-info/dependency_links.txt +0 -0
  17. {tencentcloud_sdk_python_asr-3.1.101 → tencentcloud_sdk_python_asr-3.1.130}/tencentcloud_sdk_python_asr.egg-info/top_level.txt +0 -0
@@ -1,6 +1,6 @@
1
1
  Metadata-Version: 2.1
2
2
  Name: tencentcloud-sdk-python-asr
3
- Version: 3.1.101
3
+ Version: 3.1.130
4
4
  Summary: Tencent Cloud Asr SDK for Python
5
5
  Home-page: https://github.com/TencentCloud/tencentcloud-sdk-python
6
6
  Author: Tencent Cloud
@@ -15,7 +15,7 @@ Classifier: Programming Language :: Python :: 2.7
15
15
  Classifier: Programming Language :: Python :: 3
16
16
  Classifier: Programming Language :: Python :: 3.6
17
17
  Classifier: Programming Language :: Python :: 3.7
18
- Requires-Dist: tencentcloud-sdk-python-common<4.0.0,>=3.1.101
18
+ Requires-Dist: tencentcloud-sdk-python-common<4.0.0,>=3.1.130
19
19
 
20
20
  ============================
21
21
  Tencent Cloud SDK for Python
@@ -8,7 +8,7 @@ ROOT = os.path.dirname(__file__)
8
8
 
9
9
  setup(
10
10
  name='tencentcloud-sdk-python-asr',
11
- install_requires=["tencentcloud-sdk-python-common>=3.1.101,<4.0.0"],
11
+ install_requires=["tencentcloud-sdk-python-common>=3.1.130,<4.0.0"],
12
12
 
13
13
  version=tencentcloud.__version__,
14
14
  description='Tencent Cloud Asr SDK for Python',
@@ -14,4 +14,4 @@
14
14
  # limitations under the License.
15
15
 
16
16
 
17
- __version__ = '3.1.101'
17
+ __version__ = '3.1.130'
@@ -738,6 +738,29 @@ class AsrClient(AbstractClient):
738
738
  raise TencentCloudSDKException(type(e).__name__, str(e))
739
739
 
740
740
 
741
+ def VoicePrintGroupList(self, request):
742
+ r"""返回注册的说话人分组信息列表
743
+
744
+ :param request: Request instance for VoicePrintGroupList.
745
+ :type request: :class:`tencentcloud.asr.v20190614.models.VoicePrintGroupListRequest`
746
+ :rtype: :class:`tencentcloud.asr.v20190614.models.VoicePrintGroupListResponse`
747
+
748
+ """
749
+ try:
750
+ params = request._serialize()
751
+ headers = request.headers
752
+ body = self.call("VoicePrintGroupList", params, headers=headers)
753
+ response = json.loads(body)
754
+ model = models.VoicePrintGroupListResponse()
755
+ model._deserialize(response["Response"])
756
+ return model
757
+ except Exception as e:
758
+ if isinstance(e, TencentCloudSDKException):
759
+ raise
760
+ else:
761
+ raise TencentCloudSDKException(type(e).__name__, str(e))
762
+
763
+
741
764
  def VoicePrintGroupVerify(self, request):
742
765
  r"""说话人验证1:N接口,可以通过传入一段说话人音频,并且指定已存在的groupId, 和返回topN, 接口返回groupId内所有声纹和传入音频声纹比对打分TopN的结果。
743
766
 
@@ -592,6 +592,24 @@ class AsrClient(AbstractClient):
592
592
 
593
593
  return await self.call_and_deserialize(**kwargs)
594
594
 
595
+ async def VoicePrintGroupList(
596
+ self,
597
+ request: models.VoicePrintGroupListRequest,
598
+ opts: Dict = None,
599
+ ) -> models.VoicePrintGroupListResponse:
600
+ """
601
+ 返回注册的说话人分组信息列表
602
+ """
603
+
604
+ kwargs = {}
605
+ kwargs["action"] = "VoicePrintGroupList"
606
+ kwargs["params"] = request._serialize()
607
+ kwargs["resp_cls"] = models.VoicePrintGroupListResponse
608
+ kwargs["headers"] = request.headers
609
+ kwargs["opts"] = opts or {}
610
+
611
+ return await self.call_and_deserialize(**kwargs)
612
+
595
613
  async def VoicePrintGroupVerify(
596
614
  self,
597
615
  request: models.VoicePrintGroupVerifyRequest,
@@ -801,7 +801,7 @@ class CreateRecTaskRequest(AbstractModel):
801
801
 
802
802
  def __init__(self):
803
803
  r"""
804
- :param _EngineModelType: <p>引擎模型类型<br>识别引擎采用分级计费方案,标记为“大模型版”的引擎适用大模型计费方案,<a href="https://cloud.tencent.com/document/product/1093/35686">点击这里</a> 查看产品计费说明</p><p>电话通讯场景引擎:<br><strong>注意:电话通讯场景,请务必使用以下8k引擎</strong><br>• 8k_zh:中文电话通讯;<br>• 8k_en:英文电话通讯;<br>• 8k_zh_large:中文电话场景专用大模型引擎【大模型版】。当前模型同时支持中文、上海话、四川话、武汉话、贵阳话、昆明话、西安话、郑州话、太原话、兰州话、银川话、西宁话、南京话、合肥话、南昌话、长沙话、苏州话、杭州话、济南话、天津话、石家庄话、黑龙江话、吉林话、辽宁话、闽南语、客家话、粤语、南宁话方言识别,通过显著提升模型参数规模与语言建模能力,实现对电话音频中复杂场景(如口音干扰、背景噪声)的高精度识别,识别准确率较常规版本大幅提升。<a href="https://console.cloud.tencent.com/asr/demonstrate">点击这里</a> 对比常规版本与普方大模型效果;</p><p>注意:如您有电话通讯场景识别需求,但发现需求语种仅支持16k,可将8k音频传入下方16k引擎,亦能获取识别结果。但<strong>16k引擎并非基于电话通讯数据训练,无法承诺此种调用方式的识别效果,需由您自行验证识别结果是否可用</strong></p><p>通用场景引擎:<br><strong>注意:除电话通讯场景以外的其它识别场景,请务必使用以下16k引擎</strong><br>• <strong>16k_zh_en</strong>:中英粤+9种方言大模型引擎【大模型版】。当前模型同时支持中文、英语、粤语、四川、陕西、河南、上海、湖南、湖北、安徽、闽南和潮汕方言识别,模型参数量极大,语言模型性能增强,针对噪声大、回音大、人声小、人声远等低质量音频的识别准确率极大提升;<br>• <strong>16k_zh_large:</strong>普方英大模型引擎【大模型版】。当前模型同时支持中文、英文、<a href="https://cloud.tencent.com/document/product/1093/35682">多种中文方言</a>等语言的识别,模型参数量极大,语言模型性能增强,针对噪声大、回音大、人声小、人声远等低质量音频的识别准确率极大提升,<a href="https://console.cloud.tencent.com/asr/demonstrate">点击这里</a> 对比中文普通话常规版本与普方英大模型版本的识别效果;<br>• <strong>16k_multi_lang:</strong>多语种大模型引擎【大模型版】。当前模型同时支持英语、日语、韩语、阿拉伯语、菲律宾语、法语、印地语、印尼语、马来语、葡萄牙语、西班牙语、泰语、土耳其语、越南语、德语的识别,可实现15个语种的自动识别(句子/段落级别);<br>• <strong>16k_zh:</strong>中文普通话通用引擎,支持中文普通话和少量英语,使用丰富的中文普通话语料训练,覆盖场景广泛,适用于除电话通讯外的所有中文普通话识别场景;<br>• <strong>16k_en:</strong>英语;<br>• <strong>16k_en_large:</strong>英语大模型;<br>• <strong>16k_yue:</strong>粤语;<br>• <strong>16k_zh-PY:</strong>中英粤混合引擎,使用一个引擎同时识别中文普通话、英语、粤语三个语言;<br>• <strong>16k_zh-TW</strong>:中文繁体;<br>• <strong>16k_ja:</strong>日语;<br>• <strong>16k_ko:</strong>韩语;<br>• <strong>16k_vi:</strong>越南语;<br>• <strong>16k_ms:</strong>马来语;<br>• <strong>16k_id:</strong>印度尼西亚语;<br>• <strong>16k_fil:</strong>菲律宾语;<br>• <strong>16k_th:</strong>泰语;<br>• <strong>16k_pt:</strong>葡萄牙语;<br>• <strong>16k_tr:</strong>土耳其语;<br>• <strong>16k_ar:</strong>阿拉伯语;<br>• <strong>16k_es:</strong>西班牙语;<br>• <strong>16k_hi:</strong>印地语;<br>• <strong>16k_fr:</strong>法语;<br>• <strong>16k_zh_medical:</strong>中文医疗引擎;<br>• <strong>16k_de:</strong>德语;</p><p>枚举值:</p><ul><li>16k_zh: 中文普通话通用引擎,支持中文普通话和少量英语,使用丰富的中文普通话语料训练,覆盖场景广泛,适用于除电话通讯外的所有中文普通话识别场景</li></ul>
804
+ :param _EngineModelType: <p>引擎模型类型<br>识别引擎采用分级计费方案,标记为“大模型版”的引擎适用大模型计费方案,<a href="https://cloud.tencent.com/document/product/1093/35686">点击这里</a> 查看产品计费说明</p><p>电话通讯场景引擎:<br><strong>注意:电话通讯场景,请务必使用以下8k引擎</strong><br>• 8k_zh:中文电话通讯;<br>• 8k_en:英文电话通讯;<br>• 8k_zh_large:中文电话场景专用大模型引擎【大模型版】。当前模型同时支持中文、上海话、四川话、武汉话、贵阳话、昆明话、西安话、郑州话、太原话、兰州话、银川话、西宁话、南京话、合肥话、南昌话、长沙话、苏州话、杭州话、济南话、天津话、石家庄话、黑龙江话、吉林话、辽宁话、闽南语、客家话、粤语、南宁话方言识别,通过显著提升模型参数规模与语言建模能力,实现对电话音频中复杂场景(如口音干扰、背景噪声)的高精度识别,识别准确率较常规版本大幅提升。<a href="https://console.cloud.tencent.com/asr/demonstrate">点击这里</a> 对比常规版本与普方大模型效果;</p><p>注意:如您有电话通讯场景识别需求,但发现需求语种仅支持16k,可将8k音频传入下方16k引擎,亦能获取识别结果。但<strong>16k引擎并非基于电话通讯数据训练,无法承诺此种调用方式的识别效果,需由您自行验证识别结果是否可用</strong></p><p>通用场景引擎:<br><strong>注意:除电话通讯场景以外的其它识别场景,请务必使用以下16k引擎</strong><br>• <strong>16k_zh_en:</strong>普方英大模型引擎【大模型版】。当前模型同时支持中文、英文和 <a href="https://cloud.tencent.com/document/product/1093/35682">31种方言</a> 的识别,模型参数量极大,语言模型性能增强,针对噪声大、回音大、人声小、人声远等低质量音频的识别准确率极大提升,<a href="https://console.cloud.tencent.com/asr/demonstrate">点击这里</a> 对比中文普通话常规版本与普方英大模型版本的识别效果;<br>• <strong>16k_multi_lang:</strong>多语种大模型引擎【大模型版】。当前模型同时支持英语、日语、韩语、阿拉伯语、菲律宾语、法语、印地语、印尼语、马来语、葡萄牙语、西班牙语、泰语、土耳其语、越南语、德语的识别,可实现15个语种的自动识别(句子/段落级别);<br>• <strong>16k_zh:</strong>中文普通话通用引擎,支持中文普通话和少量英语,使用丰富的中文普通话语料训练,覆盖场景广泛,适用于除电话通讯外的所有中文普通话识别场景;<br>• <strong>16k_en:</strong>英语;<br>• <strong>16k_en_large:</strong>英语大模型;<br>• <strong>16k_yue:</strong>粤语;<br>• <strong>16k_zh-PY:</strong>中英粤混合引擎,使用一个引擎同时识别中文普通话、英语、粤语三个语言;<br>• <strong>16k_zh-TW</strong>:中文繁体;<br>• <strong>16k_ja:</strong>日语;<br>• <strong>16k_ko:</strong>韩语;<br>• <strong>16k_vi:</strong>越南语;<br>• <strong>16k_ms:</strong>马来语;<br>• <strong>16k_id:</strong>印度尼西亚语;<br>• <strong>16k_fil:</strong>菲律宾语;<br>• <strong>16k_th:</strong>泰语;<br>• <strong>16k_pt:</strong>葡萄牙语;<br>• <strong>16k_tr:</strong>土耳其语;<br>• <strong>16k_ar:</strong>阿拉伯语;<br>• <strong>16k_es:</strong>西班牙语;<br>• <strong>16k_hi:</strong>印地语;<br>• <strong>16k_fr:</strong>法语;<br>• <strong>16k_zh_medical:</strong>中文医疗引擎;<br>• <strong>16k_de:</strong>德语;</p><p>枚举值:</p><ul><li>16k_zh: 中文普通话通用引擎,支持中文普通话和少量英语,使用丰富的中文普通话语料训练,覆盖场景广泛,适用于除电话通讯外的所有中文普通话识别场景</li></ul>
805
805
  :type EngineModelType: str
806
806
  :param _ChannelNum: <p>识别声道数<br>1:单声道(16k音频仅支持单声道,<strong>请勿</strong>设置为双声道);<br>2:双声道(仅支持8k电话音频,且双声道应分别为通话双方)</p><p>注意:<br>• 16k音频:仅支持单声道识别,<strong>需设置ChannelNum=1</strong>;<br>• 8k电话音频:支持单声道、双声道识别,<strong>建议设置ChannelNum=2,即双声道</strong>。双声道能够物理区分说话人、避免说话双方重叠产生的识别错误,能达到最好的说话人分离效果和识别效果。设置双声道后,将自动区分说话人,因此<strong>无需再开启说话人分离功能</strong>,相关参数(<strong>SpeakerDiarization、SpeakerNumber</strong>)使用默认值即可,返回的ResultDetail中的speakerId的值为0代表左声道,值为1代表右声道。</p>
807
807
  :type ChannelNum: int
@@ -817,7 +817,7 @@ class CreateRecTaskRequest(AbstractModel):
817
817
  :type Url: str
818
818
  :param _CallbackUrl: <p>回调 URL<br>用户自行搭建的用于接收识别结果的服务URL<br>回调格式和内容详见:<a href="https://cloud.tencent.com/document/product/1093/52632">录音识别回调说明</a></p><p>注意:</p><ul><li>如果用户使用轮询方式获取识别结果,则无需提交该参数</li><li>建议在回调URL中带上您的业务ID等信息,以便处理业务逻辑</li></ul>
819
819
  :type CallbackUrl: str
820
- :param _SpeakerDiarization: <p>是否开启说话人分离<br>0:不开启;<br>1:开启(仅支持以下引擎:8k_zh/8k_zh_large/16k_zh/16k_ms/16k_en/16k_id/16k_zh_large/16k_zh_dialect/16k_zh_en/16k_es/16k_fr/16k_ja/16k_ko,且ChannelNum=1时可用);<br>3: 开启角色分离,需配合SpeakerRoles参数使用(增值服务,仅支持16k_zh_en引擎,可支持传入声纹对录音文件内的说话人进行角色认证)<br>默认值为 0</p><p>注意:<br>8k双声道电话音频请按 <strong>ChannelNum 识别声道数</strong> 的参数描述使用默认值</p>
820
+ :param _SpeakerDiarization: <p>是否开启说话人分离<br>0:不开启;<br>1:开启(仅支持以下引擎:8k_zh/8k_zh_large/16k_zh/16k_ms/16k_en/16k_id/16k_zh_dialect/16k_zh_en/16k_es/16k_fr/16k_ja/16k_ko,且ChannelNum=1时可用);<br>3: 开启角色分离,需配合SpeakerRoles参数使用(增值服务,仅支持16k_zh_en引擎,可支持传入声纹对录音文件内的说话人进行角色认证)<br>默认值为 0</p><p>注意:<br>8k双声道电话音频请按 <strong>ChannelNum 识别声道数</strong> 的参数描述使用默认值</p>
821
821
  :type SpeakerDiarization: int
822
822
  :param _SpeakerNumber: <p>说话人分离人数<br><strong>需配合开启说话人分离使用,不开启无效</strong>,取值范围:0-10<br>0:自动分离(最多分离出20个人);<br>1-10:指定人数分离;<br>默认值为 0<br>注:16k引擎不支持指定人数分离</p>
823
823
  :type SpeakerNumber: int
@@ -880,7 +880,7 @@ class CreateRecTaskRequest(AbstractModel):
880
880
 
881
881
  @property
882
882
  def EngineModelType(self):
883
- r"""<p>引擎模型类型<br>识别引擎采用分级计费方案,标记为“大模型版”的引擎适用大模型计费方案,<a href="https://cloud.tencent.com/document/product/1093/35686">点击这里</a> 查看产品计费说明</p><p>电话通讯场景引擎:<br><strong>注意:电话通讯场景,请务必使用以下8k引擎</strong><br>• 8k_zh:中文电话通讯;<br>• 8k_en:英文电话通讯;<br>• 8k_zh_large:中文电话场景专用大模型引擎【大模型版】。当前模型同时支持中文、上海话、四川话、武汉话、贵阳话、昆明话、西安话、郑州话、太原话、兰州话、银川话、西宁话、南京话、合肥话、南昌话、长沙话、苏州话、杭州话、济南话、天津话、石家庄话、黑龙江话、吉林话、辽宁话、闽南语、客家话、粤语、南宁话方言识别,通过显著提升模型参数规模与语言建模能力,实现对电话音频中复杂场景(如口音干扰、背景噪声)的高精度识别,识别准确率较常规版本大幅提升。<a href="https://console.cloud.tencent.com/asr/demonstrate">点击这里</a> 对比常规版本与普方大模型效果;</p><p>注意:如您有电话通讯场景识别需求,但发现需求语种仅支持16k,可将8k音频传入下方16k引擎,亦能获取识别结果。但<strong>16k引擎并非基于电话通讯数据训练,无法承诺此种调用方式的识别效果,需由您自行验证识别结果是否可用</strong></p><p>通用场景引擎:<br><strong>注意:除电话通讯场景以外的其它识别场景,请务必使用以下16k引擎</strong><br>• <strong>16k_zh_en</strong>:中英粤+9种方言大模型引擎【大模型版】。当前模型同时支持中文、英语、粤语、四川、陕西、河南、上海、湖南、湖北、安徽、闽南和潮汕方言识别,模型参数量极大,语言模型性能增强,针对噪声大、回音大、人声小、人声远等低质量音频的识别准确率极大提升;<br>• <strong>16k_zh_large:</strong>普方英大模型引擎【大模型版】。当前模型同时支持中文、英文、<a href="https://cloud.tencent.com/document/product/1093/35682">多种中文方言</a>等语言的识别,模型参数量极大,语言模型性能增强,针对噪声大、回音大、人声小、人声远等低质量音频的识别准确率极大提升,<a href="https://console.cloud.tencent.com/asr/demonstrate">点击这里</a> 对比中文普通话常规版本与普方英大模型版本的识别效果;<br>• <strong>16k_multi_lang:</strong>多语种大模型引擎【大模型版】。当前模型同时支持英语、日语、韩语、阿拉伯语、菲律宾语、法语、印地语、印尼语、马来语、葡萄牙语、西班牙语、泰语、土耳其语、越南语、德语的识别,可实现15个语种的自动识别(句子/段落级别);<br>• <strong>16k_zh:</strong>中文普通话通用引擎,支持中文普通话和少量英语,使用丰富的中文普通话语料训练,覆盖场景广泛,适用于除电话通讯外的所有中文普通话识别场景;<br>• <strong>16k_en:</strong>英语;<br>• <strong>16k_en_large:</strong>英语大模型;<br>• <strong>16k_yue:</strong>粤语;<br>• <strong>16k_zh-PY:</strong>中英粤混合引擎,使用一个引擎同时识别中文普通话、英语、粤语三个语言;<br>• <strong>16k_zh-TW</strong>:中文繁体;<br>• <strong>16k_ja:</strong>日语;<br>• <strong>16k_ko:</strong>韩语;<br>• <strong>16k_vi:</strong>越南语;<br>• <strong>16k_ms:</strong>马来语;<br>• <strong>16k_id:</strong>印度尼西亚语;<br>• <strong>16k_fil:</strong>菲律宾语;<br>• <strong>16k_th:</strong>泰语;<br>• <strong>16k_pt:</strong>葡萄牙语;<br>• <strong>16k_tr:</strong>土耳其语;<br>• <strong>16k_ar:</strong>阿拉伯语;<br>• <strong>16k_es:</strong>西班牙语;<br>• <strong>16k_hi:</strong>印地语;<br>• <strong>16k_fr:</strong>法语;<br>• <strong>16k_zh_medical:</strong>中文医疗引擎;<br>• <strong>16k_de:</strong>德语;</p><p>枚举值:</p><ul><li>16k_zh: 中文普通话通用引擎,支持中文普通话和少量英语,使用丰富的中文普通话语料训练,覆盖场景广泛,适用于除电话通讯外的所有中文普通话识别场景</li></ul>
883
+ r"""<p>引擎模型类型<br>识别引擎采用分级计费方案,标记为“大模型版”的引擎适用大模型计费方案,<a href="https://cloud.tencent.com/document/product/1093/35686">点击这里</a> 查看产品计费说明</p><p>电话通讯场景引擎:<br><strong>注意:电话通讯场景,请务必使用以下8k引擎</strong><br>• 8k_zh:中文电话通讯;<br>• 8k_en:英文电话通讯;<br>• 8k_zh_large:中文电话场景专用大模型引擎【大模型版】。当前模型同时支持中文、上海话、四川话、武汉话、贵阳话、昆明话、西安话、郑州话、太原话、兰州话、银川话、西宁话、南京话、合肥话、南昌话、长沙话、苏州话、杭州话、济南话、天津话、石家庄话、黑龙江话、吉林话、辽宁话、闽南语、客家话、粤语、南宁话方言识别,通过显著提升模型参数规模与语言建模能力,实现对电话音频中复杂场景(如口音干扰、背景噪声)的高精度识别,识别准确率较常规版本大幅提升。<a href="https://console.cloud.tencent.com/asr/demonstrate">点击这里</a> 对比常规版本与普方大模型效果;</p><p>注意:如您有电话通讯场景识别需求,但发现需求语种仅支持16k,可将8k音频传入下方16k引擎,亦能获取识别结果。但<strong>16k引擎并非基于电话通讯数据训练,无法承诺此种调用方式的识别效果,需由您自行验证识别结果是否可用</strong></p><p>通用场景引擎:<br><strong>注意:除电话通讯场景以外的其它识别场景,请务必使用以下16k引擎</strong><br>• <strong>16k_zh_en:</strong>普方英大模型引擎【大模型版】。当前模型同时支持中文、英文和 <a href="https://cloud.tencent.com/document/product/1093/35682">31种方言</a> 的识别,模型参数量极大,语言模型性能增强,针对噪声大、回音大、人声小、人声远等低质量音频的识别准确率极大提升,<a href="https://console.cloud.tencent.com/asr/demonstrate">点击这里</a> 对比中文普通话常规版本与普方英大模型版本的识别效果;<br>• <strong>16k_multi_lang:</strong>多语种大模型引擎【大模型版】。当前模型同时支持英语、日语、韩语、阿拉伯语、菲律宾语、法语、印地语、印尼语、马来语、葡萄牙语、西班牙语、泰语、土耳其语、越南语、德语的识别,可实现15个语种的自动识别(句子/段落级别);<br>• <strong>16k_zh:</strong>中文普通话通用引擎,支持中文普通话和少量英语,使用丰富的中文普通话语料训练,覆盖场景广泛,适用于除电话通讯外的所有中文普通话识别场景;<br>• <strong>16k_en:</strong>英语;<br>• <strong>16k_en_large:</strong>英语大模型;<br>• <strong>16k_yue:</strong>粤语;<br>• <strong>16k_zh-PY:</strong>中英粤混合引擎,使用一个引擎同时识别中文普通话、英语、粤语三个语言;<br>• <strong>16k_zh-TW</strong>:中文繁体;<br>• <strong>16k_ja:</strong>日语;<br>• <strong>16k_ko:</strong>韩语;<br>• <strong>16k_vi:</strong>越南语;<br>• <strong>16k_ms:</strong>马来语;<br>• <strong>16k_id:</strong>印度尼西亚语;<br>• <strong>16k_fil:</strong>菲律宾语;<br>• <strong>16k_th:</strong>泰语;<br>• <strong>16k_pt:</strong>葡萄牙语;<br>• <strong>16k_tr:</strong>土耳其语;<br>• <strong>16k_ar:</strong>阿拉伯语;<br>• <strong>16k_es:</strong>西班牙语;<br>• <strong>16k_hi:</strong>印地语;<br>• <strong>16k_fr:</strong>法语;<br>• <strong>16k_zh_medical:</strong>中文医疗引擎;<br>• <strong>16k_de:</strong>德语;</p><p>枚举值:</p><ul><li>16k_zh: 中文普通话通用引擎,支持中文普通话和少量英语,使用丰富的中文普通话语料训练,覆盖场景广泛,适用于除电话通讯外的所有中文普通话识别场景</li></ul>
884
884
  :rtype: str
885
885
  """
886
886
  return self._EngineModelType
@@ -968,7 +968,7 @@ class CreateRecTaskRequest(AbstractModel):
968
968
 
969
969
  @property
970
970
  def SpeakerDiarization(self):
971
- r"""<p>是否开启说话人分离<br>0:不开启;<br>1:开启(仅支持以下引擎:8k_zh/8k_zh_large/16k_zh/16k_ms/16k_en/16k_id/16k_zh_large/16k_zh_dialect/16k_zh_en/16k_es/16k_fr/16k_ja/16k_ko,且ChannelNum=1时可用);<br>3: 开启角色分离,需配合SpeakerRoles参数使用(增值服务,仅支持16k_zh_en引擎,可支持传入声纹对录音文件内的说话人进行角色认证)<br>默认值为 0</p><p>注意:<br>8k双声道电话音频请按 <strong>ChannelNum 识别声道数</strong> 的参数描述使用默认值</p>
971
+ r"""<p>是否开启说话人分离<br>0:不开启;<br>1:开启(仅支持以下引擎:8k_zh/8k_zh_large/16k_zh/16k_ms/16k_en/16k_id/16k_zh_dialect/16k_zh_en/16k_es/16k_fr/16k_ja/16k_ko,且ChannelNum=1时可用);<br>3: 开启角色分离,需配合SpeakerRoles参数使用(增值服务,仅支持16k_zh_en引擎,可支持传入声纹对录音文件内的说话人进行角色认证)<br>默认值为 0</p><p>注意:<br>8k双声道电话音频请按 <strong>ChannelNum 识别声道数</strong> 的参数描述使用默认值</p>
972
972
  :rtype: int
973
973
  """
974
974
  return self._SpeakerDiarization
@@ -5774,6 +5774,108 @@ class VoicePrintEnrollResponse(AbstractModel):
5774
5774
  self._RequestId = params.get("RequestId")
5775
5775
 
5776
5776
 
5777
+ class VoicePrintGroupList(AbstractModel):
5778
+ r"""声纹分组名称列表
5779
+
5780
+ """
5781
+
5782
+ def __init__(self):
5783
+ r"""
5784
+ :param _Total: <p>总数量</p>
5785
+ :type Total: int
5786
+ :param _GroupIds: <p>分组名称列表</p>
5787
+ :type GroupIds: list of str
5788
+ """
5789
+ self._Total = None
5790
+ self._GroupIds = None
5791
+
5792
+ @property
5793
+ def Total(self):
5794
+ r"""<p>总数量</p>
5795
+ :rtype: int
5796
+ """
5797
+ return self._Total
5798
+
5799
+ @Total.setter
5800
+ def Total(self, Total):
5801
+ self._Total = Total
5802
+
5803
+ @property
5804
+ def GroupIds(self):
5805
+ r"""<p>分组名称列表</p>
5806
+ :rtype: list of str
5807
+ """
5808
+ return self._GroupIds
5809
+
5810
+ @GroupIds.setter
5811
+ def GroupIds(self, GroupIds):
5812
+ self._GroupIds = GroupIds
5813
+
5814
+
5815
+ def _deserialize(self, params):
5816
+ self._Total = params.get("Total")
5817
+ self._GroupIds = params.get("GroupIds")
5818
+ memeber_set = set(params.keys())
5819
+ for name, value in vars(self).items():
5820
+ property_name = name[1:]
5821
+ if property_name in memeber_set:
5822
+ memeber_set.remove(property_name)
5823
+ if len(memeber_set) > 0:
5824
+ warnings.warn("%s fileds are useless." % ",".join(memeber_set))
5825
+
5826
+
5827
+
5828
+ class VoicePrintGroupListRequest(AbstractModel):
5829
+ r"""VoicePrintGroupList请求参数结构体
5830
+
5831
+ """
5832
+
5833
+
5834
+ class VoicePrintGroupListResponse(AbstractModel):
5835
+ r"""VoicePrintGroupList返回参数结构体
5836
+
5837
+ """
5838
+
5839
+ def __init__(self):
5840
+ r"""
5841
+ :param _Data: <p>返回分组名称列表数据</p>
5842
+ :type Data: :class:`tencentcloud.asr.v20190614.models.VoicePrintGroupList`
5843
+ :param _RequestId: 唯一请求 ID,由服务端生成,每次请求都会返回(若请求因其他原因未能抵达服务端,则该次请求不会获得 RequestId)。定位问题时需要提供该次请求的 RequestId。
5844
+ :type RequestId: str
5845
+ """
5846
+ self._Data = None
5847
+ self._RequestId = None
5848
+
5849
+ @property
5850
+ def Data(self):
5851
+ r"""<p>返回分组名称列表数据</p>
5852
+ :rtype: :class:`tencentcloud.asr.v20190614.models.VoicePrintGroupList`
5853
+ """
5854
+ return self._Data
5855
+
5856
+ @Data.setter
5857
+ def Data(self, Data):
5858
+ self._Data = Data
5859
+
5860
+ @property
5861
+ def RequestId(self):
5862
+ r"""唯一请求 ID,由服务端生成,每次请求都会返回(若请求因其他原因未能抵达服务端,则该次请求不会获得 RequestId)。定位问题时需要提供该次请求的 RequestId。
5863
+ :rtype: str
5864
+ """
5865
+ return self._RequestId
5866
+
5867
+ @RequestId.setter
5868
+ def RequestId(self, RequestId):
5869
+ self._RequestId = RequestId
5870
+
5871
+
5872
+ def _deserialize(self, params):
5873
+ if params.get("Data") is not None:
5874
+ self._Data = VoicePrintGroupList()
5875
+ self._Data._deserialize(params.get("Data"))
5876
+ self._RequestId = params.get("RequestId")
5877
+
5878
+
5777
5879
  class VoicePrintGroupVerifyRequest(AbstractModel):
5778
5880
  r"""VoicePrintGroupVerify请求参数结构体
5779
5881
 
@@ -1,6 +1,6 @@
1
1
  Metadata-Version: 2.1
2
2
  Name: tencentcloud-sdk-python-asr
3
- Version: 3.1.101
3
+ Version: 3.1.130
4
4
  Summary: Tencent Cloud Asr SDK for Python
5
5
  Home-page: https://github.com/TencentCloud/tencentcloud-sdk-python
6
6
  Author: Tencent Cloud
@@ -15,7 +15,7 @@ Classifier: Programming Language :: Python :: 2.7
15
15
  Classifier: Programming Language :: Python :: 3
16
16
  Classifier: Programming Language :: Python :: 3.6
17
17
  Classifier: Programming Language :: Python :: 3.7
18
- Requires-Dist: tencentcloud-sdk-python-common<4.0.0,>=3.1.101
18
+ Requires-Dist: tencentcloud-sdk-python-common<4.0.0,>=3.1.130
19
19
 
20
20
  ============================
21
21
  Tencent Cloud SDK for Python
@@ -0,0 +1 @@
1
+ tencentcloud-sdk-python-common<4.0.0,>=3.1.130
@@ -1 +0,0 @@
1
- tencentcloud-sdk-python-common<4.0.0,>=3.1.101