tencentcloud-sdk-nodejs-trtc 4.1.300 → 4.1.301

This diff represents the content of publicly available package versions that have been released to one of the supported registries. The information contained in this diff is provided for informational purposes only and reflects changes between package versions as they appear in their respective public registries.
package/package.json CHANGED
@@ -1,6 +1,6 @@
1
1
  {
2
2
  "name": "tencentcloud-sdk-nodejs-trtc",
3
- "version": "4.1.300",
3
+ "version": "4.1.301",
4
4
  "description": "腾讯云 API NODEJS SDK",
5
5
  "main": "./tencentcloud/index.js",
6
6
  "module": "./es/index.js",
@@ -49,7 +49,6 @@
49
49
  "@types/json-bigint": "^1.0.1",
50
50
  "@types/node": "^18.0.0",
51
51
  "@types/node-fetch": "^2.5.7",
52
- "@types/uuid": "^9.0.8",
53
52
  "@typescript-eslint/eslint-plugin": "^2.34.0",
54
53
  "@typescript-eslint/parser": "^2.34.0",
55
54
  "babel-eslint": "^10.0.2",
@@ -483,75 +483,27 @@ export interface StartAIConversationResponse {
483
483
  */
484
484
  export interface STTConfig {
485
485
  /**
486
- *
487
- 语音转文字支持识别的语言,默认是"zh" 中文
488
-
489
- 可通过购买「AI智能识别时长包」解锁或领取包月套餐体验版解锁不同语言. 详细说明参考:[AI智能识别计费说明](https://cloud.tencent.com/document/product/647/111976)
490
-
491
- 语音转文本不同套餐版本支持的语言如下:
492
-
493
- **基础语言引擎**:
494
- - "zh": 中文(简体)
495
- - "zh-TW": 中文(繁体)
496
- - "en": 英语
497
- - "16k_zh_edu":中文教育
498
- - "16k_zh_medical":中文医疗
499
- - "16k_zh_court":中文法庭
500
-
501
- **标准语言引擎:**
502
- - "8k_zh_large": 普方大模型引擎. 当前模型同时支持中文等语言的识别,模型参数量极大,语言模型性能增强,针对电话音频中各类场景、各类中文方言的识别准确率极大提升.
503
- - "16k_zh_large": 普方英大模型引擎. 当前模型同时支持中文、英文、多种中文方言等语言的识别,模型参数量极大,语言模型性能增强,针对噪声大、回音大、人声小、人声远等低质量音频的识别准确率极大提升.
504
- - "16k_multi_lang": 多语种大模型引擎. 当前模型同时支持英语、日语、韩语、阿拉伯语、菲律宾语、法语、印地语、印尼语、马来语、葡萄牙语、西班牙语、泰语、土耳其语、越南语、德语的识别,可实现15个语种的自动识别(句子/段落级别).
505
- - "16k_zh_en": 中英大模型引擎. 当前模型同时支持中文、英语识别,模型参数量极大,语言模型性能增强,针对噪声大、回音大、人声小、人声远等低质量音频的识别准确率极大提升.
506
-
507
- **高级语言引擎:**
508
- - "zh-dialect": 中国方言
509
- - "zh-yue": 中国粤语
510
- - "vi": 越南语
511
- - "ja": 日语
512
- - "ko": 韩语
513
- - "id": 印度尼西亚语
514
- - "th": 泰语
515
- - "pt": 葡萄牙语
516
- - "tr": 土耳其语
517
- - "ar": 阿拉伯语
518
- - "es": 西班牙语
519
- - "hi": 印地语
520
- - "fr": 法语
521
- - "ms": 马来语
522
- - "fil": 菲律宾语
523
- - "de": 德语
524
- - "it": 意大利语
525
- - "ru": 俄语
526
- - "sv": 瑞典语
527
- - "da": 丹麦语
528
- - "no": 挪威语
529
-
530
- **注意:**
531
- 如果缺少满足您需求的语言,请联系我们技术人员。
486
+ * <p>语音转文字支持识别的语言,默认是&quot;zh&quot; 中文</p><p>可通过购买「AI智能识别时长包」解锁或领取包月套餐体验版解锁不同语言. 详细说明参考:<a href="https://cloud.tencent.com/document/product/647/111976">AI智能识别计费说明</a></p><p>语音转文本不同套餐版本支持的语言如下:</p><p><strong>基础语言引擎</strong>:</p><ul><li> "zh": 中文(简体)</li><li>"zh-TW": 中文(繁体)</li><li>"en": 英语</li><li>"16k_zh_edu":中文教育</li><li>"16k_zh_medical":中文医疗</li><li>"16k_zh_court":中文法庭</li></ul><p><strong>标准语言引擎:</strong></p><ul><li> "8k_zh_large": 普方大模型引擎. 当前模型同时支持中文等语言的识别,模型参数量极大,语言模型性能增强,针对电话音频中各类场景、各类中文方言的识别准确率极大提升.</li><li> "16k_zh_large": 普方英大模型引擎. 当前模型同时支持中文、英文、多种中文方言等语言的识别,模型参数量极大,语言模型性能增强,针对噪声大、回音大、人声小、人声远等低质量音频的识别准确率极大提升.</li><li> "16k_multi_lang": 多语种大模型引擎. 当前模型同时支持英语、日语、韩语、阿拉伯语、菲律宾语、法语、印地语、印尼语、马来语、葡萄牙语、西班牙语、泰语、土耳其语、越南语、德语的识别,可实现15个语种的自动识别(句子/段落级别).</li><li> "16k_zh_en": 中英大模型引擎. 当前模型同时支持中文、英语识别,模型参数量极大,语言模型性能增强,针对噪声大、回音大、人声小、人声远等低质量音频的识别准确率极大提升.</li></ul><p><strong>高级语言引擎:</strong></p><ul><li>"zh-dialect": 中国方言</li><li>"zh-yue": 中国粤语</li><li>"vi": 越南语</li><li>"ja": 日语</li><li>"ko": 韩语</li><li>"id": 印度尼西亚语</li><li>"th": 泰语</li><li>"pt": 葡萄牙语</li><li>"tr": 土耳其语</li><li>"ar": 阿拉伯语</li><li>"es": 西班牙语</li><li>"hi": 印地语</li><li>"fr": 法语</li><li>"ms": 马来语</li><li>"fil": 菲律宾语</li><li>"de": 德语</li><li>"it": 意大利语</li><li>"ru": 俄语</li><li>"sv": 瑞典语</li><li>"da": 丹麦语</li><li>"no": 挪威语</li><li>"pl": 波兰语</li><li>"uz": 乌兹别克语</li><li>"hu": 匈牙利语</li><li>"he": 希伯来语</li><li>"ur": 乌尔都语</li><li>"af-ZA": 南非荷兰语</li><li>"nl-BE": 比利时荷兰语</li><li>"nl-NL": 荷兰语(本土)</li></ul><p><strong>bigmodel全新大模型语音识别引擎</strong></p><ul><li>"bigmodel_auto": 多语言自动识别</li><li>"bigmodel_zh": 中文</li><li>"bigmodel_en": 英语</li><li>"bigmodel_yue": 粤语</li><li>"bigmodel_ar": 阿拉伯语</li><li>"bigmodel_de": 德语</li><li>"bigmodel_fr": 法语</li><li>"bigmodel_es": 西班牙</li><li>"bigmodel_pt": 葡萄牙语</li><li>"bigmodel_id": 印尼语</li><li>"bigmodel_it": 意大利语</li><li>"bigmodel_ko": 韩语</li><li>"bigmodel_ru": 俄语</li><li>"bigmodel_th": 泰语</li><li>"bigmodel_vi": 越南语</li><li>"bigmodel_tr": 土耳其语</li><li>"bigmodel_hi": 印地语</li><li>"bigmodel_ms": 马来语</li><li>"bigmodel_pl": 波兰语</li><li>"bigmodel_cs": 捷克语</li><li>"bigmodel_fil": 菲律宾语</li><li>"bigmodel_fa": 波斯语</li><li>"bigmodel_el": 希腊语</li><li>"bigmodel_ro": 罗马尼亚语</li><li>"bigmodel_hu": 匈牙利语</li><li>"bigmodel_mk": 马其顿语</li></ul><p><strong>注意:</strong><br>如果缺少满足您需求的语言,请联系我们技术人员。</p>
532
487
  */
533
488
  Language?: string;
534
489
  /**
535
- * **发起模糊识别为高级版能力,默认按照高级版收费**
536
- 注意:不支持填写"zh-dialect", "16k_zh_edu", "16k_zh_medical", "16k_zh_court", "8k_zh_large", "16k_zh_large","16k_multi_lang", "16k_zh_en"
537
-
490
+ * <p><strong>发起模糊识别为高级版能力,默认按照高级版收费</strong><br>注意:不支持填写&quot;zh-dialect&quot;, &quot;16k_zh_edu&quot;, &quot;16k_zh_medical&quot;, &quot;16k_zh_court&quot;, &quot;8k_zh_large&quot;, &quot;16k_zh_large&quot;,&quot;16k_multi_lang&quot;, &quot;16k_zh_en&quot;</p>
538
491
  */
539
492
  AlternativeLanguage?: Array<string>;
540
493
  /**
541
- * 自定义参数,联系后台使用
542
-
494
+ * <p>自定义参数,联系后台使用</p>
543
495
  */
544
496
  CustomParam?: string;
545
497
  /**
546
- * 语音识别vad的时间,范围为240-2000,默认为1000,单位为ms。更小的值会让语音识别分句更快。
498
+ * <p>语音识别vad的时间,范围为240-2000,默认为1000,单位为ms。更小的值会让语音识别分句更快。</p>
547
499
  */
548
500
  VadSilenceTime?: number;
549
501
  /**
550
- * 热词表:该参数用于提升识别准确率。 单个热词限制:"热词|权重",单个热词不超过30个字符(最多10个汉字),权重[1-11]或者100,如:“腾讯云|5” 或 “ASR|11”; 热词表限制:多个热词用英文逗号分割,最多支持128个热词,如:“腾讯云|10,语音识别|5,ASR|11”;
502
+ * <p>热词表:该参数用于提升识别准确率。 单个热词限制:&quot;热词|权重&quot;,单个热词不超过30个字符(最多10个汉字),权重[1-11]或者100,如:“腾讯云|5” 或 “ASR|11”; 热词表限制:多个热词用英文逗号分割,最多支持128个热词,如:“腾讯云|10,语音识别|5,ASR|11”;</p>
551
503
  */
552
504
  HotWordList?: string;
553
505
  /**
554
- * vad的远场人声抑制能力(不会对asr识别效果造成影响),范围为[0, 5],默认为0,表示不开启远场人声抑制能力。推荐设置为2,有较好的远场人声抑制能力。嘈杂的办公室环境下可以设置为3,更为嘈杂的环境下可以使用4和5。注意较高的VadLevel可能会将单字当作噪声给过滤。
506
+ * <p>vad的远场人声抑制能力(不会对asr识别效果造成影响),范围为[0, 5],默认为0,表示不开启远场人声抑制能力。推荐设置为2,有较好的远场人声抑制能力。嘈杂的办公室环境下可以设置为3,更为嘈杂的环境下可以使用4和5。注意较高的VadLevel可能会将单字当作噪声给过滤。</p>
555
507
  */
556
508
  VadLevel?: number;
557
509
  }