tdk-api-wrapper 1.2.2 → 1.3.1

This diff represents the content of publicly available package versions that have been released to one of the supported registries. The information contained in this diff is provided for informational purposes only and reflects changes between package versions as they appear in their respective public registries.
package/README.md CHANGED
@@ -35,6 +35,9 @@ tdk kural kısaltmalar
35
35
  tdk karsilastir kalem kağıt
36
36
  tdk analiz "Bu güzel kalem masanın üstünde duruyor"
37
37
  tdk oneri kale
38
+ tdk kubbealti merhaba
39
+ tdk nisanyan merhaba
40
+ tdk viki merhaba
38
41
  ```
39
42
 
40
43
  Herhangi bir komuta `--json` bayrağı eklendiğinde çıktı, insan-okunur metin yerine tek satırlık JSON olarak basılır (script/otomasyon kullanımı için):
@@ -90,6 +93,14 @@ Aşağıdaki metotlar `TDK` sınıfı üzerinden statik olarak erişilebilir dur
90
93
  - **`TDK.getKurallar()`**: TDK'nin `/icerik` akışının o an döndürdüğü yazım kuralı sayfa(lar)ını `{ adi, url }` şeklinde listeler. Not: bu sabit bir katalog değildir — `/icerik` her istekte, yaklaşık yirmi kurallık bir havuzdan rastgele tek bir kural döndürür.
91
94
  - **`TDK.getRule(name)`**: Adı verilen (küçük/büyük harf duyarsız, alt dize eşleşmesi) yazım kuralının tam metnini `tdk.gov.tr`'den çekip düz metne çevirir. `getKurallar()`'ın rastgeleliği yüzünden istenen kuralı bulana kadar eşzamanlı gruplar hâlinde (toplam en fazla 25 deneme, ~5 round-trip'e sığdırılmış) yeniden dener; bulamazsa veya sayfa ayrıştırılamazsa `null` döner.
92
95
 
96
+ ### 5. Diğer Sözlük Kaynakları
97
+
98
+ TDK dışındaki bu üç kaynak da her zaman kullanılabilir/dokümante edilmiş resmî API'ler değildir; her biri **fragile scraping** (kırılgan, dokümante edilmemiş entegrasyon) — kaynak taraflarında bir değişiklik olursa `null`/`[]` dönerler, hataya düşmezler. Verinin telif/kullanım koşulları kaynağa göre farklıdır: Wiktionary içeriği CC BY-SA lisanslıdır (açık); Nişanyan Sözlük ücretsiz, açık bir kişisel/akademik kaynaktır; **Kubbealtı Lugatı ise ticari bir sözlük ürünüdür** — bu kütüphane onu da dokümante edilmemiş bir uç noktadan çekebiliyor olsa da, kullanımınızı Kubbealtı'nın kendi kullanım şartlarına göre değerlendirmeniz önerilir.
99
+
100
+ - **`TDK.getKubbealti(word)`**: Kubbealtı Lugatı'nın ("Misalli Büyük Türkçe Sözlük") verilerini `{ kelime, anlam }` dizisi olarak döner (`anlam` zengin tipografi içeren ham HTML'dir). `getKubbealtiMeanings(word)` aynı veriyi düz metne çevirir. `getKubbealtiSuggestions(prefix)` Kubbealtı'nın kendi otomatik tamamlama uç noktasını kullanır (TDK'nin `getSuggestions()`'ından bağımsız, ayrı bir veri kaynağı). Kubbealtı başlıkları klasik Türkçe imlayla (ü/ö/ç/ğ/ş, düzeltme işareti) indekslidir; düz ASCII'ye yakın bir sorgu (örn. `ruzgar`) boş dönerse, kütüphane tek harflik Türkçeleştirme varyasyonlarını (`rüzgâr`, `rûzgar` vb.) otomatik dener. Not: Kubbealtı'nın veri sunucusu (`eski.lugatim.com`) sertifika zincirini eksik gönderiyor; bu kütüphane eksik ara sertifikaları ekleyerek zinciri düzgün doğruluyor (doğrulamayı kapatmıyor) — Let's Encrypt bu ara sertifikayı döndürürse bu entegrasyon `null` dönmeye başlar.
101
+ - **`TDK.getNisanyan(word)`**: Nişanyan Sözlük'ten kelimenin etimoloji paragrafını düz metin olarak döner; kelime bulunamazsa `null`.
102
+ - **`TDK.getWiktionary(word)`**: Türkçe Vikisözlük'ten (`tr.wiktionary.org`) resmî MediaWiki API'si (`action=query&prop=extracts`) üzerinden veri çeker — bu üçü arasında scraping olmayan, resmî ve en kararlı olanı. `{ raw, sections }` döner; `sections` metni `== Köken ==`, `=== Söyleniş ===` gibi başlıklara göre bir sözlüğe ayırır. `getWiktionarySection(word, sectionName)` tek bir bölümü (örn. `"Köken"`) büyük/küçük harf duyarsız süzer. Bu wiki'de başlık büyütme kapalı (`$wgCapitalLinks=false` — "Türkiye" ile bir küçük harfli kelime ayrı sayfalardır), o yüzden `TDK.getWiktionary("türkiye")` gibi tam eşleşmeyen aramalar otomatik olarak ilk harfi (Türkçe kurallarına göre, örn. `istanbul` → `İstanbul`) büyütülmüş hâliyle tekrar denenir.
103
+
93
104
  ## Hata Yönetimi
94
105
 
95
106
  Kütüphane, ayırt edilebilir hata sınıfları fırlatır (hepsi `Error`'dan türer):
@@ -30,9 +30,87 @@ import * as fs from "fs";
30
30
  import * as path from "path";
31
31
  import * as os from "os";
32
32
  import * as https from "https";
33
+ import * as tls from "tls";
33
34
  var TDK = class {
34
35
  static BASE_URL = "https://sozluk.gov.tr";
35
36
  static AUDIO_API_HOST = "api.sozluk.gov.tr";
37
+ static KUBBEALTI_HOST = "eski.lugatim.com";
38
+ /**
39
+ * `eski.lugatim.com` (Kubbealtı Lugatı's data API) sends only its leaf
40
+ * certificate during the TLS handshake, omitting the intermediates a
41
+ * correctly configured server would include — a server-side misconfiguration,
42
+ * not something we should paper over by disabling verification. These are
43
+ * the two certificates the server *should* be sending (fetched from the
44
+ * leaf's own Authority Information Access URLs), supplied here so Node can
45
+ * still build a full, properly verified chain up to a root it already
46
+ * trusts (ISRG Root X1). If Let's Encrypt rotates this intermediate, this
47
+ * stops working and every Kubbealtı call fails closed to `null` — same
48
+ * fail-closed contract as the rest of this file's fragile integrations.
49
+ */
50
+ static KUBBEALTI_EXTRA_CA = [
51
+ `-----BEGIN CERTIFICATE-----
52
+ MIIE2jCCAsKgAwIBAgIQTr0klH4k05SALYSlL9WzGTANBgkqhkiG9w0BAQsFADAu
53
+ MQswCQYDVQQGEwJVUzENMAsGA1UEChMESVNSRzEQMA4GA1UEAxMHUm9vdCBZUjAe
54
+ Fw0yNTA5MDMwMDAwMDBaFw0yODA5MDIyMzU5NTlaMDMxCzAJBgNVBAYTAlVTMRYw
55
+ FAYDVQQKEw1MZXQncyBFbmNyeXB0MQwwCgYDVQQDEwNZUjIwggEiMA0GCSqGSIb3
56
+ DQEBAQUAA4IBDwAwggEKAoIBAQDZ0LxwBppqh84luqMerV/eeL/fXQ7mLQQv1Lnp
57
+ WKZbyvGpx6wh6AfnslAnF6ewTkcHA+gSOoBvm3Dfm06AuGiF+KRut4fAcowqnAQQ
58
+ CW98+QPP/eOv/wug7Iyk4NkOxf2I6g2f55T6nJoOTLFcukeRq80JGQEYan+dPFr9
59
+ OGUgQK2hGKgNkW87pappsOAuUJcroYhRt5uUis4qaZireiseu32gzDJNBAiKtsvd
60
+ 6HX4v25bpkRNcS/B/Gtc9kVbUpD+2PLPxdei3Tim55k4tfAEXwD2qyiPTxrTNq6l
61
+ N+AMr5g2c1dNqkOTwjxeV6L5lpP1rGiYvLnRaPlOqyZRPW+5AgMBAAGjge4wgesw
62
+ DgYDVR0PAQH/BAQDAgGGMBMGA1UdJQQMMAoGCCsGAQUFBwMBMBIGA1UdEwEB/wQI
63
+ MAYBAf8CAQAwHQYDVR0OBBYEFEAVLSZ57TIgnt+ach3WMh+BDIEMMB8GA1UdIwQY
64
+ MBaAFN7nW2DQIm1AKH0/DQH+pLVStFGUMDIGCCsGAQUFBwEBBCYwJDAiBggrBgEF
65
+ BQcwAoYWaHR0cDovL3lyLmkubGVuY3Iub3JnLzATBgNVHSAEDDAKMAgGBmeBDAEC
66
+ ATAnBgNVHR8EIDAeMBygGqAYhhZodHRwOi8veXIuYy5sZW5jci5vcmcvMA0GCSqG
67
+ SIb3DQEBCwUAA4ICAQB0ZUQWZ9/Yn9COEpo+JfecMnB0h0vwDm/M66IqXqw3LoaL
68
+ mx9lZvRTeDIS67PUeI3yCA2W6PKRD0/FE/G57lOmS+Xy5AaaL00ICGOqjNcCaMWW
69
+ 8o8nevHOd4i4lqgtznE/28QwlcdJyF8yBiWHpnyjhEpmNWJURgOCOg2xpwRMBCsj
70
+ MScqYPtOhBeuYQvSwAEeTML2Ukh6uGuX4E14q65Ja8cdjF5bAldnP1eE4FBaAwsZ
71
+ G2fOqqrKV03Y85Nw2btedP1AtliQuJZs/Jo/gXxXdc7LrH3McgnpnbTiAncX7yES
72
+ hP6kzQejllqMCIt52HOjxDGWafS7Xw+DKwqmH+Eqy8dcbOuag/1AYlQoKNVK3F5q
73
+ Hh6tEDiMqQcLIibGKteE6iHo4A/bIScbzrhXUYuism42ZYzmc48FMVIH3qy4L84E
74
+ TdAH2gtxw0PAhvRVXp8HP7wfngpzsN/8xOTpeRSbM4+Qbc56G6+Bifmv6sk1ieQb
75
+ NA3wJdl4DDUuQSV8hBgx6zoI1ZSGORprDFux7c6rhc77QZMSRrEgomBeklervEve
76
+ 86ylWmZ3WWHV6RLMi8xNvjd71r4EPIGgY7BZU/VPBkq+uA7Gb6mbJnFgV43uh3xy
77
+ LRFgxIAphIukwTGSMZZR+AI+Qnp0BYTWovHXozOf3H8r6hozEoT02JHn0AeTfA==
78
+ -----END CERTIFICATE-----`,
79
+ `-----BEGIN CERTIFICATE-----
80
+ MIIF9DCCA9ygAwIBAgIRAPJLbRf52a18scn+p4eCaZ8wDQYJKoZIhvcNAQELBQAw
81
+ TzELMAkGA1UEBhMCVVMxKTAnBgNVBAoTIEludGVybmV0IFNlY3VyaXR5IFJlc2Vh
82
+ cmNoIEdyb3VwMRUwEwYDVQQDEwxJU1JHIFJvb3QgWDEwHhcNMjYwNTEzMDAwMDAw
83
+ WhcNMzIwOTAyMjM1OTU5WjAuMQswCQYDVQQGEwJVUzENMAsGA1UEChMESVNSRzEQ
84
+ MA4GA1UEAxMHUm9vdCBZUjCCAiIwDQYJKoZIhvcNAQEBBQADggIPADCCAgoCggIB
85
+ ANvGJnN78CTJdWL3+eGfsLN5TrNBJs+VH9hRXqRbwxu9sGNiB0BD1fcOxbSUQCJI
86
+ M1xE13Db+5Cw1w0s0EBYsvuIP/6joF0w8cuImbgR1OGgYbSQ4OpzI+DG8SGuTlcE
87
+ 873OCS+kh3srlo6vl43M5OJg4Aeo1sfHp6kTJDoIiFBNJAY+OKfX/FUvYKuhjT+n
88
+ o49lmqmupSBI5PkBQiqrEGtWU5uxU/cQWHGu8jSjFBznZqvbNPLMXMLFxCb3WTfr
89
+ JBXXjqvWG+v4bjzxjjeAtOlU7qarRDvNOyAuQYLln904M+faKx8hnLCpJ15ZqaEg
90
+ cNlY+9MMWcC5yvL2A2j3l9+2buggZX+dOE91zYmIdawTvSZuVvlbRrAlLxIB6pwM
91
+ BjneXCjYQ8+3BCCjssbSNpZU3hTcBDdhfAlEDlYr6pEatnMdmDT5BqnKC92bd0Eh
92
+ M1fbLHioLccLCuievT8ZkPhZrq7Mii7gNXAcUEAR8+lzYal+9zTg7C5DALyVOeG/
93
+ CqfRAMn1KSHCR0NSA6P8tn/mGRlnCct5rtVCLnVySVpU6H1qGg3DgTOuskf8eahT
94
+ MiYbI5ezPJmO5ertalskQ1utp74+eDy92PI4ftHKTbq9IWhH4YZKh3WnJEIt+oQv
95
+ lYZbY8tpEroKrFB6PFGzrJIDRyts4HqvuH52RFj2zv/BAgMBAAGjgeswgegwDgYD
96
+ VR0PAQH/BAQDAgEGMBMGA1UdJQQMMAoGCCsGAQUFBwMBMA8GA1UdEwEB/wQFMAMB
97
+ Af8wHQYDVR0OBBYEFN7nW2DQIm1AKH0/DQH+pLVStFGUMB8GA1UdIwQYMBaAFHm0
98
+ WeZ7tuXkAXOACIjIGlj26ZtuMDIGCCsGAQUFBwEBBCYwJDAiBggrBgEFBQcwAoYW
99
+ aHR0cDovL3gxLmkubGVuY3Iub3JnLzATBgNVHSAEDDAKMAgGBmeBDAECATAnBgNV
100
+ HR8EIDAeMBygGqAYhhZodHRwOi8veDEuYy5sZW5jci5vcmcvMA0GCSqGSIb3DQEB
101
+ CwUAA4ICAQA8spSI95KKfn2W6GMmDpHBJSPaLbsS3W93cijJCRCYAc1fsJgL1FIL
102
+ 7C0C9ecPOdcwB2fi0Dk2p94j9iTJCxmt5CFSKLRWwnXT2MMSXexVxqoVB79BdWPx
103
+ VXETkVme/qYSAuKVHh5Ps+5BixgmwS1JkjSAc+MfrUbNssVEEnH0aEiAh+rotXAV
104
+ JSP/Ye7LJPEwD9DWG72vVWbhAcuOf5OLjz57Ctk7MgQHynZ7+PlHJtajroCaIbtC
105
+ r6tcZZaAwUQm+jQyeWdV+2hv9deOYFmKeQyjjcSrN5Nadrw+L9DZJLbA1HqeNvLh
106
+ BgqpP0fvJq2N6EtD574N6eMI7uMsJTnji2UDz9el5XLSv9fqJMuDQtYVb2oTNoKp
107
+ oUqhxPVC0aq4eG5MESaIdn8b5ZGSSeAJLMHXljEdlNza+ncfkviXk1POLnnFdvx8
108
+ /gk6M374WbLWFXw8N141B/Rl/tINGfl1TxOIiqtiMYkL02RSGb1kq34BL9NPP27z
109
+ RGMuHGnzS3hFIrRTfKxrzUZ9RzQWzEG3K6fJ3r2nqSltkeytis9DIBoFY9VmVyjL
110
+ M71DMi+y1+TRSJVClEMwvA4yL++7q9XZx5r5wBRWB4kQTKH5qyoZnDw7iiuh1lID
111
+ yDFx8r7i9vIJU5HS3moZLkYWAOilMaV9N56A9Bgb6dNcHkvg3NoaYA==
112
+ -----END CERTIFICATE-----`
113
+ ];
36
114
  // Cache Mechanism
37
115
  static isCacheEnabled = false;
38
116
  static wordCache = /* @__PURE__ */ new Map();
@@ -542,7 +620,222 @@ var TDK = class {
542
620
  }
543
621
  }
544
622
  static htmlToPlainText(html) {
545
- return html.replace(/<br\s*\/?>/gi, "\n").replace(/<\/(p|div)>/gi, "\n\n").replace(/<[^>]+>/g, "").replace(/&nbsp;/gi, " ").replace(/&amp;/gi, "&").replace(/&quot;/gi, '"').replace(/&#39;|&rsquo;/gi, "'").replace(/[ \t]+/g, " ").replace(/[ \t]*\n[ \t]*/g, "\n").replace(/\n{3,}/g, "\n\n").trim();
623
+ return html.replace(/<br\s*\/?>/gi, "\n").replace(/<\/(p|div)>/gi, "\n\n").replace(/<[^>]+>/g, "").replace(/&nbsp;/gi, " ").replace(/&lt;/gi, "<").replace(/&gt;/gi, ">").replace(/&quot;/gi, '"').replace(/&#39;|&rsquo;/gi, "'").replace(/&amp;/gi, "&").replace(/[ \t]+/g, " ").replace(/[ \t]*\n[ \t]*/g, "\n").replace(/\n{3,}/g, "\n\n").trim();
624
+ }
625
+ /**
626
+ * GETs a JSON path from Kubbealtı Lugatı's data API (`eski.lugatim.com`),
627
+ * supplying `KUBBEALTI_EXTRA_CA` to work around that host's incomplete
628
+ * certificate chain (see the constant's doc comment). Fails closed to
629
+ * `null` on any error — network, TLS, HTTP, or JSON parse.
630
+ */
631
+ static fetchKubbealtiJson(path2) {
632
+ return new Promise((resolve) => {
633
+ const req = https.request(
634
+ {
635
+ hostname: this.KUBBEALTI_HOST,
636
+ path: path2,
637
+ method: "GET",
638
+ ca: [...tls.rootCertificates, ...this.KUBBEALTI_EXTRA_CA],
639
+ headers: {
640
+ "User-Agent": "Mozilla/5.0 (Windows NT 10.0; Win64; x64) AppleWebKit/537.36 (KHTML, like Gecko) Chrome/128.0.0.0 Safari/537.36"
641
+ }
642
+ },
643
+ (res) => {
644
+ if (res.statusCode !== 200) {
645
+ res.resume();
646
+ resolve(null);
647
+ return;
648
+ }
649
+ let body = "";
650
+ res.on("data", (chunk) => body += chunk);
651
+ res.on("end", () => {
652
+ try {
653
+ resolve(JSON.parse(body));
654
+ } catch {
655
+ resolve(null);
656
+ }
657
+ });
658
+ }
659
+ );
660
+ req.on("error", () => resolve(null));
661
+ req.end();
662
+ });
663
+ }
664
+ /**
665
+ * Kubbealtı indexes headwords with full classical Turkish orthography,
666
+ * including letters that a plain-ASCII-ish query tends to drop — most
667
+ * commonly ü/ö/ç/ğ/ş, but also the circumflex ("düzeltme işareti") used in
668
+ * Arabic/Persian loanwords like "rüzgâr". A search for "ruzgar" misses
669
+ * entirely (verified: even "ruzgâr" alone still misses — it's the missing
670
+ * ü, not the missing â, that actually breaks the match). This generates
671
+ * single-letter-substitution variants to retry, one substitution per
672
+ * variant (not combinatorial) — covers the overwhelmingly common case of
673
+ * one "de-Turkished" letter without an explosion of API calls for words
674
+ * with several.
675
+ */
676
+ static TURKISH_DEASCII_MAP = {
677
+ a: ["\xE2"],
678
+ i: ["\u0131", "\xEE"],
679
+ o: ["\xF6"],
680
+ u: ["\xFC", "\xFB"],
681
+ c: ["\xE7"],
682
+ g: ["\u011F"],
683
+ s: ["\u015F"]
684
+ };
685
+ static generateTurkishVariants(word) {
686
+ const lower = word.trim().toLocaleLowerCase("tr-TR");
687
+ const variants = [];
688
+ for (let i = 0; i < lower.length; i++) {
689
+ for (const replacement of this.TURKISH_DEASCII_MAP[lower[i]] ?? []) {
690
+ variants.push(lower.slice(0, i) + replacement + lower.slice(i + 1));
691
+ }
692
+ }
693
+ return variants;
694
+ }
695
+ /**
696
+ * Returns Kubbealtı Lugatı ("Misalli Büyük Türkçe Sözlük") entries for a
697
+ * word, scraped from the site's own data API — undocumented, and Kubbealtı
698
+ * Lugatı is a commercial dictionary product, unlike TDK's or Wiktionary's
699
+ * openly-published data, so use this in line with their terms. `anlam` is
700
+ * raw HTML (rich typography markup); use `getKubbealtiMeanings()` for
701
+ * plain text. Falls back to `generateTurkishVariants()` if the exact query
702
+ * comes up empty (see its doc comment). Returns `null` on any fetch/parse
703
+ * failure, `[]` if no variant matches either.
704
+ */
705
+ static async getKubbealti(word) {
706
+ if (!word || word.trim() === "")
707
+ return null;
708
+ const data = await this.fetchKubbealtiJson(`/rest/s/${encodeURIComponent(word.trim())}/`);
709
+ if (!data || !Array.isArray(data.content))
710
+ return null;
711
+ if (data.content.length > 0) {
712
+ return data.content.map((entry) => ({ kelime: entry.kelime, anlam: entry.anlam }));
713
+ }
714
+ for (const variant of this.generateTurkishVariants(word)) {
715
+ const variantData = await this.fetchKubbealtiJson(`/rest/s/${encodeURIComponent(variant)}/`);
716
+ if (variantData && Array.isArray(variantData.content) && variantData.content.length > 0) {
717
+ return variantData.content.map((entry) => ({ kelime: entry.kelime, anlam: entry.anlam }));
718
+ }
719
+ }
720
+ return [];
721
+ }
722
+ /**
723
+ * Same as `getKubbealti()` but with each entry's `anlam` HTML stripped to
724
+ * plain text via `htmlToPlainText()`.
725
+ */
726
+ static async getKubbealtiMeanings(word) {
727
+ const entries = await this.getKubbealti(word);
728
+ if (!entries)
729
+ return null;
730
+ return entries.map((e) => this.htmlToPlainText(e.anlam));
731
+ }
732
+ /**
733
+ * Autocomplete suggestions from Kubbealtı Lugatı's own typeahead endpoint
734
+ * (separate from `getSuggestions()`, which uses TDK's data).
735
+ */
736
+ static async getKubbealtiSuggestions(prefix) {
737
+ if (!prefix || prefix.trim() === "")
738
+ return [];
739
+ const data = await this.fetchKubbealtiJson(`/rest/word-search/${encodeURIComponent(prefix.trim())}`);
740
+ if (!Array.isArray(data))
741
+ return [];
742
+ return data.map((item) => item.display).filter(Boolean);
743
+ }
744
+ /**
745
+ * Returns the etymology paragraph for a word from Nişanyan Sözlük, scraped
746
+ * from that page's server-rendered `<meta name="description">` tag (the
747
+ * page already puts the full etymology text there for SEO, so no need to
748
+ * parse the site's internal SvelteKit data format). Returns `null` if the
749
+ * word isn't found (the page falls back to a generic site tagline in that
750
+ * case) or the request fails.
751
+ */
752
+ static async getNisanyan(word) {
753
+ if (!word || word.trim() === "")
754
+ return null;
755
+ try {
756
+ const response = await fetch(
757
+ `https://www.nisanyansozluk.com/kelime/${encodeURIComponent(word.trim().toLocaleLowerCase("tr-TR"))}`,
758
+ { headers: { "User-Agent": "TDK-API-Nodejs-Wrapper/1.0" } }
759
+ );
760
+ if (!response.ok)
761
+ return null;
762
+ const html = await response.text();
763
+ const match = html.match(/<meta name="description" content="([^"]*)"/);
764
+ if (!match)
765
+ return null;
766
+ const description = this.htmlToPlainText(match[1]);
767
+ if (description === "\xC7a\u011Fda\u015F T\xFCrk\xE7enin Etimolojisi")
768
+ return null;
769
+ return description;
770
+ } catch {
771
+ return null;
772
+ }
773
+ }
774
+ static async fetchWiktionaryEntry(title) {
775
+ try {
776
+ const url = `https://tr.wiktionary.org/w/api.php?action=query&prop=extracts&titles=${encodeURIComponent(
777
+ title
778
+ )}&format=json&explaintext=1&formatversion=2`;
779
+ const response = await fetch(url, { headers: { "User-Agent": "TDK-API-Nodejs-Wrapper/1.0" } });
780
+ if (!response.ok)
781
+ return null;
782
+ const data = await response.json();
783
+ const page = data?.query?.pages?.[0];
784
+ if (!page || page.missing || !page.extract)
785
+ return null;
786
+ const raw = page.extract;
787
+ const sections = {};
788
+ const parts = raw.split(/\n(={2,4})\s*(.+?)\s*\1\n/);
789
+ for (let i = 1; i < parts.length; i += 3) {
790
+ const title2 = parts[i + 1]?.trim();
791
+ const content = parts[i + 2]?.trim();
792
+ if (title2)
793
+ sections[title2] = content ?? "";
794
+ }
795
+ return { raw, sections };
796
+ } catch {
797
+ return null;
798
+ }
799
+ }
800
+ /**
801
+ * Returns the Turkish Wiktionary (`tr.wiktionary.org`) entry for a word,
802
+ * via MediaWiki's official Action API (`action=query&prop=extracts`) — no
803
+ * scraping involved, this is a stable, documented public API. `sections`
804
+ * splits the plain-text extract on its `== Heading ==`/`=== Heading ===`
805
+ * markers (e.g. "Köken", "Söyleniş", "Ad") for convenience; `raw` has the
806
+ * unsplit text. This wiki has title capitalization turned off
807
+ * ($wgCapitalLinks=false — common for Wiktionaries, since case is
808
+ * meaningful for a dictionary: "Türkiye" the country vs. a lowercase
809
+ * common word), so an exact-case miss retries with the first letter
810
+ * uppercased (Turkish-locale-aware, so "istanbul" tries "İstanbul", not
811
+ * "Istanbul") before giving up. Returns `null` if neither is found or the
812
+ * request fails.
813
+ */
814
+ static async getWiktionary(word) {
815
+ if (!word || word.trim() === "")
816
+ return null;
817
+ const trimmed = word.trim();
818
+ const direct = await this.fetchWiktionaryEntry(trimmed);
819
+ if (direct)
820
+ return direct;
821
+ const capitalized = trimmed.charAt(0).toLocaleUpperCase("tr-TR") + trimmed.slice(1);
822
+ if (capitalized === trimmed)
823
+ return null;
824
+ return this.fetchWiktionaryEntry(capitalized);
825
+ }
826
+ /**
827
+ * Convenience filter over `getWiktionary()`: returns just one section's
828
+ * text (e.g. `getWiktionarySection(word, "Köken")` for etymology), matched
829
+ * case-insensitively. Returns `null` if the word or the section isn't found.
830
+ */
831
+ static async getWiktionarySection(word, sectionName) {
832
+ const entry = await this.getWiktionary(word);
833
+ if (!entry)
834
+ return null;
835
+ const key = Object.keys(entry.sections).find(
836
+ (k) => k.toLocaleLowerCase("tr-TR") === sectionName.trim().toLocaleLowerCase("tr-TR")
837
+ );
838
+ return key ? entry.sections[key] : null;
546
839
  }
547
840
  /**
548
841
  * Returns compound words that contain this word.