tokenbee-sdk 1.3.0__tar.gz → 2.0.0__tar.gz

This diff represents the content of publicly available package versions that have been released to one of the supported registries. The information contained in this diff is provided for informational purposes only and reflects changes between package versions as they appear in their respective public registries.
@@ -1,6 +1,6 @@
1
1
  Metadata-Version: 2.4
2
2
  Name: tokenbee-sdk
3
- Version: 1.3.0
3
+ Version: 2.0.0
4
4
  Summary: Official Python SDK for TokenBee LLM inference gateway and observability.
5
5
  Author: TokenBee Inc.
6
6
  Author-email: "TokenBee Inc." <founders@tokenbee.io>
@@ -54,7 +54,7 @@ client = TokenBee(
54
54
 
55
55
  # Send a request
56
56
  response = client.send(
57
- model=TokenBeeModel.OPENAI_GPT_4O,
57
+ model=TokenBeeModel.ANTHROPIC_CLAUDE_SONNET_4,
58
58
  input={
59
59
  "messages": [
60
60
  {"role": "user", "content": "Explain quantum entanglement in simple terms."}
@@ -77,7 +77,7 @@ You can specify the compression rate and method per request. TokenBee uses an in
77
77
 
78
78
  ```python
79
79
  response = client.send(
80
- model=TokenBeeModel.ANTHROPIC_CLAUDE_3_5_SONNET,
80
+ model=TokenBeeModel.ANTHROPIC_CLAUDE_SONNET_4,
81
81
  input={
82
82
  "messages": [...],
83
83
  "compression": "auto", # "auto" (default), "on", or "off"
@@ -97,9 +97,9 @@ response = client.send(
97
97
 
98
98
  The SDK provides a `TokenBeeModel` enum with popular models:
99
99
 
100
- - `TokenBeeModel.OPENAI_GPT_4O`
101
- - `TokenBeeModel.ANTHROPIC_CLAUDE_3_5_SONNET`
102
- - `TokenBeeModel.GEMINI_2_0_FLASH`
100
+ - `TokenBeeModel.ANTHROPIC_CLAUDE_SONNET_4`
101
+ - `TokenBeeModel.OPENAI_GPT_5_MINI`
102
+ - `TokenBeeModel.GROQ_GPT_OSS_20B`
103
103
  - ... and many others.
104
104
 
105
105
  ## License
@@ -36,7 +36,7 @@ client = TokenBee(
36
36
 
37
37
  # Send a request
38
38
  response = client.send(
39
- model=TokenBeeModel.OPENAI_GPT_4O,
39
+ model=TokenBeeModel.ANTHROPIC_CLAUDE_SONNET_4,
40
40
  input={
41
41
  "messages": [
42
42
  {"role": "user", "content": "Explain quantum entanglement in simple terms."}
@@ -59,7 +59,7 @@ You can specify the compression rate and method per request. TokenBee uses an in
59
59
 
60
60
  ```python
61
61
  response = client.send(
62
- model=TokenBeeModel.ANTHROPIC_CLAUDE_3_5_SONNET,
62
+ model=TokenBeeModel.ANTHROPIC_CLAUDE_SONNET_4,
63
63
  input={
64
64
  "messages": [...],
65
65
  "compression": "auto", # "auto" (default), "on", or "off"
@@ -79,9 +79,9 @@ response = client.send(
79
79
 
80
80
  The SDK provides a `TokenBeeModel` enum with popular models:
81
81
 
82
- - `TokenBeeModel.OPENAI_GPT_4O`
83
- - `TokenBeeModel.ANTHROPIC_CLAUDE_3_5_SONNET`
84
- - `TokenBeeModel.GEMINI_2_0_FLASH`
82
+ - `TokenBeeModel.ANTHROPIC_CLAUDE_SONNET_4`
83
+ - `TokenBeeModel.OPENAI_GPT_5_MINI`
84
+ - `TokenBeeModel.GROQ_GPT_OSS_20B`
85
85
  - ... and many others.
86
86
 
87
87
  ## License
@@ -4,7 +4,7 @@ build-backend = "setuptools.build_meta"
4
4
 
5
5
  [project]
6
6
  name = "tokenbee-sdk"
7
- version = "1.3.0"
7
+ version = "2.0.0"
8
8
  authors = [
9
9
  { name="TokenBee Inc.", email="founders@tokenbee.io" },
10
10
  ]
@@ -6,7 +6,7 @@ long_description = (this_directory / "README.md").read_text()
6
6
 
7
7
  setup(
8
8
  name="tokenbee-sdk",
9
- version="1.3.0",
9
+ version="2.0.0",
10
10
  packages=find_packages(),
11
11
  install_requires=["httpx>=0.23.0"],
12
12
  author="TokenBee Inc.",
@@ -20,28 +20,39 @@ class TokenBeeContext(str, Enum):
20
20
  CODE = "code"
21
21
 
22
22
  class TokenBeeModel(str, Enum):
23
- # OpenAI
24
- OPENAI_GPT_4_5 = "openai/gpt-4.5-preview"
23
+ # OpenAI — current GPT-5.6 / GPT-5 family
24
+ OPENAI_GPT_5_6_SOL = "openai/gpt-5.6-sol"
25
+ OPENAI_GPT_5_6_TERRA = "openai/gpt-5.6-terra"
26
+ OPENAI_GPT_5_6_LUNA = "openai/gpt-5.6-luna"
27
+ OPENAI_GPT_5 = "openai/gpt-5"
28
+ OPENAI_GPT_5_MINI = "openai/gpt-5-mini"
29
+ OPENAI_GPT_5_NANO = "openai/gpt-5-nano"
30
+ OPENAI_GPT_5_4 = "openai/gpt-5.4"
31
+ OPENAI_GPT_5_4_MINI = "openai/gpt-5.4-mini"
32
+ OPENAI_GPT_5_4_NANO = "openai/gpt-5.4-nano"
33
+ OPENAI_GPT_4_1 = "openai/gpt-4.1"
34
+ OPENAI_GPT_4_1_MINI = "openai/gpt-4.1-mini"
35
+ OPENAI_GPT_4_1_NANO = "openai/gpt-4.1-nano"
25
36
  OPENAI_GPT_4O = "openai/gpt-4o"
26
37
  OPENAI_GPT_4O_MINI = "openai/gpt-4o-mini"
38
+ OPENAI_O3 = "openai/o3"
39
+ OPENAI_O3_MINI = "openai/o3-mini"
40
+ OPENAI_O4_MINI = "openai/o4-mini"
27
41
  OPENAI_O1 = "openai/o1"
28
42
  OPENAI_O1_MINI = "openai/o1-mini"
29
- OPENAI_O3_MINI = "openai/o3-mini"
30
43
 
31
44
  # Anthropic
45
+ ANTHROPIC_CLAUDE_SONNET_4 = "anthropic/claude-sonnet-4-latest"
46
+ ANTHROPIC_CLAUDE_OPUS_4 = "anthropic/claude-opus-4-latest"
47
+ ANTHROPIC_CLAUDE_HAIKU_4 = "anthropic/claude-haiku-4-latest"
32
48
  ANTHROPIC_CLAUDE_3_7_SONNET = "anthropic/claude-3-7-sonnet-latest"
33
49
  ANTHROPIC_CLAUDE_3_5_SONNET = "anthropic/claude-3-5-sonnet-latest"
34
50
  ANTHROPIC_CLAUDE_3_5_HAIKU = "anthropic/claude-3-5-haiku-latest"
35
- ANTHROPIC_CLAUDE_3_OPUS = "anthropic/claude-3-opus-latest"
36
51
 
37
52
  # Google
38
- GEMINI_3_1_PRO = "google/gemini-3.1-pro"
39
- GEMINI_3_1_FLASH = "google/gemini-3.1-flash"
40
53
  GEMINI_2_5_PRO = "google/gemini-2.5-pro"
54
+ GEMINI_2_5_FLASH = "google/gemini-2.5-flash"
41
55
  GEMINI_2_0_FLASH = "google/gemini-2.0-flash"
42
- GEMINI_2_0_PRO = "google/gemini-2.0-pro-exp"
43
- GEMINI_1_5_PRO = "google/gemini-1.5-pro"
44
-
45
56
 
46
57
  # Mistral
47
58
  MISTRAL_LARGE = "mistral/mistral-large-latest"
@@ -54,10 +65,14 @@ class TokenBeeModel(str, Enum):
54
65
  PERPLEXITY_SONAR_PRO = "perplexity/sonar-pro"
55
66
  PERPLEXITY_SONAR_REASONING = "perplexity/sonar-reasoning"
56
67
 
57
- # Groq
58
- GROQ_LLAMA_3_3_70B = "groq/llama-3.3-70b-versatile"
59
- GROQ_LLAMA_3_1_8B = "groq/llama-3.1-8b-instant"
60
- GROQ_DEEPSEEK_R1_DISTILL = "groq/deepseek-r1-distill-llama-70b"
68
+ # Groq (current — Aug 2026)
69
+ # Note: model IDs after "groq/" are sent to Groq as-is (may include org prefix).
70
+ GROQ_GPT_OSS_120B = "groq/openai/gpt-oss-120b"
71
+ GROQ_GPT_OSS_20B = "groq/openai/gpt-oss-20b"
72
+ GROQ_GPT_OSS_SAFEGUARD_20B = "groq/openai/gpt-oss-safeguard-20b"
73
+ GROQ_QWEN3_6_27B = "groq/qwen/qwen3.6-27b"
74
+ GROQ_COMPOUND = "groq/groq/compound"
75
+ GROQ_COMPOUND_MINI = "groq/groq/compound-mini"
61
76
 
62
77
  # xAI
63
78
  XAI_GROK_3 = "xai/grok-3"
@@ -1,6 +1,6 @@
1
1
  Metadata-Version: 2.4
2
2
  Name: tokenbee-sdk
3
- Version: 1.3.0
3
+ Version: 2.0.0
4
4
  Summary: Official Python SDK for TokenBee LLM inference gateway and observability.
5
5
  Author: TokenBee Inc.
6
6
  Author-email: "TokenBee Inc." <founders@tokenbee.io>
@@ -54,7 +54,7 @@ client = TokenBee(
54
54
 
55
55
  # Send a request
56
56
  response = client.send(
57
- model=TokenBeeModel.OPENAI_GPT_4O,
57
+ model=TokenBeeModel.ANTHROPIC_CLAUDE_SONNET_4,
58
58
  input={
59
59
  "messages": [
60
60
  {"role": "user", "content": "Explain quantum entanglement in simple terms."}
@@ -77,7 +77,7 @@ You can specify the compression rate and method per request. TokenBee uses an in
77
77
 
78
78
  ```python
79
79
  response = client.send(
80
- model=TokenBeeModel.ANTHROPIC_CLAUDE_3_5_SONNET,
80
+ model=TokenBeeModel.ANTHROPIC_CLAUDE_SONNET_4,
81
81
  input={
82
82
  "messages": [...],
83
83
  "compression": "auto", # "auto" (default), "on", or "off"
@@ -97,9 +97,9 @@ response = client.send(
97
97
 
98
98
  The SDK provides a `TokenBeeModel` enum with popular models:
99
99
 
100
- - `TokenBeeModel.OPENAI_GPT_4O`
101
- - `TokenBeeModel.ANTHROPIC_CLAUDE_3_5_SONNET`
102
- - `TokenBeeModel.GEMINI_2_0_FLASH`
100
+ - `TokenBeeModel.ANTHROPIC_CLAUDE_SONNET_4`
101
+ - `TokenBeeModel.OPENAI_GPT_5_MINI`
102
+ - `TokenBeeModel.GROQ_GPT_OSS_20B`
103
103
  - ... and many others.
104
104
 
105
105
  ## License
File without changes