Official Python SDK for the Cortex LLM Gateway API by InfiniteMonkeys
Project description
Cortex Python SDK
Python client for the Cortex LLM Gateway and Admin API.
Installation
pip install cortex-sdk
Quick Start
from cortex_sdk import CortexClient
client = CortexClient(api_key="sk-cortex-...")
# Chat completions
response = client.chat.completions.create(
model="default",
messages=[{"role": "user", "content": "Hello!"}],
)
print(response.choices[0].message.content)
client.close()
Async Usage
import asyncio
from cortex_sdk import AsyncCortexClient
async def main():
async with AsyncCortexClient(api_key="sk-cortex-...") as client:
response = await client.chat.completions.create(
model="default",
messages=[{"role": "user", "content": "Hello!"}],
)
print(response.choices[0].message.content)
asyncio.run(main())
Streaming
# Sync streaming
stream = client.chat.completions.create(
model="default",
messages=[{"role": "user", "content": "Tell me a story"}],
stream=True,
)
for chunk in stream:
if chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="")
# Async streaming
stream = await async_client.chat.completions.create(
model="default",
messages=[{"role": "user", "content": "Tell me a story"}],
stream=True,
)
async for chunk in stream:
if chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="")
Configuration
client = CortexClient(
api_key="sk-cortex-...",
llm_base_url="https://cortexapi.nfinitmonkeys.com/v1", # LLM gateway
admin_base_url="https://admin.nfinitmonkeys.com", # Admin API
timeout=30.0, # Request timeout (seconds)
streaming_timeout=300.0, # Streaming timeout (seconds)
max_retries=3, # Retry count for transient errors
extra_headers={"X-Custom": "value"},
)
LLM Gateway
Chat Completions
response = client.chat.completions.create(
model="gpt-4",
messages=[
{"role": "system", "content": "You are a helpful assistant."},
{"role": "user", "content": "What is Python?"},
],
temperature=0.7,
max_tokens=500,
)
Text Completions
response = client.completions.create(
model="gpt-3.5-turbo-instruct",
prompt="Once upon a time",
max_tokens=100,
)
print(response.choices[0].text)
Embeddings
response = client.embeddings.create(
model="text-embedding-ada-002",
input="Hello world",
)
print(response.data[0].embedding)
Models
models = client.models.list()
for model in models.data:
print(model.id)
Admin API
API Keys
# List keys
keys = client.keys.list()
# Create key
key = client.keys.create(name="Production", scopes=["chat", "embeddings"])
# Delete key
client.keys.delete("key-id")
Teams
# List / create / get / delete teams
teams = client.teams.list()
team = client.teams.create(name="Engineering")
team = client.teams.get("team-id")
client.teams.delete("team-id")
# Members
member = client.teams.add_member("team-id", email="alice@example.com", role="admin")
client.teams.update_member("team-id", "member-id", role="viewer")
client.teams.remove_member("team-id", "member-id")
Usage & Performance
stats = client.usage.get(params={"start_date": "2024-01-01"})
limits = client.usage.limits()
metrics = client.performance.get()
Conversations
convos = client.conversations.list()
convo = client.conversations.create(title="My Chat", model="gpt-4")
convo = client.conversations.get("conv-id")
convo = client.conversations.update("conv-id", title="New Title")
client.conversations.delete("conv-id")
# Stream messages (SSE)
for msg in client.conversations.messages("conv-id"):
print(msg.content)
Iris (Document Extraction)
job = client.iris.extract(
document_url="https://example.com/invoice.pdf",
schema_id="invoice-schema",
)
jobs = client.iris.list_jobs(limit=10)
schemas = client.iris.list_schemas()
Other Resources
# Plugins & Optimizations
plugins = client.plugins.list()
opts = client.optimizations.get()
# Admin models config
models = client.admin_models.list()
# PDF generation
pdf = client.pdf.generate(content="# Report", template="default")
# Web search
results = client.web_search.search(query="Python programming", num_results=5)
Error Handling
from cortex_sdk import (
CortexError,
AuthenticationError,
RateLimitError,
NotFoundError,
InternalServerError,
)
try:
response = client.chat.completions.create(...)
except AuthenticationError:
print("Invalid API key")
except RateLimitError as e:
print(f"Rate limited. Retry after {e.retry_after}s")
except NotFoundError:
print("Resource not found")
except InternalServerError:
print("Server error — will be retried automatically")
except CortexError as e:
print(f"SDK error: {e.message}")
Retry Behavior
The SDK automatically retries on HTTP 429, 500, 502, 503, and 504 with exponential backoff and jitter. The Retry-After header is respected when present. Configure with max_retries (default: 3).
Development
pip install -e ".[dev]"
pytest
License
MIT
Project details
Download files
Download the file for your platform. If you're not sure which to choose, learn more about installing packages.
Source Distribution
Built Distribution
Filter files by name, interpreter, ABI, and platform.
If you're not sure about the file name format, learn more about wheel file names.
Copy a direct link to the current filters
File details
Details for the file nfinitmonkeys_cortex_sdk-1.0.0.tar.gz.
File metadata
- Download URL: nfinitmonkeys_cortex_sdk-1.0.0.tar.gz
- Upload date:
- Size: 20.3 kB
- Tags: Source
- Uploaded using Trusted Publishing? No
- Uploaded via: twine/6.2.0 CPython/3.14.3
File hashes
| Algorithm | Hash digest | |
|---|---|---|
| SHA256 |
b3e04aba36967b7b1423f5d05db410903ef133c106e20e4c8e1a52e6b11a6baf
|
|
| MD5 |
84b644c915107d75dacdceacda9c7224
|
|
| BLAKE2b-256 |
8ce1bb57d92ca6da84e9ea592990567af43249eef79790cd4c86240819bac54e
|
File details
Details for the file nfinitmonkeys_cortex_sdk-1.0.0-py3-none-any.whl.
File metadata
- Download URL: nfinitmonkeys_cortex_sdk-1.0.0-py3-none-any.whl
- Upload date:
- Size: 23.3 kB
- Tags: Python 3
- Uploaded using Trusted Publishing? No
- Uploaded via: twine/6.2.0 CPython/3.14.3
File hashes
| Algorithm | Hash digest | |
|---|---|---|
| SHA256 |
cce80e9c9d3a57beaf0952335f7a9ceddb2570fa14d45e3544c7f5b1b57160e1
|
|
| MD5 |
bc26400c965b53a5e3b9adcc42715c5a
|
|
| BLAKE2b-256 |
76e244ff531ab045d4ee867495c81bd8949ca122aa1a756b9e8834f74d83d4d6
|