Skip to main content

Intelligent prompt compression for LLMs โ€” cut token costs without losing meaning

Project description

๐ŸŒณ Prompt Bonsai

Cut your LLM token costs by 30โ€“70% without losing meaning.

PyPI version Python versions CI Codecov License: MIT

Prompt Bonsai intelligently compresses prompts for Large Language Models (LLMs), reducing token usage and API costs while preserving semantic meaning and output quality.

Why Prompt Bonsai?

Problem Solution
Token costs eating your budget? 30โ€“70% token reduction with quality guarantees
Context window too small? Fit more content in limited context
Prompts full of filler? Remove semantic redundancy automatically
JSON/code bloating tokens? Structural optimization preserves syntax
Worried about quality loss? Built-in quality assessment with configurable thresholds

Installation

pip install prompt-bonsai

With optional dependencies:

pip install prompt-bonsai[openai,langchain]  # For integrations
pip install prompt-bonsai[all]                  # Everything

Quick Start

One-line compression

from prompt_bonsai import compress

long_prompt = "I would like to kindly request your assistance with..." * 10
short = compress(long_prompt, ratio=0.5)

print(f"Saved {len(long_prompt) - len(short)} characters")

Full control with Compressor

from prompt_bonsai import Compressor

compressor = Compressor(
    strategy="hybrid",      # "semantic", "structural", or "hybrid"
    target_ratio=0.4,        # Aim for 40% reduction
    min_quality=0.90,       # Reject if quality drops below 90%
    preserve=["{user_id}"], # Keep template variables
    model_name="gpt-4",     # Optimize for specific tokenizer
    verbose=True,           # Show compression details
)

result = compressor.compress(your_prompt)

print(result.text)                          # Compressed prompt
print(result.original_tokens)             # Before
print(result.compressed_tokens)           # After
print(result.quality_report.overall_score)  # Quality: 0.0โ€“1.0

Compression Strategies

Strategy Best For How It Works
Semantic Conversational prompts Removes filler words, redundant phrases, weak adverbs
Structural Code, JSON, XML Normalizes whitespace, minimizes structured data, removes comments
Hybrid Mixed content (default) Auto-detects prompt type and applies optimal strategy

Real-World Example

from prompt_bonsai import Compressor

compressor = Compressor(target_ratio=0.5, verbose=True)

system_prompt = """
You are an expert Python developer. Please review the following code
and suggest improvements for readability, performance, and
maintainability. Consider PEP 8 compliance, type hints, documentation,
error handling, and testing coverage in your analysis.
"""

result = compressor.compress(system_prompt)

Output:

โ”โ”โ”โ”โ”โ”โ”โ”โ”โ”โ”โ”โ”โ”โ”โ”โ”โ”โ”โ”โ”โ”โ”ณโ”โ”โ”โ”โ”โ”โ”โ”โ”โ”โ”โ”โ”โ”โ”โ”โ”โ”โ”โ”โ”โ”โ”โ”โ”โ”โ”โ”โ”โ”โ”โ”โ”โ”“
โ”ƒ Metric              โ”ƒ Value                           โ”ƒ
โ”กโ”โ”โ”โ”โ”โ”โ”โ”โ”โ”โ”โ”โ”โ”โ”โ”โ”โ”โ”โ”โ”โ•‡โ”โ”โ”โ”โ”โ”โ”โ”โ”โ”โ”โ”โ”โ”โ”โ”โ”โ”โ”โ”โ”โ”โ”โ”โ”โ”โ”โ”โ”โ”โ”โ”โ”โ”ฉ
โ”‚ Strategy            โ”‚ HybridCompressor                โ”‚
โ”‚ Original Tokens     โ”‚ 67                              โ”‚
โ”‚ Compressed Tokens   โ”‚ 34                              โ”‚
โ”‚ Tokens Saved        โ”‚ 33 (49.3%)                      โ”‚
โ”‚ Quality Score       โ”‚ 0.912                           โ”‚
โ”‚ Semantic Similarity โ”‚ 0.845                           โ”‚
โ”‚ Structural Integrityโ”‚ 1.000                           โ”‚
โ””โ”€โ”€โ”€โ”€โ”€โ”€โ”€โ”€โ”€โ”€โ”€โ”€โ”€โ”€โ”€โ”€โ”€โ”€โ”€โ”€โ”€โ”ดโ”€โ”€โ”€โ”€โ”€โ”€โ”€โ”€โ”€โ”€โ”€โ”€โ”€โ”€โ”€โ”€โ”€โ”€โ”€โ”€โ”€โ”€โ”€โ”€โ”€โ”€โ”€โ”€โ”€โ”€โ”€โ”€โ”€โ”˜

Integration Examples

With OpenAI

from openai import OpenAI
from prompt_bonsai import compress

client = OpenAI()

prompt = "Your very long prompt here..."
compressed = compress(prompt, ratio=0.4)

response = client.chat.completions.create(
    model="gpt-4",
    messages=[{"role": "user", "content": compressed}]
)

With LangChain

from prompt_bonsai import Compressor

compressor = Compressor(target_ratio=0.3)

# Compress before creating your prompt
compressed_context = compressor.compress(large_document).text

# Use in your LangChain pipeline
prompt = PromptTemplate.from_template(
    "Answer based on: {context}\n\nQuestion: {question}"
)

Configuration

from prompt_bonsai.config import CompressionConfig, CompressionStrategy

config = CompressionConfig(
    strategy=CompressionStrategy.HYBRID,
    target_ratio=0.5,
    min_quality=0.90,
    max_iterations=3,
    preserve_patterns=["{variable}", "{{template}}"],
    tokenizer_backend="auto",  # "tiktoken", "huggingface", or "auto"
    model_name="gpt-4",        # For accurate token counting
)

compressor = Compressor(config=config)

CLI Usage

# Compress a file
prompt-bonsai compress input.txt --ratio 0.5 --output compressed.txt

# Compress from stdin
echo "Your long prompt..." | prompt-bonsai compress --ratio 0.4

# Check token count
prompt-bonsai tokens "Your prompt here" --model gpt-4

Benchmarks

Run benchmarks against standard datasets:

python benchmarks/run_benchmarks.py

API Reference

See full documentation.

Contributing

We welcome contributions! See CONTRIBUTING.md.

git clone https://github.com/vodalachakshu123/prompt-bonsai.git
cd prompt-bonsai
pip install -e ".[dev]"
pytest

License

MIT License โ€” see LICENSE.

Project details


Download files

Download the file for your platform. If you're not sure which to choose, learn more about installing packages.

Source Distribution

prompt_bonsai-0.1.1.tar.gz (31.1 kB view details)

Uploaded Source

Built Distribution

If you're not sure about the file name format, learn more about wheel file names.

prompt_bonsai-0.1.1-py3-none-any.whl (23.9 kB view details)

Uploaded Python 3

File details

Details for the file prompt_bonsai-0.1.1.tar.gz.

File metadata

  • Download URL: prompt_bonsai-0.1.1.tar.gz
  • Upload date:
  • Size: 31.1 kB
  • Tags: Source
  • Uploaded using Trusted Publishing? No
  • Uploaded via: twine/6.2.0 CPython/3.12.2

File hashes

Hashes for prompt_bonsai-0.1.1.tar.gz
Algorithm Hash digest
SHA256 b7fd795a1eaa39449fb40ae3f64791315574ac41605f27392e3da8fdbf8c5ad4
MD5 b80179ef78e523273147c7cf11edb40f
BLAKE2b-256 1a9f4b63a21cf8d37ca19e3ea653e005d7e72d26e8c718bb1fa0468f0efcffcd

See more details on using hashes here.

File details

Details for the file prompt_bonsai-0.1.1-py3-none-any.whl.

File metadata

  • Download URL: prompt_bonsai-0.1.1-py3-none-any.whl
  • Upload date:
  • Size: 23.9 kB
  • Tags: Python 3
  • Uploaded using Trusted Publishing? No
  • Uploaded via: twine/6.2.0 CPython/3.12.2

File hashes

Hashes for prompt_bonsai-0.1.1-py3-none-any.whl
Algorithm Hash digest
SHA256 656ac52d0d0664893135a9a81c3f8b5b1a9666a95921c004b3b6c64861847210
MD5 af55e769d5f73fc11aabb4f3f3d294d7
BLAKE2b-256 9c537a0d3fbeaf1e6a6c6d01f9bd8ba1104ada9e6b1f7cf4443b3b5e8e935ba2

See more details on using hashes here.

Supported by

AWS Cloud computing and Security Sponsor Datadog Monitoring Depot Continuous Integration Fastly CDN Google Download Analytics Pingdom Monitoring Sentry Error logging StatusPage Status page