Skip to main content

Flash Attention X

Flash Attention X is a flash attention(s) implementation using Triton, including flash_attention_full, flash_attention_causal and flash_attention_bias...

Installation

You can install Flash Attention X using pip:

pip install flash_attention_x
pip install -e .

Requirements

  • Python >= 3.8
  • Triton >= 2.3.0

The package is tested with Triton 2.3.0 and CUDA 12.0.

Features

  • Efficient implementation of flash attention(s), including flash_attention_full, flash_attention_causal and flash_attention_bias...
  • Built using Triton for optimized performance

License

This project is licensed under the MIT License - see the LICENSE file for details.

Author

Xiaotian Han

Release files for flash-attention-x 0.0.1

For a detailed explanation of source distributions (sdists) and built distributions (wheels), please see the package formats documentation.

Source distribution (sdist)

Source distribution for flash-attention-x 0.0.1
File Size Uploaded
flash_attention_x-0.0.1.tar.gz 6.7 kB Details

Release files / flash_attention_x-0.0.1.tar.gz

Download URL flash_attention_x-0.0.1.tar.gz
Size 6.7 kB
Tags Source
SHA-256 checksum
How to use checksums
e83277a2bd3d7023d22cb5c8b6dd159d4bd99cabfce60dde9426f091b01f242a
BLAKE2b-256 checksum
How to use checksums
c69e38f907af63cc1ca3ee67f6cbea8a40d44b62efbf6e0cb7a4c3c530e41874
Upload date
Uploaded using Trusted Publishing?
What is trusted publishing?
No
Uploaded via twine/5.1.1 CPython/3.10.12

Release history Release notifications | RSS feed

This release

0.0.1 This release

1 release file

Anthropic, PBC Visionary sponsor Bloomberg Visionary sponsor Hudson River Trading Visionary sponsor Meta Visionary sponsor NVIDIA Visionary sponsor Microsoft Sustainability sponsor Depot Continuous Integration AWS Cloud computing and Security Sponsor Datadog Monitoring Fastly CDN Google Download Analytics Sentry Error logging StatusPage Status page