AlpinDale 4a7cb8f232 rocm: add custom paged attention kernels for ROCm (#1043) 2 місяців тому
..
__init__.py 9d81716bfd [v0.5.3] Release Candidate (#388) 10 місяців тому
abstract.py 1390915778 multi-step: add support for flashinfer attention backend (#1033) 2 місяців тому
blocksparse_attn.py 1405051912 attention: add `AttentionState` abstraction (#863) 3 місяців тому
flash_attn.py 1390915778 multi-step: add support for flashinfer attention backend (#1033) 2 місяців тому
flashinfer.py c951a54d21 fix: multi-step + flashinfer with cuda graphs (#1036) 2 місяців тому
ipex_attn.py 6951928522 xpu: bump IPEX to 2.3, support GQA (#1042) 2 місяців тому
openvino.py 1405051912 attention: add `AttentionState` abstraction (#863) 3 місяців тому
pallas.py 032974a28a tpu: fix TPU type api (#975) 2 місяців тому
placeholder_attn.py 3bb0f07461 chore: rename `task_handler` to `worker` (#985) 2 місяців тому
rocm_flash_attn.py 4a7cb8f232 rocm: add custom paged attention kernels for ROCm (#1043) 2 місяців тому
torch_sdpa.py 1405051912 attention: add `AttentionState` abstraction (#863) 3 місяців тому
utils.py 3bb0f07461 chore: rename `task_handler` to `worker` (#985) 2 місяців тому
xformers.py 1405051912 attention: add `AttentionState` abstraction (#863) 3 місяців тому