AlpinDale c577c31aaa feat: tree attention 8 місяців тому
..
__init__.py 04b53d2db5 chore: add initializer files 1 рік тому
cache_engine.py 4d33ce60da feat: Triton flash attention backend for ROCm (#407) 9 місяців тому
cpu_model_runner.py 6e0761ba5d make init_distributed_environment compatible with init_process_group 9 місяців тому
cpu_worker.py d8c4193704 feat: Speculative Decoding using a draft model (#432) 8 місяців тому
model_runner.py c577c31aaa feat: tree attention 8 місяців тому
neuron_model_runner.py 0f1399c135 feat: attention refactor part 2 9 місяців тому
neuron_worker.py d8c4193704 feat: Speculative Decoding using a draft model (#432) 8 місяців тому
worker.py d8c4193704 feat: Speculative Decoding using a draft model (#432) 8 місяців тому
worker_base.py d8c4193704 feat: Speculative Decoding using a draft model (#432) 8 місяців тому