.. |
__init__.py
|
5884e0b904
add bitnetforcausallm support
|
преди 6 месеца |
arctic.py
|
656459fd84
make fp8_e4m3 work on nvidia
|
преди 6 месеца |
baichuan.py
|
656459fd84
make fp8_e4m3 work on nvidia
|
преди 6 месеца |
bitnet.py
|
9bbc75d2e3
wip
|
преди 6 месеца |
bloom.py
|
656459fd84
make fp8_e4m3 work on nvidia
|
преди 6 месеца |
chatglm.py
|
656459fd84
make fp8_e4m3 work on nvidia
|
преди 6 месеца |
commandr.py
|
656459fd84
make fp8_e4m3 work on nvidia
|
преди 6 месеца |
dbrx.py
|
656459fd84
make fp8_e4m3 work on nvidia
|
преди 6 месеца |
decilm.py
|
50b7c13db0
refactor: attention selector (#552)
|
преди 6 месеца |
deepseek.py
|
656459fd84
make fp8_e4m3 work on nvidia
|
преди 6 месеца |
falcon.py
|
656459fd84
make fp8_e4m3 work on nvidia
|
преди 6 месеца |
gemma.py
|
656459fd84
make fp8_e4m3 work on nvidia
|
преди 6 месеца |
gpt2.py
|
656459fd84
make fp8_e4m3 work on nvidia
|
преди 6 месеца |
gpt_bigcode.py
|
656459fd84
make fp8_e4m3 work on nvidia
|
преди 6 месеца |
gpt_j.py
|
656459fd84
make fp8_e4m3 work on nvidia
|
преди 6 месеца |
gpt_neox.py
|
656459fd84
make fp8_e4m3 work on nvidia
|
преди 6 месеца |
internlm2.py
|
656459fd84
make fp8_e4m3 work on nvidia
|
преди 6 месеца |
jais.py
|
656459fd84
make fp8_e4m3 work on nvidia
|
преди 6 месеца |
llama.py
|
ac79d115b3
add guards for prefix caching, fp8, chunked, etc
|
преди 6 месеца |
llama_embedding.py
|
50b7c13db0
refactor: attention selector (#552)
|
преди 6 месеца |
llava.py
|
24a2d9c2c8
minor llava refactoring
|
преди 6 месеца |
minicpm.py
|
656459fd84
make fp8_e4m3 work on nvidia
|
преди 6 месеца |
mixtral.py
|
ac79d115b3
add guards for prefix caching, fp8, chunked, etc
|
преди 6 месеца |
mixtral_quant.py
|
ac79d115b3
add guards for prefix caching, fp8, chunked, etc
|
преди 6 месеца |
mpt.py
|
656459fd84
make fp8_e4m3 work on nvidia
|
преди 6 месеца |
olmo.py
|
656459fd84
make fp8_e4m3 work on nvidia
|
преди 6 месеца |
opt.py
|
656459fd84
make fp8_e4m3 work on nvidia
|
преди 6 месеца |
orion.py
|
656459fd84
make fp8_e4m3 work on nvidia
|
преди 6 месеца |
phi.py
|
656459fd84
make fp8_e4m3 work on nvidia
|
преди 6 месеца |
phi3_small.py
|
696f2cd59c
add phi3_small support with blocksparse attention
|
преди 6 месеца |
qwen.py
|
656459fd84
make fp8_e4m3 work on nvidia
|
преди 6 месеца |
qwen2.py
|
ac79d115b3
add guards for prefix caching, fp8, chunked, etc
|
преди 6 месеца |
qwen2_moe.py
|
656459fd84
make fp8_e4m3 work on nvidia
|
преди 6 месеца |
stablelm.py
|
656459fd84
make fp8_e4m3 work on nvidia
|
преди 6 месеца |
starcoder2.py
|
ac79d115b3
add guards for prefix caching, fp8, chunked, etc
|
преди 6 месеца |
vlm_base.py
|
f970f3f3fb
add base class for VLMs
|
преди 6 месеца |
xverse.py
|
ac79d115b3
add guards for prefix caching, fp8, chunked, etc
|
преди 6 месеца |