AlpinDale d9f4c36edd feat: Medusa speculative decoding support (#590) 5 tháng trước cách đây
..
__init__.py d9f4c36edd feat: Medusa speculative decoding support (#590) 5 tháng trước cách đây
arctic.py 1e35cef979 feat: add arctic snowflake model (#551) 6 tháng trước cách đây
chatglm.py 9e73559eba make use of batched rotary embedding kernels to support long context lora 6 tháng trước cách đây
dbrx.py fca911ee0a vLLM Upstream Sync (#526) 7 tháng trước cách đây
falcon.py fca911ee0a vLLM Upstream Sync (#526) 7 tháng trước cách đây
jais.py fca911ee0a vLLM Upstream Sync (#526) 7 tháng trước cách đây
medusa.py d9f4c36edd feat: Medusa speculative decoding support (#590) 5 tháng trước cách đây
mlp_speculator.py de7e6919c0 feat: support tied weights and input scale for MLPSpeculator 5 tháng trước cách đây
mpt.py fca911ee0a vLLM Upstream Sync (#526) 7 tháng trước cách đây