Inference Providers
Active filters: quark
fxmarty/qwen1.5_moe_a2.7b_chat_w_fp4_a_fp6_e2m3
8B • Updated • 5.01k
fxmarty/qwen1.5_moe_a2.7b_chat_w_fp6_e2m3_a_fp6_e2m3
11B • Updated • 10
fxmarty/qwen1.5_moe_a2.7b_chat_w_fp6_e3m2_a_fp6_e3m2
11B • Updated • 4.93k
amd/Llama-2-70b-chat-hf-WMXFP4-AMXFP4-KVFP8-Scale-UINT8-MLPerf-GPTQ
37B • Updated • 19
sudhab1988/rakuten-7b-awq-g128-int4-asym-fp16-hf
1B • Updated • 7
matmelis/Llama_3.2_1B_w_uint4_gptq
0.4B • Updated • 10
EliovpAI/Qwen3-14B-FP8-KV
Text Generation
• 15B • Updated • 18
• 2
matmelis/Llama_3.2_1B_w_uint4_autosmoothquant_gptq
0.4B • Updated • 8
matmelis/Llama_3.2_1B_w_uint4_qronos
0.4B • Updated • 7
matmelis/Llama_3.2_3B_w_mxfp4_a_mxfp4_qronos
2B • Updated • 7
EliovpAI/Qwen3-0.6B-FP8-KV
Text Generation
• 0.6B • Updated • 12
matmelis/Llama_3.2_3B_w_mxfp4_a_mxfp4_gptq
2B • Updated • 8
matmelis/Llama_3.2_1B_w_int3_qronos
0.6B • Updated • 6
matmelis/Llama_3.2_3B_w_uint4_qronos
0.8B • Updated • 6
matmelis/Llama_3.2_3B_w_int3_qronos
1B • Updated • 7
matmelis/Llama_3.2_3B_w_int2_gptq
3B • Updated • 7
matmelis/Llama_3.2_3B_w_int3_gptq
3B • Updated • 8
matmelis/Llama_3.2_3B_w_int2_qronos
3B • Updated • 8
matmelis/Llama_3.2_1B_w_int3_gptq
0.6B • Updated • 9
matmelis/Llama_3.2_3B_w_uint4_gptq
0.8B • Updated • 8
matmelis/Llama_3.2_1B_w_int2_qronos
1B • Updated • 6
matmelis/Llama_3.2_1B_w_int2_gptq
1B • Updated • 9
matmelis/Llama_3.2_1B_w_uint4_smoothquant_qronos
0.4B • Updated • 8
amd/DeepSeek-R1-0528-MXFP4-ASQ
342B • Updated • 87
• 1
haoyang-amd/output_oss_120b_moe_w_mxfp4_a_mxfp4
174B • Updated • 11
haoyang-amd/output_oss_20b_moe_w_mxfp4_a_bfloat16
11B • Updated • 8
matmelis/Llama_3.2_1B_w_mxfp4_a_mxfp4_gptq
0.8B • Updated • 10
matmelis/Llama_3.2_1B_w_mxfp4_a_mxfp4_qronos
0.8B • Updated • 10
amd/Mixtral-8x7B-Instruct-v0.1-WMXFP4FP8-AMXFP4FP8-AMP-KVFP8
37B • Updated • 38
amd/Llama-2-70b-chat-hf-WMXFP4FP8-AMXFP4FP8-AMP-KVFP8
55B • Updated • 43