Loading...
Browse 4,794 models across providers, modalities, and use cases.
🌐 All Models
4,794 models · Page 119 of 134
Open-source Qwen3-Coder-Next-FP8 model from qwen — available for download and self-hosting on Hugging Face.
Open-source NVIDIA-Nemotron-3-Nano-30B-A3B-FP8 model from nvidia — available for download and self-hosting on Hugging Face.
glm-5 — available to run locally via Ollama on CPU and GPU hardware.
deepseek-v3.2 — available to run locally via Ollama on CPU and GPU hardware.
qwen3-vl:235b — available to run locally via Ollama on CPU and GPU hardware.
gemini-3-flash-preview — available to run locally via Ollama on CPU and GPU hardware.
cogito-2.1:671b — available to run locally via Ollama on CPU and GPU hardware.
Open-source Mistral-7B-Instruct-v0.2 model from mistralai — available for download and self-hosting on Hugging Face.
Open-source Qwen3-0.6B-FP8 model from qwen — available for download and self-hosting on Hugging Face.
Open-source Llama-3.1-8B model from meta-llama — available for download and self-hosting on Hugging Face.
Open-source OTel-LLM-1.2B-IT model from farbodtavakkoli — available for download and self-hosting on Hugging Face.
Open-source Gemma-4-31B-IT-NVFP4 model from nvidia — available for download and self-hosting on Hugging Face.
Open-source Qwen2.5-Coder-32B-Instruct model from qwen — available for download and self-hosting on Hugging Face.
Open-source tiny-random-Llama-3 model from llamafactory — available for download and self-hosting on Hugging Face.
Open-source Qwen3-4B-Base model from qwen — available for download and self-hosting on Hugging Face.
Open-source Qwen2.5-7B model from qwen — available for download and self-hosting on Hugging Face.
qwen3-coder-next — available to run locally via Ollama on CPU and GPU hardware.
Open-source Qwen2.5-1.5B-quantized.w8a8 model from redhatai — available for download and self-hosting on Hugging Face.
Open-source Kimi-K2.5-NVFP4 model from nvidia — available for download and self-hosting on Hugging Face.
Open-source pythia-70m-deduped model from eleutherai — available for download and self-hosting on Hugging Face.
Open-source gpt2-medium model from openai-community — available for download and self-hosting on Hugging Face.
Open-source SmolLM2-135M-Instruct model from huggingfacetb — available for download and self-hosting on Hugging Face.
Open-source HyperCLOVAX-SEED-Think-14B-GPTQ model from k-compression — available for download and self-hosting on Hugging Face.
Open-source Llama-3.1-70B-Instruct model from meta-llama — available for download and self-hosting on Hugging Face.
Open-source GLM-4.7-Flash model from zai-org — available for download and self-hosting on Hugging Face.
Open-source gemma-3-1b-it model from google — available for download and self-hosting on Hugging Face.
Open-source Qwen2.5-Coder-7B-Instruct-GPTQ-Int4 model from qwen — available for download and self-hosting on Hugging Face.
Open-source Qwen2.5-Coder-14B-Instruct model from qwen — available for download and self-hosting on Hugging Face.
Open-source DeepSeek-V3 model from deepseek-ai — available for download and self-hosting on Hugging Face.
Open-source MiniMax-M2.5 model from minimaxai — available for download and self-hosting on Hugging Face.
Open-source DeepSeek-R1-0528 model from deepseek-ai — available for download and self-hosting on Hugging Face.
nemotron-3-nano:30b — available to run locally via Ollama on CPU and GPU hardware.
qwen3-next:80b — available to run locally via Ollama on CPU and GPU hardware.
devstral-2:123b — available to run locally via Ollama on CPU and GPU hardware.
glm-4.6 — available to run locally via Ollama on CPU and GPU hardware.
kimi-k2-thinking — available to run locally via Ollama on CPU and GPU hardware.