Models 297
Latest releases first. Find a model for what you’re making.
0–7d New 8–30d Recent 31d+ Older · days since release
laya
2d0 downloads / mo168 likesGLM 5.3 FlashX
2dGLM-5.3-FlashX is the high-speed variant of Z.ai's GLM-5.3-Flash, a native multimodal model delivering inference speeds of up to 200 tokens/s.
Open weightsTernary Bonsai 2 27B
2dBonsai 2 27B is a 27B-parameter reasoning model from PrismML derived from Qwen3.8-27B.
405.6K downloads / mo978 likesBonsai-2-27B-Ternary-CRACK-GGUF
3d1.4K downloads / mo94 likesneedle3
4d4.4K downloads / mo70 likesTernary-Bonsai-2-27B-gguf
4d405.6K downloads / mo978 likesQwen3.8-35B-A3B-Distill-GGUF
4d18.3K downloads / mo87 likesQwen-2.5-1B-RLCD
4d0 downloads / mo392 likesDeepSeek-V4.1-Flash-NVFP4
4d550 downloads / mo62 likesopenjev
4d0 downloads / mo147 likesXing4.0-29B-A4B
4d3.1K downloads / mo497 likesTernary-Bonsai-2-27B-mlx-2bit
4d5.1K downloads / mo190 likesXing4.0-29B-A4B-GGUF
4d715 downloads / mo114 likesYuE2-instrumental-cot-full-loras
5d0 downloads / mo52 likesDeepSeek Pro Latest
6dThis model always redirects to the latest model in the DeepSeek Pro family.
Open weightsDeepSeek Flash Latest
6dThis model always redirects to the latest model in the DeepSeek Flash family.
Open weightsyue2-mothersuperior-realaudio-tokenizer-v4
7d0 downloads / mo139 likesDeepSeek-V4.1-Flash-Abliterated-Cybersecurity-Unleashed
7d0 downloads / mo114 likesSchematron V2 Small
8dSchematron V2 Small is a 3B-parameter HTML-to-JSON extraction model from Inference.net.
140.6K downloads / mo2K likesSchematron V2 Turbo
8dSchematron V2 Turbo is a 3B-parameter HTML-to-JSON extraction model from Inference.net.
140.6K downloads / mo2K likesSwift-Qwen3.8-27B-GGUF
9d100.2K downloads / mo284 likesAgnes-3.0-Flash
9d1.4K downloads / mo228 likesAtria-Dawn-Preview
9d711 downloads / mo168 likesYuE2
9d102.2K downloads / mo188 likesgliformer-large-v1
9d0 downloads / mo115 likesQwen3.8-27B-TWIN-TURBO-Fable-Cold-Fusion-709-L-Uncensored-NM-DAU-NEO-MTP-GGUF
10d163.6K downloads / mo168 likesLing 3.0 Flash VL
10dLing 3.0 Flash VL builds on Ling 3.0 Flash (124B total / 5.5B active MoE from InclusionAI), further strengthening its language capabilities while adding…
7.7K downloads / mo97 likesDeepSeek V4.1 Flash
10dDeepSeek V4.1 Flash is a sparse mixture-of-experts model from DeepSeek, and the first built on the company's Causal Encoder-Decoder (CED) architecture.
429.9K downloads / mo3.2K likesAliceAI-T5-35B-A0.6B
10d977 downloads / mo119 likesDeepSeek-V4.1-Flash-UNCENSORED-FP8
10d33.1K downloads / mo283 likesSheetSage2
11d9.2K downloads / mo107 likesSignal-3.8-27B-GGUF
11d17.1K downloads / mo89 likesSwift-Qwen3.8-27b
12d6.3K downloads / mo448 likesNex-N2.5-Pro (free)
12dNex-N2.5 is an agentic model built to turn goals into working, verified outcomes.
31.7K downloads / mo665 likesEdge0-8B-A1B-preview
12d4.3K downloads / mo72 likesNex-N2.5-Mini (free)
12dNex-N2.5 is an agentic model built to turn goals into working, verified outcomes.
8K downloads / mo836 likesFastVideo-FastH3-Comfy
12d80.1K downloads / mo84 likesEdge0-35B-A3B-preview
12d52.5K downloads / mo3.4K likesOxCoder-9B
13d2.5K downloads / mo63 likesOUI-1
13d2.3K downloads / mo125 likesNex-N2.5-Max
13d12.1K downloads / mo56 likesQwen3.8-Flash-Next-GSQ-RCO-GGUF
13d21.2K downloads / mo144 likesMinimax-H3-ComfyUI
14d21.9K downloads / mo217 likesMiniCPM5-2B
14d357.2K downloads / mo1.6K likesHuihui-Qwen3.8-Flash-Next-abliterated-GGUF
14d59.7K downloads / mo76 likesQwen3.8-27B-OBLITERATED-Mythos-Class-Agentic
14d4.4K downloads / mo75 likesMiniMax-H3-Semantic-Bridge
15d1.8K downloads / mo74 likesNeoHorse-1-9B
15d10.7K downloads / mo890 likes
