Strata fork: Qwen3.8-Flash-Next 125B MoE in ModelOpt NVFP4 on one RTX 20/30/40/50 card (12 GB+, measured on an RTX 5090) + 64 GB of RAM or more. W4A8 prompt path, AVX-512 CPU experts, a low-RAM tier, pictures on the CPU, Cyrillic MTP drafts. Windows / CUDA 13.
Topic Catalog
Nvfp4 GitHub Repositories (2026) · Open Source Tools
Discover the best Nvfp4 open source repositories on GitHub. Explore trending tools, live star counts, source code, and developer projects updated daily.
SPONSORED BY
2 matching projects · updated Oct 7, 2026
How we rank ↗
From our network