Back to Tools Directory
A 2.78-trillion-parameter Kimi K3 running inference on a single CPU in 8.24 GB of RAM. Portable C99: no BLAS, no framework, no GPU.
Categories & Topics
avx2c99cpu-inferencedeep-learningfrom-scratchinference-enginekimi-k3linear-attentionllmllm-inferencemachine-learningmemory-efficientmixture-of-expertsmoemxfp4quantizationsimdsystems-programmingtransformerzero-dependencies
Repository Stats
3.0k
GitHub Stars
508
Forks
3.0k
Watchers
2
Open Issues
License
Apache License 2.0
Repository
FareedKhan-dev/kimi-k3-in-cLast Updated
Today
August 7, 2026
Latest Release
v0.1.0
5 days ago
Related Tools
auto-deep-researcher-24x7
1.3k
🔥 An autonomous AI agent that runs your deep learning experiments 24/7 while you sleep. Zero-cost monitoring, Leader-Worker architecture, constant-size memory.
Confucius4-TTS
739
Confucius4-TTS: a Multilingual and Cross-Lingual Zero-Shot TTS Engine
how-to-train-your-gpt
2.3k
Build a modern LLM from scratch. Every line commented. Explained like we are five.
kairos
2.5k
Official code for world model Kairos
kairos-sensenova
2.5k
Official code for world model Kairos
MatAnyone2
805
[CVPR 2026 Highlight] MatAnyone 2: Scaling Video Matting via a Learned Quality Evaluator