RSS Feed
All
r/AI_Agents
r/AI_Governance
r/ClaudeAI
r/ClaudeCode
r/DeepSeek
r/Futurology
r/LangChain
r/LocalLLaMA
r/MachineLearning
r/OpenAI
r/artificial
r/cybersecurity
r/europe
r/hermesagent
r/netsec
r/singularity
r/technology
1212 items in r/LocalLLaMA
30.08.2026
29.08.2026
r/LocalLLaMA
llama.cpp Open PRs list - CPU/RAM/Disk/Hybrid Related - Better for CPU-only & Hybrid inference
๐
r/LocalLLaMA
Tencent compressed Hy4-preview from 1.5TB to about 200GB GGUF and kept about 98% performance.
๐
28.08.2026
r/LocalLLaMA
I audited 443 GGUF quants across 25 repos. 64 of them can't be the quant their filename claims.
๐
r/LocalLLaMA
It's unbelievable! I used the mmap function in llama.cpp to fit Qwen3.8-Flash-Next IQ3_XSS into 16G+64G RAM, and the speed still reached 26t/s.
๐