Text
Matrix
技术笔记
行业快讯
视频精读
财富自由
思考与随笔
搜索
Text
Matrix
搜索
技术笔记
行业快讯
视频精读
财富自由
思考与随笔
MoE
2026
KTransformers:让 CPU-GPU 异构推理跑超大 MoE 的实战框架
07-20
colibrì 引擎拆解:在 25GB RAM 上跑 744B MoE 模型,纯 C 实现,比 vLLM-Moet 快 2.5 倍
07-13
Qwen 3.6 27B 是本地开发的甜蜜点:一份 226 行实测译文 + 工程化拆解
06-30
2×GH200 跑 GLM-5.2:从 2.39 tok/s 到 54.92 tok/s,局部性铁律贯穿全文
06-25
GLM-5 全家桶拆解:从 Vibe Coding 到 Agentic Engineering 的开源旗舰模型
06-18
DeepSeek-V3 技术解析:671B 参数开源大模型的工程奇迹
04-27
OpenMythos:开源复现 Claude Mythos 架构,Looped Transformer 如何让大模型学会“深度思考”
04-23
MiniMind:从零开始用3块钱训练64M参数的大语言模型
04-12