Text
Matrix
技术笔记
行业快讯
视频精读
财富自由
思考与随笔
搜索
Text
Matrix
搜索
技术笔记
行业快讯
视频精读
财富自由
思考与随笔
量化
2026
Qwen 3.6 27B 是本地开发的甜蜜点:一份 226 行实测译文 + 工程化拆解
06-30
ML Systems Notes 精读:数据移动为何比计算慢 100 倍——一位工程师的量化、分布式与 Roofline 实战笔记
06-20
turbovec 深度拆解:基于 Google TurboQuant 的 Rust 量化向量索引,10× 内存压缩、SIMD 跑赢 FAISS
06-16
turbovec 深度解析:基于 Google TurboQuant 的 Rust 向量索引,10M 文档从 31 GB 砍到 4 GB,比 FAISS 还快
06-08
AirLLM 完全指南:4GB 显存跑 70B 模型,单 GPU 玩转大模型推理
06-04
LongLive 2.0:NVlabs 长视频生成基础设施,45.7 FPS 实时推理
05-24
TurboQuant+ 深度解读:LLM KV 缓存极限压缩的工程实践
04-23
AI 量化交易从 0 到 1:ai-quant-book 多智能体量化系统导读
04-23
llama.cpp:104k Stars 纯C/C++实现的高效LLM推理框架
04-06