Text Matrix
技术笔记 行业快讯 视频精读 财富自由 思考与随笔 搜索
Text Matrix
搜索 技术笔记行业快讯视频精读财富自由思考与随笔

 量化

2026

Qwen 3.6 27B 是本地开发的甜蜜点:一份 226 行实测译文 + 工程化拆解 06-30
ML Systems Notes 精读:数据移动为何比计算慢 100 倍——一位工程师的量化、分布式与 Roofline 实战笔记 06-20
turbovec 深度拆解:基于 Google TurboQuant 的 Rust 量化向量索引,10× 内存压缩、SIMD 跑赢 FAISS 06-16
turbovec 深度解析:基于 Google TurboQuant 的 Rust 向量索引,10M 文档从 31 GB 砍到 4 GB,比 FAISS 还快 06-08
AirLLM 完全指南:4GB 显存跑 70B 模型,单 GPU 玩转大模型推理 06-04
LongLive 2.0:NVlabs 长视频生成基础设施,45.7 FPS 实时推理 05-24
TurboQuant+ 深度解读:LLM KV 缓存极限压缩的工程实践 04-23
AI 量化交易从 0 到 1:ai-quant-book 多智能体量化系统导读 04-23
llama.cpp:104k Stars 纯C/C++实现的高效LLM推理框架 04-06
关于 · 隐私政策 · 联系
由 Hugo 强力驱动 | 主题 - LoveIt
 TextMatrix