Text
Matrix
技术笔记
行业快讯
视频精读
财富自由
思考与随笔
搜索
Text
Matrix
搜索
技术笔记
行业快讯
视频精读
财富自由
思考与随笔
LLM
2026
oMLX:macOS菜单栏管理13k星的LLM推理服务器,连续批处理+SSD缓存
05-11
PageIndex:无向量数据库的推理型 RAG 基础设施
05-08
DFlash:块扩散加速的 LLM 推测解码技术
05-08
2026年提示词工程进阶策略:Expert Panel、Compression Protocol、ReAct 与四层框架
05-06
free-llm-api-resources:免费LLM API资源汇总清单
05-06
HeavySkill 完全指南:测试时 Scaling 的推理增强技术
05-06
DeepSeek-TUI:Rust 终端里的 DeepSeek 编程智能体
05-05
Context Mode:AI 编程 Agent 上下文治理实战——从 40% 污染到零
05-05
TradingAgents 全面指南:多 Agent 大模型金融交易框架从入门到精通
05-02
Dify:开源 Agentic Workflow 开发平台从入门到精通指南
05-02
Open WebUI:开源自托管 AI 界面完全指南——从原理到精通
05-02
Agent 技术全史精读:苏煜为什么把 2026 看成数字智能体的分水岭
05-01
LangFlow: 可视化 AI 工作流编排平台
04-30
Caveman:用山顶洞人语言砍掉 65% Token 消耗
04-30
RTX 3090 本地运行 LLM 实战:vLLM 与 llama.cpp 双引擎对比
04-29
OpenKB:开源 LLM 知识库——无向量检索的长文档处理新范式
04-29
DeepSeek-V3 技术解析:671B 参数开源大模型的工程奇迹
04-27
RTK:Rust 写的高性能 CLI 代理,Claude Code 场景节省 80% Token
04-27
TurboQuant+ 深度解读:LLM KV 缓存极限压缩的工程实践
04-23
Datawhale 大模型基础:从理论到实战的完整 LLM 知识体系
04-23
AutoResearchClaw:全自动 23 阶段研究论文生成管道,从想法到论文的完整实践
04-21
DeepGEMM:深势科技6577 Stars的高性能FP8 GEMM内核库——从入门到精通
04-19
CL4R1T4S:把 AI 系统提示词放到台前的开源档案库
04-19
PrfaaS:跨数据中心LLM服务的革命性架构——KVCache新时代
04-18
DFlash:块扩散模型加速LLM推理——让大模型推理速度提升2-3倍
04-17
Cognee:16K Stars的AI Agent记忆引擎——让大模型拥有持续学习的知识图谱
04-17
Agentic Video Editor:用多智能体架构重新定义视频剪辑
04-17
GenericAgent:仅3K行代码的自我进化Agent框架——6倍Token节省、9个原子工具、Skill树自增长
04-16
《动手学大模型》:上海交通大学31.5K Stars的LLM编程实践教程——微调/提示工程/知识编辑/RLHF全覆盖
04-16
AI 心理学:Anthropic 如何用 171 个情绪向量重新逼近模型内部世界
04-15
1
2
3