Skip to content

Microllin

记录 AI 工程、大模型基础设施与后端系统的拆解笔记。不写速览,只写把一件事讲透的长文——从原理到实现,从踩过的坑到背后的取舍。

技术写作全部文章GitHub
当"做出来"不再稀缺:AI 时代产品经理的能力重估
vibe coding 的造词人在十二个月后弃用了这个词。这篇文章从随机对照实验、大规模开发者调查和一起真实的删库事故出发,拆解 AI 究竟改变了产品经理工作中的哪一部分,哪些能力真正变成了瓶颈,以及哪些"必备素质"其实被严重高估了。
Nginx 从会用到看懂:配置、请求生命周期与内部架构
大多数人对 Nginx 的理解停在"抄一段配置能跑就行"。但 location 为什么这么匹配、proxy_pass 那个斜杠为什么能改变一切、为什么 if 是邪恶的、为什么它能用 4 个进程扛住十万连接——这些答案全在同一套机制里。本文从最小可用配置一路拆到内存池与事件循环。
计算机网络全景图:从一根电缆到一次网页加载
网络知识的难点从来不是某一层有多深,而是它被切成了太多互不相干的碎片——ARP、CIDR、三次握手、TLS、CDN、NAT 穿透,各自都懂一点,却拼不成一张图。本文按分层走一遍全貌,再用一次网页加载把它们串成一条链。
AI Agent 的长期记忆是怎么实现的?拆解 Claude Code 的 memory 机制
服务器端的大模型是彻底无状态的,它不可能"记住"任何人。那 Claude Code 凭什么跨会话记得你的偏好?本文从磁盘布局一路拆到 API 请求体,讲清这套"记忆幻术"的完整实现。
从敲下回车到吐出第一个字:一次 LLM 请求的全链路解剖
你在终端敲下回车,两秒后第一个字出现。这两秒里,文本被切成 token、装进 HTTP 请求体、跨越大洲、在 GPU 上过一遍几十层网络、KV cache 被复用或重建,然后逐字流回来。本文逐字段、逐阶段拆开这条链路。
模型蒸馏全解:从暗知识到在线蒸馏
蒸馏是"让小模型学大模型",但这句话掩盖了太多东西——软标签为什么比正确答案信息量更大、在线蒸馏和 on-policy 蒸馏根本不是一回事、以及一场关于"偷师算不算偷"的真实争论。本文按论文逐层拆开。