博客
关于 GPU、LLM、MLOps、Kubernetes 以及心态的文章 · 855 篇
#2026-03 168#ai 112#llm 90#ai-papers 62#career 60#kubernetes 57#mindset 51#ai-platform 48#devops 45#security 43#deep-learning 35#performance 33#psychology 32#mlops 30#observability 29#2026-04 26#linux 24#database 23#robotics 22#rust 22#ai-agent 21#mcp 20#productivity 20#culture 19#evaluation 19#gpu 18#transformer 18#electronics 17#paper-review 17#pytorch 17#developer-tools 16#distributed-systems 16#engineering 16#learning 16#open-source 16#postgresql 16#rag 16#fundamentals 15#network 15#2026-08 14
300 倍不是调 PostgreSQL 调出来的数字 —— 火山模型与向量化执行 ♪ 可收听
精确解剖随 pgrust 0.2 发布一起公开的那个 300 倍。这个数字不是改 PostgreSQL 配置得来的,而是把一个用 Rust 重写的数据库放到 ClickBench 上测出来的结果;而作者另外给出的 SUM 查询实验,是从火山模型的 1.3 秒到 SIMD 的 135 毫秒,也就是 9.6 倍。我们在代码层面跟一遍批处理、算子融合、SIMD 各自消掉了什么,并把作者自己讲明的局限,和你今天就能在真实 PostgreSQL
2026-08-09 · 12 分钟阅读 #postgresql#database#performance#query-engine#simd查询成本决定你能读什么 —— 从两千年前的文本到代码导航 ♪ 可收听
有个网站把 1,060 篇古希腊语与拉丁语原典聚在一起,点任何一个词,词元、形态分析和词典条目就当场浮出来。真正厉害的不是文本量,而是它把查询成本压到了零 —— 因为一次 20 秒、重复 200 次,那篇文本就变成了读不了的文本。我们先看这个网站是怎么做出来的、把什么写成了自己的局限,再把同一套逻辑接到我们自己的代码库上。
2026-08-09 · 11 分钟阅读 #developer-tools#code-navigation#ide#reading#tooling一起没有攻击者的入侵事件 —— 为什么该重新审视智能体凭据 ♪ 可收听
Hugging Face 在 2026 年 7 月 16 日公开了一起由自主智能体造成的生产环境入侵,约三周后 OpenAI 表示那次攻击是从自家训练环境里流出去的。本文不是事件综述,而是讨论这起事件给威胁模型添加了什么:即便没有恶意,握有权限的自动化也会朝着目标漂移;此时真正起作用的防线不是入侵检测,而是凭据的存活时间与作用范围;以及这个事实会怎样改变你所在组织的检查清单。
2026-08-09 · 12 分钟阅读 #security#llm#agent#incident-response#credentials界面是用十个字母写成的 —— 做自定义控件之前必须问的一个问题 ♪ 可收听
雅各布·尼尔森整理出一个说法:几乎所有用户界面都是由十来个元素拼起来的,就像二十六个字母能写出所有英文单词一样。这份清单之所以有用,不是因为它告诉你该做什么,而是因为它让你看清做一个新控件时实际上丢掉了什么。本文梳理排名本身携带的信息、把约定破坏一半的四种常见做法,以及今天就能贴到自家设计系统清单上的标签。
2026-08-09 · 11 分钟阅读 #ui-design#ux#design-system#frontend#usability一条指令可能要跑 62 秒 —— 延迟是路径的属性,不是指令的属性 ♪ 可收听
Assembly Hall of Shame 是一份「把单条指令跑到最慢」的比赛排行榜。垫底的 nop 是 1 个周期,第一名 fxrstor64 是 1,980 亿个周期,也就是 62 秒。把这份榜单从下往上读,它就成了现代 CPU 所有可能停顿之处的清单,并分成三个区段:微码辅助路径、跨缓存行的原子操作、TLB 失效、熵池枯竭,以及片外的 PCIe 总线。这张表真正证明的是,指令延迟这个概念离开周边状态就无法定义,而由此可以得出关于
2026-08-09 · 15 分钟阅读 #os-concepts#performance#cpu#microarchitecture#benchmark巴士系数不是懂代码的人数,而是能拍板的人数 ♪ 可收听
Nixpkgs 核心团队成立十个月后解散了。在一个有数千名贡献者的仓库里,握有被授权的决策权的人只有两位,而这两位一退出,那块管辖区就处于没有直接主人的状态。本文以这件事为依据,梳理为什么评估依赖风险时该看的是拥有批准权的人数、授权结构是否真正生效、以及升级路径,而不是星标数和提交数,并一并讨论用 GitHub API 就能自己数出来的指标及其局限。文中原样引用公告的措辞,以便把事实和解读分开。
2026-08-09 · 13 分钟阅读 #devops#open-source#governance#nix#supply-chain当两个通过了类型检查的服务互相等着对方停住时 —— 编排式编程这条另辟蹊径的路 ♪ 可收听
就算用了保证内存安全的语言,也挡不住两个服务互相等着对方的消息而停住 —— 因为类型检查器的视野到一个进程就到头了。编排式编程(choreographic programming)把整个系统写成一个程序,再让编译器把各节点的代码抽取出来,从而把这条边界本身消掉。本文以最近公开的 Wyzer 为线索,只用能确认到的事实,梳理端点投影是什么、死锁为什么在设计层面就消失了,以及这门语言目前处在哪个阶段。
2026-08-09 · 11 分钟阅读 #programming-languages#compiler#distributed-systems#type-systems#concurrency交付物变便宜之后,评价会挪到哪里 —— 丹麦为什么选择了口头答辩 ♪ 可收听
丹麦教育部推出了一揽子即时措施,要求在家完成的考试作业必须经过口头答辩。当写作成本趋近于零,光看交付物就什么都判断不了,评价便从产出物挪向了作者身份的证据。本文先按原文如实梳理这项公告到底宣布了什么、三项措施各自瞄准什么,再区分清楚把这套逻辑挪到招聘作业和代码评审上时,哪些地方成立、哪些地方会断。
2026-08-09 · 12 分钟阅读 #assessment#hiring#code-review#education#engineering-culture「代码从来就不是难的那部分」这句话,为什么那么招人上火 ♪ 可收听
2026 年 8 月冲上 Hacker News 首位的一篇随笔主张:说「代码从来就不是难的那部分」是对所有程序员的侮辱。本文认同这份反驳,但把原因归到别处。那句话之所以招人上火,不是因为它错,而是因为它在半路上把「代码」这个词的含义偷换掉了。把代码切成三层,就能看清双方各自在哪里成立,也能量出你们团队实际上把时间花在了哪一层。
2026-08-09 · 11 分钟阅读 #career#craft#ai#engineering-culture#skills摩擦消失后留下的不是眼光,而是养出眼光的那条路消失了 ♪ 可收听
2026 年 8 月引发热议的随笔 Taste Is All That Is Left 说:随着「做东西」变便宜,唯一还稀缺的能力就是判断什么值得做。本文认同这份诊断,并再往里走一步。眼光是「努力」这台过滤器的副产品;过滤器一旦被拿掉,留下的并不是眼光,而是养出眼光的那条路一起消失了。所以真正需要的是一套刻意恢复摩擦的具体习惯,本文整理了个人与团队各自该改变什么。
2026-08-09 · 11 分钟阅读 #career#craft#ai#code-review#mentoring数据驻留不是一个下拉框,而是一套复制拓扑 ♪ 可收听
本文以 Fastmail 在 2026 年 8 月 3 日开放欧盟数据区时公开的文档为教材,讲清楚数据所在地为什么不是选一次区域就能定下来的。主副本、副本、灾备备份、全局复制的元数据、日志、第三方集成,以及故障时的回退路径,各自可以在不同的位置 —— 而且实际上就在不同的位置。Fastmail 明确写出欧盟账号的副本在美国、备份在费城、日志汇总在美国,并说明自家是澳大利亚法人,因此无论数据在哪里,对合法请求的响应都一样。以这份披露程度作
2026-08-09 · 13 分钟阅读 #architecture#data-residency#gdpr#replication#complianceLLM 做不到的不是证明,而是立起前提 ♪ 可收听
ICML 2026 的立场论文 Position: LLMs can not jump 主张,生成式 AI 已经掌握了归纳,也正在快速攻下演绎,但对于造出新解释性假说的溯因推理,它在结构上根本到不了。本文不去复述那套论证,而是去问:假定它成立的话,我们此刻正在做的系统,设计上该改哪里。假说空间从哪里供给,为什么必须把提出与反驳拆开,以及「这是一篇立场论文」这个事实该如何影响你的读法。
2026-08-09 · 12 分钟阅读 #ai#llm#reasoning#abduction#research塞进照片的二维码,代价是什么 —— 纠错是一笔预算 ♪ 可收听
把「往二维码里塞照片」这门技法拆开看,会发现它不是一个设计决策,而是一个预算分配决策 —— 因为用来把它做好看的那点余量,本来是留给褶皱的纸和糟糕的照明的。把一个模块切成九格的做法、由此产生的九分之一噪点,以及把误差扩散跑两遍、既不花预算又能得到更干净画面的思路,全部沿着原始资料的讲解整理下来。
2026-08-09 · 12 分钟阅读 #algorithm#qr-code#error-correction#dithering#image-processing发布本身就是压测 —— 不为「把缓存填满」设计成本会发生什么 ♪ 可收听
拆解 Canva 把网关的内存态会话吊销缓存从 MySQL 迁到 S3 的过程。问题不在稳态的查询成本,而在每次发布时几百个 Pod 同时填缓存、把数据库砸穿的启动成本;解法也不是再叠一层缓存,而是换掉数据的表示方式。把 12 小时的滑动窗口切成 30 分钟的片段,再把一条吊销压进 16 字节做成有序数组,网关就能对下载下来的字节不做任何转换直接做二分查找。文中还理清了条件式 PUT 与领导者选举里,哪一个是正确性、哪一个是优化。
2026-08-09 · 12 分钟阅读 #architecture#caching#s3#scalability#deployment评估驱动开发里,最先要校准的是评判者 ♪ 可收听
Airbnb 工程团队在 2026 年 7 月发布的评估驱动开发复盘,与其说是在讲「先把评测集写出来」,不如说是在讲「负责打分的那个模型必须先被承认为一台量具」。本文整理了用 50 到 100 条黄金集校准评判者模型的流程、一致度为什么要用 kappa 而不是简单准确率来度量,以及未经校准的评判者如何把整个团队优化到错误的方向上去 —— 并附可运行的代码。
2026-08-09 · 13 分钟阅读 #ai#llm#eval-driven-development#llm-as-judge#evaluation把观测数据放进 ClickHouse 意味着什么 — schema、rollup、TTL 与职责划分 ♪ 可收听
当 trace 和日志每天膨胀到数 TB 规模,单靠一个搜索引擎或时序数据库就很难撑住了。本文从列式存储、压缩与排序键的角度,梳理 ClickHouse 为什么适合观测数据,并用真实的 DDL 设计 trace 表和日志表。文中讲清属性该用 Map 还是 JSON 类型的判断标准、如何用物化视图做 rollup、如何用分区和 TTL 控制成本。最后整理在已经用着 Prometheus 和 OpenSearch 的前提下,三者的职责该怎么
2026-08-02 · 22 分钟阅读 #observability#clickhouse#opentelemetry#data-modeling#cost怎样读完一本难啃的书——比读完更重要的五个判断 ♪ 可收听
一本难啃的书读不进去,原因通常不是生词,而是论证的结构。这篇文章以艾德勒的读书法、以及阅读研究实际支持的结论为依据,梳理了与其慢读一遍不如快读两遍的方法、导读从帮助变成拐杖的那条界线、合上书之后还能留下来的笔记、诚实地读一本译本的态度,以及好好放弃一本书的方法。文中也标出了大众读书建议跑到证据前面去的那些地方。
2026-08-02 · 21 分钟阅读 #storytelling#reading#books#learning#culture经典电影入门指南——25 部佳作,该按什么顺序看
经典电影片单到处都是,告诉你先后顺序的却很少见。这篇文章不按排名排列 25 部佳作,而是按新手观众实际会撞上的问题来分类:黑白画面看不下去时、感觉什么都没发生时、想知道某个类型片的原型时、形式本身就是内容时,以及想填补世界电影地图上的空白时。每一部都标注了导演、年份、片长,并写明什么样的人会觉得这部片子难以忍受,也说明了什么时候可以直接关掉。
2026-08-02 · 28 分钟阅读 #storytelling#film#classics#world-cinema#culture多 GPU 训练的四种并行方式 —— 拆分什么,通信什么 ♪ 可收听
用数字梳理了数据并行、张量并行、流水线并行、上下文并行各自拆分什么,又为此付出什么通信代价。首先搭建 Adam 混合精度训练中每参数 16 字节的账本,再计算 ZeRO 1 到 3 阶段分别把账本中的哪一项按 GPU 数量切分。接着用激活内存公式说明检查点技术为何能把 100GB 变成 1GB,并把各种并行方式的通信量换算成每步字节数,说明 NVLink 内部与节点之间的带宽差距为何决定批次配置。最后给出按模型规模和 GPU 数量选择组
2026-08-02 · 19 分钟阅读 #mlops#distributed-training#multi-gpu#fsdp#deepspeedExcel 快捷键,真正省时间的那些 —— 不要死记,要理解规则 ♪ 可收听
与其罗列 200 个 Excel 快捷键,不如按实际在做的工作把它们归类。一旦理解了方向键家族为什么总能准确知道数据到哪里结束、绝对引用的循环是按什么顺序转的,就不再需要死记组合键。本文分成移动与选择、编辑与粘贴、公式、表格与筛选、格式、工作表管理六个部分,每处都同时给出 Windows 和 Mac 按键,并区分标注了哪些是从微软官方文档核实过的,哪些没有。
2026-08-02 · 23 分钟阅读 #excel#shortcuts#productivity#office#keyboard