博客
关于 GPU、LLM、MLOps、Kubernetes 以及心态的文章 · 855 篇
#2026-03 168#ai 112#llm 90#ai-papers 62#career 60#kubernetes 57#mindset 51#ai-platform 48#devops 45#security 43#deep-learning 35#performance 33#psychology 32#mlops 30#observability 29#2026-04 26#linux 24#database 23#robotics 22#rust 22#ai-agent 21#mcp 20#productivity 20#culture 19#evaluation 19#gpu 18#transformer 18#electronics 17#paper-review 17#pytorch 17#developer-tools 16#distributed-systems 16#engineering 16#learning 16#open-source 16#postgresql 16#rag 16#fundamentals 15#network 15#2026-08 14
3.3V 与 5V,以及电平转换:树莓派 GPIO 扛不住 5V ♪ 可收听
把 5V 传感器直接接到树莓派 GPIO,引脚就会报废。这篇文章从逻辑电平的定义出发,解释背后的原因。讲清楚 VIH 和 VIL 这两个阈值是什么,为什么 3.3V 输出接到 5V 输入大体上能读到,而反过来绝对不行,过压进来时芯片内部的静电保护二极管实际会发生什么。接着老老实实地比较电阻分压、MOSFET 双向电平转换和专用电平转换 IC 各自的优缺点,并单独讲开漏结构、情况不同的 I2C。
2026-07-31 · 28 分钟阅读 #electronics#raspberry-pi#arduino#hardware#iot写给程序员的欧姆定律:用数字理解电压、电流和电阻 ♪ 可收听
一份写给第一次接触 Arduino 或树莓派的软件工程师的欧姆定律指南。把电压重新定义为两点之间的差,而不是一个「量」,并指出水流类比在哪里成立、又在哪里失效。用真实数字手算串联和并联电路,并说明如何把基尔霍夫两大定律当作测量工具来用。还会讲电阻为什么会发热、如何选定额定功率,以及用万用表测电压和电流的实际步骤,包括几乎每个人都会中招一次的烧保险丝的错误。
2026-07-31 · 27 分钟阅读 #electronics#arduino#circuit#hardware#maker上拉、下拉与悬空引脚:为什么一个按钮会这么难搞 ♪ 可收听
从「什么都没接的输入引脚为什么会在 0 和 1 之间随机跳动」讲起。解释悬空输入为什么会表现得像天线,上拉和下拉电阻如何解决这个问题,以及不同板子上内部上拉的实际阻值究竟是多少。用真实数字算出按钮为什么习惯接成低电平有效,以及挑选外部电阻值时抗噪能力与耗电量之间的取舍。最后讲开关抖动的真实波形、RC 硬件消抖,以及不使用 delay 的正确 Arduino 消抖代码。
2026-07-31 · 29 分钟阅读 #electronics#arduino#raspberry-pi#circuit#hardware驱动电机、继电器与感性负载:为什么不能直接用 GPIO 带动电机 ♪ 可收听
GPIO 引脚只能输出几十毫安,而一个小型直流电机却要求几百毫安。这篇文章逐一拆解这个差距会引发的各种事故:如何使用独立电源、为什么必须把地线接在一起,用晶体管或 MOSFET 开关时如何计算基极电阻和栅极电阻,感性反冲电压为什么能达到几千伏的物理原因,以及续流二极管在其中扮演的角色。最后用数字说明,电机每次转动都让主板重启,这为什么不是代码问题。
2026-07-31 · 32 分钟阅读 #electronics#arduino#hardware#maker#iotLED 限流电阻计算全解:为什么每种颜色的阻值都不同,以及 E24 系列 ♪ 可收听
从二极管的指数型电流曲线出发,说明为什么 LED 必须串联一个电阻。用表格整理各颜色的正向电压,并针对 5V 和 3.3V 两种电源分别算出真实的电阻值。文章讲解为什么必须把计算值向上取整到 E24 标准值、电阻上消耗的功率有多少,以及多颗 LED 共用一个电阻并联时会发生什么。最后整理了引脚电流超限时,从纯电阻切换到晶体管或驱动 IC 的判断标准。
2026-07-31 · 28 分钟阅读 #electronics#arduino#circuit#hardware#raspberry-pi把 TCP 拥塞控制看出来 — CUBIC 与 BBRv3,以及跑在浏览器里的 gVisor 网络栈 ♪ 可收听
2026 年 7 月 28 日,Hacker News 上出现了「Simulating TCP loss and congestion in browser using Go/WASM」。它把两套 gVisor 网络栈整个编译成 WebAssembly,放进浏览器 worker 里跑,中间夹一条带宽、时延、丢包率和队列规律都可调的瓶颈链路,然后把 CUBIC 和作者自己实现的 BBRv3 并排画出来。本文以这个模拟器为切入口,梳理 sl
2026-07-31 · 23 分钟阅读 #network#tcp#congestion-control#bbr#wasm在浏览器中模拟系统 — WASM 实现了什么,又还卡在哪里 ♪ 可收听
2026 年 7 月底登上 Hacker News 的 ccsim,把 gVisor 用户态 TCP 协议栈的两份完整实现编译成 WebAssembly,整套跑在浏览器的 worker 里。v86 把 x86 CPU 实时编译(JIT)成 WASM 来启动 Windows 98,WebVM 则在 CheerpX 之上运行未经修改的 Debian。本文梳理这些浏览器模拟器共有的模式与限制:没有原始套接字这一事实如何把设计分成两条路线,Sh
2026-07-31 · 22 分钟阅读 #webassembly#wasm#simulation#browser#systems2026年自托管部署平台怎么选 —— 划分 Coolify、Dokploy、CapRover、Kamal、Openship 的五个维度 ♪ 可收听
Openship —— 一款自带 CI/CD 的自托管部署平台 —— 登上 GeekNews,老问题又被带回来了:要不要离开托管式 PaaS,自己运维?本文用真正决定结果的五个维度 —— 控制平面归属、回滚路径、密钥处理方式、多节点行为、运维负担 —— 来比较 Coolify、Dokploy、CapRover、Kamal 2、Openship,以及纯 compose 组合。文中给出每款工具的实际命令与配置,并算一算自托管到底是用什么换掉
2026-07-31 · 19 分钟阅读 #self-hosting#deployment#paas#kamal#coolify平均值什么也说明不了——如何用分布调试延迟 ♪ 可收听
2026 年 7 月 27 日发布、登上 Hacker News 榜首的 Farid Zakaria 文章《The mean means nothing》,讨论了这样一种情形:部署缓存层之后,平均延迟从 112ms 恶化到 122ms,上升了 9%。而在同一份数据中,p50 从 99ms 改善到 54ms,下降了 46%;p99 则从 309ms 恶化到 678ms,上升了 119%。同一份数据之所以能同时支持两个截然相反的结论,是因为
2026-07-31 · 22 分钟阅读 #observability#latency#performance#histogram#percentile重构的经济学:什么时候能回本 — 用变更频率计算 ♪ 可收听
2026年7月30日发布在martinfowler.com上的The Economic Benefit of Refactoring一文,对一个约1.7万行的模块进行了15步重构,每一步都重新执行同一个变更请求,测得输入token从159,564个降到27,360个,减少了83%。这是个有意思的实验,但作者本人明确指出这只是单次实验,而且只针对一个绿地(greenfield)应用。本文把这个实验和既有证据(Tornhill与Borg针对
2026-07-31 · 22 分钟阅读 #refactoring#engineering#technical-debt#ai#metrics用 500 美元微调的 9B 赢过前沿模型的条件 — 以及这些条件有多窄 ♪ 可收听
2026 年 7 月 28 日,Hacker News 上有一篇拿到 336 分的文章。Fermisense 用 GRPO 训练 Qwen3.5-9B,只花了约 500 美元的 GPU 时间,就在电商目录审核任务上,用同样的工具和同样的评分器,赢过了五套前沿模型配置。可达成分数的 87.3% 对最高前沿配置的 76.9%,处理 1,000 条的成本约 0.50 美元,对 19 到 172 美元。本文既不否定也不放大这个结果,而是把条件拆
2026-07-31 · 16 分钟阅读 #ai#llm#fine-tuning#reinforcement-learning#inference-cost单体仓库 CI 缓存策略 — 别扩容缓存,要修的是缓存键 ♪ 可收听
单体仓库 CI 慢,大多数时候不是因为缓存太小,而是因为缓存键错了。本文梳理 Turborepo、Nx、Bazel、GitHub Actions 各自的缓存都往哈希里塞了什么、收窄哈希输入的三个抓手、如何靠 affected 判定干脆不执行、CI 与开发者共享远程缓存时出现的信任边界,以及 2026 年一起真实的缓存投毒事故为什么本质上是个 hermeticity(封闭性)问题。最后讲讲怎么不掺水、老老实实地衡量命中率。
2026-07-31 · 21 分钟阅读 #monorepo#ci-cd#build-cache#turborepo#bazel一篇挂着假作者的论文被接收为口头报告 —— AI 时代同行评审的系统性失败分析 ♪ 可收听
2026 年 7 月 30 日,两位审稿人公开表示,他们今年夏天审的 22 篇机器学习会议投稿中,有 15 篇存在伪造引用、虚构作者,或明显的 LLM 生成痕迹。其中两篇把真实论文的作者姓名换成了假名字,尽管给出了拒稿意见并向组委会举报,这两篇论文最终仍以"只需修正幻觉参考文献"为条件被接收为口头报告。本文不把这件事当成一个值得愤怒的八卦来读,而是当作一次系统性失败来分析:标记流程实际抓住了什么,投稿量激增和强制互审如何挤压整条流水线,
2026-07-31 · 22 分钟阅读 #ai#peer-review#research-integrity#llm#academia才能这个幻象 — 练习研究究竟说了什么,以及什么才真正以复利积累 ♪ 可收听
2026年7月底,《才能这个幻象》登上了GeekNews的前列。光看标题像是一场关于才能与练习的科学争论,但原文其实是一篇讲初级开发者职业焦虑的个人随笔,全文没有引用任何一项研究。本文沿着真实的文献往下走:埃里克森1993年的论文主张了什么、又没有主张什么,麦克纳马拉元分析给出的方差解释率12%与2018年勘误改正后的14%,2019年重复实验的失败,以及瑞典双胞胎研究抛出的那个最令人不适的反证 — 全都用数字摆出来。在此之上,能够诚实
2026-07-31 · 22 分钟阅读 #career#deliberate-practice#expertise#psych-papers#mindset工程师该如何读懂 Go-to-Market 打法手册 —— 渠道胜过产品质量的地带 ♪ 可收听
2026 年 7 月底,GeekNews 上出现了 NFX 的《升级版 Go-to-Market 打法手册》。这是一篇由 VC 撰写的观点文章,里面的数字是精心挑选的个案,而不是样本。本文把这份打法手册翻译给技术读者:渠道在哪些地带真正胜过产品质量、面向开发者的自助转化真实转化率是多少(面向开发者的产品,中位转化率只有非开发者产品的一半)、"time to first value" 与"文档即漏斗"这类说法是否有真实数据支撑、PLG 为
2026-07-31 · 21 分钟阅读 #startup#go-to-market#product-led-growth#developer-tools#career用提示词生成 3D CAD 这件事 —— 网格与 B-rep 之别,以及约束条件这个瓶颈 ♪ 可收听
GeekNews 的 Show GN 板块上出现了一个叫 CAID 的工具,能用提示词生成 3D CAD 模型。作者自己坦承的局限,恰好精准概括了整个领域的现状 —— 没有自动尺寸校验,无法判断公差、DFM 和可加工性,而且明确说明输出只是一个已验证的原型,不能直接用于制造。从工程角度看,问题只有一个:CAD 是参数化、基于约束的系统,"生成一个网格"和"生成一个带有可编辑特征、真正可制造的模型"是完全不同的两件事。本文梳理 B-rep
2026-07-31 · 19 分钟阅读 #ai#cad#llm#manufacturing#geometry当开源治理崩溃时 — Ruby Central 之争与三根支柱 ♪ 可收听
2026 年 7 月 30 日,André Arko 发布《Ruby Central 的破坏性遗产》,让始于 2025 年 9 月的 RubyGems 仓库访问权限之争,在十个月后再度浮出水面。本文将双方的第一手陈述并列呈现,梳理出一条可核实的时间线,然后从结构层面分析为什么同样形态的危机会在 core-js、event-stream、xz-utils、Nix、Redis、Terraform 身上反复出现。核心是三根支柱 —— 商标归谁
2026-07-31 · 24 分钟阅读 #open-source#governance#rubygems#supply-chain#licensing26B 模型跑在 2GB 内存里的原理 — 常驻内存和工作集不是同一个数字 ♪ 可收听
2026 年 7 月 29 日发到 Show HN 上的 TurboFieldfare 声称,能在 M 系列 Mac 上用约 2GB 内存跑 Gemma 4 26B-A4B。磁盘上装的是 14.3GB,常驻内存里的只有 1.35GB 的共享核心,每个 token 需要的专家权重从 SSD 读进来。本文不照搬这些数字,而是自己推导并核对 — 4 比特分组 64 量化为什么会变成每权重 4.5 比特、从而落到 14.2GB,路由专家与共享核
2026-07-31 · 16 分钟阅读 #ai#llm#quantization#apple-silicon#moeGPT-5.6 与性价比的极限 — 如何在曲线上找到自己负载的位置 ♪ 可收听
OpenAI 在 2026 年 7 月 30 日把 GPT-5.6 Luna 降价 80%、Terra 降价 20%。距离 7 月 9 日正式发布只有三周,而最顶端的 Sol 价格不变。Luna 从每 100 万 token 输入 1 美元、输出 6 美元,变成输入 0.20 美元、输出 1.20 美元。本文不介绍降价幅度,而是计算这条曲线 — 降价后三个档位的单价比在两个轴上都恰好锁定为 25 比 10 比 1,因此在同一系列内部 t
2026-07-31 · 17 分钟阅读 #ai#llm#openai#inference-cost#prompt-cachingGCC 的 AI 政策与开源世界的选择 —— 15 行这条边界线到底想守住什么 ♪ 可收听
2026 年 7 月 29 日,GCC 指导委员会通过了 AI 政策工作组的建议。核心内容是:具有法律意义的贡献如果包含 LLM 生成内容或衍生自这类内容,将不予接受,判定基准线大致沿用 GNU 维护者指南里的约 15 行。不过测试用例是个例外,把 LLM 用于调研、分析、发现 bug、审查补丁本身并不受限制,只是 AI 辅助的工作需要附上 Assisted-by 标签。本文梳理这项政策实际要求了什么、其背后的版权转让与 DCO 问题、
2026-07-31 · 19 分钟阅读 #ai#open-source#gcc#licensing#governance