博客
关于 GPU、LLM、MLOps、Kubernetes 以及心态的文章 · 855 篇
#2026-03 168#ai 112#llm 90#ai-papers 62#career 60#kubernetes 57#mindset 51#ai-platform 48#devops 45#security 43#deep-learning 35#performance 33#psychology 32#mlops 30#observability 29#2026-04 26#linux 24#database 23#robotics 22#rust 22#ai-agent 21#mcp 20#productivity 20#culture 19#evaluation 19#gpu 18#transformer 18#electronics 17#paper-review 17#pytorch 17#developer-tools 16#distributed-systems 16#engineering 16#learning 16#open-source 16#postgresql 16#rag 16#fundamentals 15#network 15#2026-08 14
DeepSeek V4 Flash 真正改变的是什么 — 这是每单位能力成本的问题,不是排行榜的问题 ♪ 可收听
2026 年 7 月 31 日,DeepSeek 把 V4-Flash API 转为公开测试版。架构和 4 月的预览版完全一样 — 284B 总参数、13B 激活的 MoE,1M 上下文 — 变的只有后训练。官方更新日志公布的分数是 Terminal Bench 2.1 上 82.7、Toolathlon verified 上 70.3,但首先要说清楚的是:这些数字是 DeepSeek 用自家 harness 测出来的厂商自测值。本文不
2026-07-31 · 16 分钟阅读 #ai#llm#deepseek#inference-cost#moe在生产环境里运维 AI 智能体 — 幂等性、预算,以及自信满满的错误答案 ♪ 可收听
把智能体从原型搬到生产环境时,有一片会被很晚才发现的运维表面:被重试的工具调用的幂等性、预算与步数上限、非确定性控制流的可观测性、按工具划分的权限边界,以及智能体自信满满地答错时的升级路径。最近发到 GeekNews Ask GN 上的一份分析,在 6,780 条基准测试轨迹里找到了 8,042 次重复工具执行,其中 159 次是改变状态的工具真的创建出了重复资源。本文以那份数据为起点,梳理该记录什么、该对什么设告警,以及在像第三方 A
2026-07-31 · 24 分钟阅读 #ai#agents#observability#reliability#mcpJava Value Objects(JEP 401)带来的改变 —— 放弃身份标识,得到什么、失去什么 ♪ 可收听
2026 年 7 月 31 日 00:45 UTC,JEP 401 Value Objects 的实现被合并进了 OpenJDK 主线。它与 JEP 539(Strict Field Initialization)打包在同一个提交里,涉及 1,888 个文件、新增约 20.8 万行代码 —— 距离 Project Valhalla 于 2014 年启动,已经过去了 12 年。本文依据 JEP 原文,梳理没有身份标识的对象究竟是什么、性能
2026-07-31 · 22 分钟阅读 #java#jvm#valhalla#jep-401#performanceBun 把 Zig 重写成 Rust 的 11 天 — AI 大规模迁移里真正能带走的东西 ♪ 可收听
本文用一手资料追踪 Bun 在 11 天内把 53.5 万行 Zig 代码迁到 Rust 的整个过程。2026 年 5 月 3 日到 14 日,动用了最多 64 个 Claude 实例、约 50 条工作流、6,502 个提交,按 API 标价折算约 16.5 万美元。本文关心的不是 11 天这个数字,而是让这个数字得以成立的条件 — 一套与语言无关的测试套件充当预言机、文件对文件一一对应的结构保持式翻译,以及编译器这第二位裁判。文章把
2026-07-31 · 19 分钟阅读 #ai#bun#rust#migration#testing蒸馏会迁移什么、不会迁移什么 — 把 DeepSeek 蒸馏进 GPT-OSS,审查没有跟过来 ♪ 可收听
2026 年 7 月 30 日发到 Show HN 上的 CTGT 实验报告说,以 DeepSeek V4 Flash 为教师、GPT-OSS 为学生蒸馏金融推理能力,结果能力过来了,政治审查没有过来。在 152 组配对上,教师在敏感问题与对照组之间表现出 45.45 分的审查落差,而学生只有 0.43 分和 3.94 分,停在基线上。本文不把这一个实验放大,只把它当作起点 — 因为蒸馏复制的是教师的输出分布,所以本文立起一套框架:观测
2026-07-31 · 18 分钟阅读 #ai#llm#distillation#alignment#open-weightsGemini Robotics 2 与机器人基础模型 —— 全身控制真正改变了什么 ♪ 可收听
2026 年 7 月 30 日,Google DeepMind 发布了 Gemini Robotics 2,宣布用一个视觉-语言-动作模型来控制人形机器人,从脚尖到指尖一以贯之。有意思的是,随之公布的数字读起来不像是炫耀,反而更像是对当前状态的诚实记录 —— 拧开灯泡的成功率是 92%,拧上去是 36%,从地板上捡东西是 45.7%。本文梳理 VLA 到底是什么、全身控制为什么比上肢操作更难、跨具身泛化为什么才是真正的瓶颈,以及该怎样正
2026-07-31 · 22 分钟阅读 #ai#robotics#vla#foundation-models#evaluationAI 如何在 6 月一个月内修复两年份的 Chrome 漏洞 —— 读懂 1,072 这个数字
根据谷歌在 2026 年 7 月 30 日发布的公告,仅 6 月发布的 Chrome 149 和 150 两个版本就修复了 1,072 个安全漏洞,超过了过去两年、23 个里程碑版本合计修复的 1,036 个。其中还包括一个在代码库里潜伏了 13 年以上的沙箱逃逸漏洞。本文不追热闹的标题数字,只看背后的机制 —— 从 2023 年基于 LLM 的模糊测试目标生成,到 2024 年的 Naptime、2025 年的 Big Sleep,再
2026-07-31 · 20 分钟阅读 #ai#security#chrome#fuzzing#vulnerabilityGitHub 堆叠 PR 完全指南 —— 原生堆叠 PR 解决了什么,又原样留下了什么 ♪ 可收听
2026 年 7 月 30 日,GitHub 把 Stacked Pull Requests 推进了公开预览阶段。把一次大改动拆成若干个带有依赖顺序的小 PR、并行评审、再一并合并的这套工作流,现在由 Web 界面和 gh-stack CLI 扩展原生提供支持。本文梳理堆叠(stacking)真正解决的问题、GitHub 原生实现做了什么又没做什么、当基础分支发生变化时触发的"变基级联(rebase cascade)"要付出多大代价,以
2026-07-31 · 20 分钟阅读 #github#stacked-pr#code-review#git#developer-workflow用 LLM 搭建企业内部知识库这件事 —— 权限感知检索、新鲜度,以及上线前必须准备的评测集 ♪ 可收听
Cerebras 在 2026 年 7 月 15 日公开的内部知识库搭建记录,揭示了一个日均处理超过 15,000 次查询、由人、自动化脚本和智能体共同调用的系统的内部结构。但企业内部知识库中团队真正容易低估的部分,并不是分块(chunking)或重排(reranking),而是权限、新鲜度、删除传播,以及真相来源(source of truth)的冲突。一个会泄露 HR 文档的搜索,还不如没有搜索;一个自信地引用已经作废的运维手册(r
2026-07-31 · 23 分钟阅读 #ai#rag#enterprise-search#llm#platform-engineering成为管理者的真相 — 这不是在资深工程师之上再加一堆会议 ♪ 可收听
2026年7月底发布在GeekNews上的《成为管理者的真相》,是一篇列出十四条的个人经验随笔。本文从结构上解释这些条目为什么会反复出现。管理者角色的本质不是工作量增加,而是产出函数被整个替换;按照安迪·格鲁夫的定义,当产出变成团队的产出那一刻,反馈循环就从分钟级拉长到季度级,并失去可读性。本文梳理了个人吞吐量这个指标为什么会停止工作、头六个月反复出现的三种失败是什么,以及判断要不要回到IC岗位的标准。文中还记录了追查那条被广泛引用的"
2026-07-31 · 21 分钟阅读 #career#engineering-management#leadership#ic-to-manager#feedback-loop如何解读 2026 年的数据工具地形图 —— 不是工具清单,而是分层决策 ♪ 可收听
2026 年 7 月 28 日,一篇《面向开发者的数据工具地形指南》登上 GeekNews,获得 51 点赞。这是一份不错的地图,但地图不会替你选目的地。本文把同一片地形拆成五个层次,梳理每一层实际要做的决策是什么:表格式之争如何在 Iceberg v3 上事实终结、战场如何转移到目录(catalog)层,DuckDB 级别的单节点引擎如何把原本属于集群的工作拉回本地,Fivetran 与 dbt Labs 的合并对层与层之间的边界意味
2026-07-31 · 24 分钟阅读 #data-engineering#lakehouse#iceberg#duckdb#data-platform终端 UI 开发指南 — Ink、OpenTUI、Bubble Tea、ratatui、Textual:什么时候用什么 ♪ 可收听
shadcn 风格的终端组件集合 termcn 登上 GeekNews,让 TUI 开发再次成为热议话题。本文不罗列框架清单,而是用三种渲染模型 —— Elm 架构、立即模式、React 式协调 —— 来梳理这个生态,讲清楚终端从不主动告知自身能力这一根本问题(真彩色、尺寸、键盘协议的探测),介绍如何应对窗口缩放与画面撕裂(SIGWINCH 与 DEC 2026 同步输出),并给出一个可运行的 Ink 示例。最后总结该选择可管道化的 C
2026-07-31 · 21 分钟阅读 #tui#terminal#ink#opentui#cliMarkdown/MDX 流水线性能 — satteri 与原生内核真正改变了什么 ♪ 可收听
面向 JavaScript 生态的高性能 Markdown/MDX 处理器 satteri 登上 GeekNews 之后,文档站点的构建时间又一次成了热门话题。本文把数千页规模的 MDX 构建中时间实际去了哪里,拆分成解析、转换、编译、打包、预渲染五个阶段,并给出一套用测量代替猜测的性能分析流程。文章讲了为什么 unified/remark/rehype 的插件链会占据成本的大头,像 satteri 这样的 Rust 内核如何改变这一点
2026-07-31 · 21 分钟阅读 #mdx#markdown#build-performance#unified#static-site米切尔·哈希莫托的第二家公司 Superlogical —— 公开了什么,没公开什么 ♪ 可收听
2026 年 7 月 29 日,米切尔·哈希莫托公开了新公司 Superlogical,在 Hacker News 上拿到 776 点赞、452 条评论。第一款产品是一个终端多路复用器,以 MIT 许可证的 libghostty 作为部件。本文抛开粉丝情结,把发布会上实际公开的内容(四人团队、投资人名单、Ghostty 继续保持非营利)与没有公开的内容(融资金额、估值、发布时间表、盈利模式)分开来看,探讨从 HashiCorp 到被 I
2026-07-31 · 21 分钟阅读 #developer-tools#startup#ghostty#terminal#infrastructure用 AI 搬迁代码库的实战流程 — 先把裁判立起来,测评审率而不是行数 ♪ 可收听
本文从 2026 年上半年公开的大规模 LLM 迁移案例(53 万 5 千行 Zig 转 Rust、16 万 5 千行 Python 转 TypeScript)中抽出共同的流程,整理成一份可执行的顺序。关键在于顺序 — 在开始翻译之前先立起行为预言机,并且先确认这台预言机在被故意改坏的代码上真的会亮红灯。然后沿可验证的边界切分成队列,把完成判定交给磁盘状态,让每一步都保持可回退。要测的指标不是转换了多少行,而是人真正读过的差分比例,以及
2026-07-31 · 19 分钟阅读 #ai#migration#refactoring#testing#engineering设计离线镜像导入流水线 —— skopeo、Harbor,以及一份不会过时的重新导入手册 ♪ 可收听
本文设计的是离线(air-gapped)Kubernetes 环境里几乎没人真正做扎实的那个问题 —— 如何反复、安全地把容器镜像带进来。内容涵盖把导入清单当作代码来管理、用 skopeo sync 把外部仓库拉取成目录和 OCI layout 的具体命令、用 oras 搬运任意制品的方法,以及把 Harbor 作为内部分发仓库的双仓库模式。文中也明确指出,Harbor 的代理缓存在没有通往上游的网络路径时完全没用。接下来讲了如何用 o
2026-07-31 · 24 分钟阅读 #kubernetes#air-gap#harbor#skopeo#supply-chain隔离网络 Kubernetes 的 Day 2 运维 — 阻止集群因证书到期而死掉的方法 ♪ 可收听
隔离网络集群真正死掉的原因,大多不是什么华丽的故障,而是证书到期。谁都不去碰它,过了一年 API Server 就悄悄停住,而且没有互联网,连搜索都解决不了。这篇文章讲的是安装之后的事。内容包括在死掉之前就检测到到期的方法、kubeadm 与 k3s 的证书续期及 CA 轮换流程、NTP 漂移同时压垮 TLS 与 etcd 的路径、定时快照与真正演练过的恢复流程、没有上游时用暂存包完成的版本升级、没有 SaaS 后端的可观测性组建,以及
2026-07-31 · 26 分钟阅读 #kubernetes#air-gap#day2-operations#etcd#certificatek3s 隔离网络安装完全指南 — 从镜像 tarball 带入到私有仓库、Agent 加入 ♪ 可收听
按命令逐条梳理在完全没有互联网通路的隔离网络中搭建 k3s 集群的全过程。内容涵盖在连通网络的机器上下载 airgap 镜像 tarball 与 k3s 二进制文件并生成校验和清单、确定带入介质里要装什么、把镜像放到容器运行时目录之后再用 INSTALLK3SSKIPDOWNLOAD 执行安装脚本的整个流程。接着说明如何用 registries.yaml 把内部镜像仓库挂成镜像源、如何让自签名 CA 被信任,以及 Agent 加入与内嵌
2026-07-31 · 27 分钟阅读 #kubernetes#k3s#air-gap#on-premise#containerd1美元赢过20美元的实验 — 认知失调原文与六十年的反驳 ♪ 可收听
先让人做一件无聊透顶的任务,再请他去撒个谎,一组付1美元,另一组付20美元。事后说任务其实更有趣的,是拿钱少的那一组。费斯汀格与卡尔史密斯1959年的论文,每个条件只有20人,评分尺度从负5到正5,规模很小,却改变了社会心理学的走向。我们一路追下去:潜入末日预言团体的记录在方法上的硬伤、贝姆的自我知觉理论这一竞争解释,以及2010年被揭穿的自由选择范式的统计漏洞,看看什么留了下来,什么在动摇。
2026-07-26 · 19 分钟阅读 #psychology#paper-review#social-psychology#decision-making#mindset三幕结构是法则还是惯例 — 故事结构论的谱系及其局限 ♪ 可收听
电影大都在同一个位置转弯,这不是偶然。亚里士多德从未讲过三幕,今天的三幕结构是二十世纪的发明 — 悉德·菲尔德在 1979 年把它钉死在页码上,它才成了行业标准。本文梳理了标准节拍真正承担的功能性工作、布莱克·斯奈德的节拍表让好莱坞变得均质的批评、无需冲突也能运转的起承转合与丹·哈蒙的故事圈这类替代方案,以及比任何结构图都更重要的皮克斯巧合规则。文末还有一个观察练习:随便挑一部电影,在片长的 25%、50%、75% 处按下暂停。
2026-07-26 · 18 分钟阅读 #storytelling#screenwriting#narrative#film#craft