博客
关于 GPU、LLM、MLOps、Kubernetes 以及心态的文章 · 855 篇
#2026-03 168#ai 112#llm 90#ai-papers 62#career 60#kubernetes 57#mindset 51#ai-platform 48#devops 45#security 43#deep-learning 35#performance 33#psychology 32#mlops 30#observability 29#2026-04 26#linux 24#database 23#robotics 22#rust 22#ai-agent 21#mcp 20#productivity 20#culture 19#evaluation 19#gpu 18#transformer 18#electronics 17#paper-review 17#pytorch 17#developer-tools 16#distributed-systems 16#engineering 16#learning 16#open-source 16#postgresql 16#rag 16#fundamentals 15#network 15#2026-08 14
Rust 枚举、模式匹配与错误处理 ♪ 可收听
Rust 里既没有 null 也没有异常。取而代之的是 Option 和 Result 这两个枚举,以及安全地拆解它们的模式匹配。本文用示例梳理 enum 与代数数据类型、穷尽(exhaustive)的 match、if let 与 let else、用 ? 运算符传播错误,以及用 thiserror 和 anyhow 设计实战错误类型的方法。
2026-07-02 · 18 分钟阅读 #rust#error-handling#pattern-matching前线部署工程师(FDE)是什么 ♪ 可收听
梳理 Palantir 让其大众化、如今又在 OpenAI、Anthropic 等 AI 公司的解决方案团队里重新火起来的前线部署工程师(FDE)这一角色。所谓 FDE,是被派驻到客户那里、把软件工程、产品、解决方案、外加一点销售与咨询混在一起、把客户真正的问题解决到底的人。本文梳理它与 SWE、SE、PM、咨询顾问的区别,以及为什么 AI 让 FDE 这个角色重新变得不可或缺。
2026-07-02 · 12 分钟阅读 #career#engineering#fde支付幂等性:如何防止重复扣款 ♪ 可收听
网络迟早会断开,一旦断开,客户端就会重试。可在支付场景里,重试可能变成重复扣款。幂等键、去重窗口、唯一约束、重试与超时问题、给 at-least-once 投递加上 dedup、把支付建模为状态机,直到 Stripe 风格的幂等性实现 — 本文梳理了如何让一笔钱只被扣一次。
2026-07-02 · 22 分钟阅读 #payments#idempotency#reliability输入 URL 并按下回车之后会发生什么:从浏览器到像素的全链路巡礼 ♪ 可收听
在地址栏敲入 URL、按下回车的那一秒里,究竟发生了多少事情。从 URL 解析,到带着递归查询与多层缓存的 DNS 解析、TCP 三次握手、TLS 握手、HTTP 请求与响应,再到 HTML 解析和关键渲染路径。这是一趟从浏览器一路走到第一个像素的全栈巡礼。
2026-07-02 · 17 分钟阅读 #networking#web#fundamentalsRust 的 trait、泛型与 trait 对象 ♪ 可收听
trait 是 Rust 的接口,而且不止于此。trait 与接口的区别、泛型约束(trait bound)、静态分派与 dyn trait 对象(动态分派)之间的权衡、关联类型、覆盖实现(blanket impl),以及 derive 宏 — 本文以示例为中心梳理 Rust 的抽象化工具。
2026-07-01 · 16 分钟阅读 #rust#traits#generics复式记账账本:设计一套永不丢钱的会计系统 ♪ 可收听
一项 600 年历史的会计技法,为什么会是现代支付系统的心脏。借方=贷方、不可变的 append-only 记录、账户与余额、「直接搞一个余额字段不行吗」的答案、对账(reconciliation)、像 TigerBeetle 这样的专用账本,以及并发之下的一致性 —— 如何设计一套永不丢钱的系统。
2026-07-01 · 24 分钟阅读 #payments#ledger#accounting#databases如何阅读别人写的代码
开发者花在读代码上的时间远多于写代码,但读代码这件事却从来没人教。找到入口点,不逐行阅读而是追踪数据,把测试和类型当作文档,用 grep 和 IDE 跳转画出调用图,实际跑起来打印调试,再改点东西看看什么会坏掉。这是一份快速掌控陌生代码库的实战策略。
2026-07-01 · 18 分钟阅读 #code-reading#engineering#onboarding#fundamentalsSOTA 3D 视觉解析 — 单目深度与 3D 高斯溅射
梳理 3D 视觉的 SOTA 脉络。围绕单目深度估计(相对深度与度量深度)与 Depth Anything 系概念、立体与 MVS 概览,以及从 NeRF 到 3D 高斯溅射一路演进的实时渲染,从表示、学习、应用的角度,以架构原理为中心展开分析。
2026-06-30 · 37 分钟阅读 #ai-papers#3d-vision#monocular-depth#gaussian-splatting#nerfSOTA 实时视频分析 — 追踪、理解、高效推理 ♪ 可收听
梳理实时视频分析的 SOTA 走向。围绕架构原理,本文考察行动识别、物体追踪、时间分割等视频理解任务,SAM 2 系列的视频分割与追踪概念,基于 Transformer 的视频模型,以及通过轻量化与流式处理实现的实时推理优化。
2026-06-30 · 37 分钟阅读 #ai-papers#video-understanding#object-tracking#sam2#action-recognitionSOTA 视频生成模型解析 — 时空扩散 Transformer ♪ 可收听
从时空潜在补丁与扩散 Transformer 的视角,梳理视频生成的根本难题 — 时间一致性与计算成本。本文围绕 Sora 提出的概念与后续模型系列,以架构为中心分析条件化、评估与物理一致性方面的局限。
2026-06-30 · 13 分钟阅读 #ai-papers#video-generation#diffusion-transformer#spatiotemporal#text-to-videoSOTA 分割·检测模型解析 — SAM、DETR 与 YOLO 的谱系 ♪ 可收听
梳理目标检测与图像分割的 SOTA 谱系。以架构原理为主线,从两阶段的 R-CNN 到单阶段的 YOLO/SSD,再到基于 Transformer 的 DETR,串起检测的发展脉络;同时覆盖语义、实例、全景分割,直至开启可提示分割的 Segment Anything(SAM)。
2026-06-30 · 33 分钟阅读 #ai-papers#computer-vision#object-detection#segmentation#samSOTA 文本嵌入模型解析 — 检索与 RAG 的心脏 ♪ 可收听
文本嵌入是检索与 RAG 系统的心脏。本文梳理对比学习与 InfoNCE、双编码器、难负例、E5/BGE/GTE 系列、Matryoshka 表征学习、MTEB 基准,直至最新嵌入模型的原理与实务应用。
2026-06-30 · 29 分钟阅读 #ai-papers#embedding#retrieval#rag#contrastive-learningSOTA 音乐·音频生成分析 — 神经编解码器与生成模型 ♪ 可收听
从音频表示方式(波形·频谱图·神经编解码器)到自回归音频语言模型、基于扩散的音频、文本-音乐条件化,以谱系为中心进行梳理。从架构角度分析 EnCodec、MusicGen、AudioLM 系列的原理,以及商用模型、评估与著作权争议。
2026-06-30 · 13 分钟阅读 #ai-papers#audio-generation#music-generation#neural-codec#audio-language-modelSOTA 图像生成模型分析 — 从扩散模型到 FLUX ♪ 可收听
以谱系为中心,梳理文本-图像生成的最前沿:从扩散模型原理到潜在扩散、DiT、rectified flow,再到 FLUX 系列。通过架构原理、对比表和图解,分析 SOTA 模型之间共同的结构与差异。
2026-06-30 · 16 分钟阅读 #ai-papers#diffusion-models#text-to-image#latent-diffusion#rectified-flowSOTA多模态LLM解析 — 用一个模型看、听、说 ♪ 可收听
一个只用文本训练出来的LLM,是如何走到能够理解并生成图像、音频乃至视频的?本文梳理了各模态的编码器与投影器、统一token空间、any-to-any流程、原生多模态与适配器拼接两种路线的对比,以及训练策略、基准测试与局限性。
2026-06-30 · 37 分钟阅读 #multimodal-llm#any-to-any#vision-language#audio#architectureRust 智能指针:Box、Rc、Arc、RefCell 与内部可变性 ♪ 可收听
Rust 仅凭所有权规则难以表达的情形,智能指针能够解开。把值放到堆上的 Box、共享所有权的 Rc 与线程安全的 Arc、把编译期借用规则移到运行期的 RefCell 与 Mutex 的内部可变性、Deref 强制转换,以及用 Weak 切断 Rc 造成的循环引用泄漏的方法——全部通过示例来掌握。
2026-06-30 · 17 分钟阅读 #rust#memory#systems代码中的命名:最难的简单事 ♪ 可收听
"计算机科学中只有两件难事:缓存失效,以及命名"这句玩笑话里藏着几分真心。本文梳理好名字为什么应当揭示意图而非实现、名字长度与作用域的关系、为什么要避免匈牙利命名法、可搜索性、布尔值/函数/集合的命名惯例,以及把重命名当作一次独立重构来对待的方法。
2026-06-30 · 13 分钟阅读 #clean-code#engineering#fundamentalsDB 事务与隔离级别完全解析
ACID 到底保证了什么,四种隔离级别(read uncommitted → serializable),每种级别允许出现的异常现象(脏读、不可重复读、幻读,以及写偏斜),MVCC,锁与乐观并发控制,SELECT FOR UPDATE,以及 PostgreSQL 与 MySQL 默认值的差异。从实战角度梳理事务为什么难、以及它到底守护了什么。
2026-06-30 · 22 分钟阅读 #databases#transactions#acidFDE 打法手册:用「可丢弃原型」取胜 ♪ 可收听
前向部署工程师(FDE)如何在几天之内,在客户的真实数据上做出能跑起来的演示,从而扭转局面。刻意留下、注定要丢弃的技术债,先排除风险的 spike,什么时候该硬编码,以最短路径抵达「aha 时刻」,期望管理,以及从原型迁移到生产环境。本文整理了一份在一线验证过的 FDE 原型开发打法手册。
2026-06-30 · 14 分钟阅读 #engineering#prototyping#fdeSOTA 自动驾驶感知解析 — BEV、Occupancy、端到端 ♪ 可收听
梳理自动驾驶感知的最新趋势。从感知-预测-规划-控制的技术栈、BEV 多摄像头融合、occupancy network 的 3D 占用表示、视觉中心与激光雷达融合之争,到端到端学习与世界模型,逐一审视其架构原理。
2026-06-30 · 30 分钟阅读 #ai-papers#autonomous-driving#bev#occupancy-network#end-to-end