博客
关于 GPU、LLM、MLOps、Kubernetes 以及心态的文章 · 855 篇
#2026-03 168#ai 112#llm 90#ai-papers 62#career 60#kubernetes 57#mindset 51#ai-platform 48#devops 45#security 43#deep-learning 35#performance 33#psychology 32#mlops 30#observability 29#2026-04 26#linux 24#database 23#robotics 22#rust 22#ai-agent 21#mcp 20#productivity 20#culture 19#evaluation 19#gpu 18#transformer 18#electronics 17#paper-review 17#pytorch 17#developer-tools 16#distributed-systems 16#engineering 16#learning 16#open-source 16#postgresql 16#rag 16#fundamentals 15#network 15#2026-08 14
SOTA 语音识别与合成解析 — 从 Whisper 到编解码器语言模型 ♪ 可收听
梳理语音识别(ASR)与语音合成(TTS)的最新趋势。从 HMM 到 CTC/注意力机制,从 Whisper 的大规模弱监督学习,到 Tacotron、神经声码器与编解码器语言模型,逐一审视其脉络与架构原理。
2026-06-30 · 30 分钟阅读 #ai-papers#speech-recognition#text-to-speech#whisper#neural-codec机器人基础模型 — 一个策略应对多种任务 ♪ 可收听
本文梳理机器人基础模型这一潮流——它试图用一个策略应对多种机器人、多种任务。我们会依次看通用策略的概念、Open X-Embodiment 这类大规模机器人数据、跨具身、与 VLA 的关系、扩展(scaling)视角,以及数据、安全、评估这三大课题,全程配以图示。
2026-06-29 · 34 分钟阅读 #ai-papers#robotics#foundation-model#generalist-policy#open-x-embodiment世界模型 — 机器人如何在头脑中想象未来 ♪ 可收听
解释世界模型的概念(学习环境动力学),涵盖基于模型的强化学习、潜在空间预测、视频预测与生成模型在机器人上的应用、通过想象 rollout 与 MPC 进行规划,以及在行走与操作上的应用与当前局限,并用图示加以整理。
2026-06-29 · 29 分钟阅读 #ai-papers#robotics#world-models#model-based-rl#planning机器人之眼 — 3D 感知与 SLAM ♪ 可收听
本文讲述机器人如何看世界。我们会依次介绍 RGB-D、LiDAR、立体相机等传感器,SLAM 流水线,点云与体素,6D 姿态估计,基于深度学习的感知,以及 NeRF 与 3D 高斯溅射,用代码和图示把机器人感知的全貌梳理一遍。
2026-06-29 · 28 分钟阅读 #ai-papers#robotics#slam#3d-perception#pointcloud人形机器人全身控制 — 双腿行走,双手操作 ♪ 可收听
从人形机器人双腿行走到用手操作物体,本文梳理双足行走控制与全身控制(whole-body control)的核心概念。我们结合图示,依次讲解 ZMP 与 MPC、基于强化学习的运动控制(locomotion)、平衡与跌倒恢复、行走与操作的整合,以及把仿真中学到的策略迁移到实机的流程。
2026-06-29 · 34 分钟阅读 #ai-papers#robotics#humanoid#locomotion#whole-body-control机器人安全与对齐 — 如何信任强大的机器人 ♪ 可收听
我们要如何信任日益强大的机器人?本文从物理安全、约束强化学习与安全层、分布偏移应对、人机协作安全、验证与标准,直到具身 AI 的对齐难题,进行一次均衡的梳理。
2026-06-29 · 31 分钟阅读 #ai-papers#robotics#safety#alignment#reinforcement-learning从人类视频中学习的机器人 — 网络规模数据的梦想 ♪ 可收听
机器人能从人处理物品的视频中学习吗。本文梳理了可供性与轨迹、领域差距、表征学习与预训练、单样本模仿、网络视频规模化、以及与机器人数据的结合,并诚实地列出案例与局限。
2026-06-29 · 33 分钟阅读 #ai-papers#robotics#imitation-learning#representation-learning#video机器人如何学习 — 模仿学习与强化学习 ♪ 可收听
概览机器人习得技能的四种方式,深入剖析模仿学习(遥操作、行为克隆、DAgger)与强化学习(奖励、策略、探索)的原理、优缺点、数据效率上的差异,以及如何将两者结合,并用图示与对比表加以梳理。
2026-06-29 · 28 分钟阅读 #ai-papers#robotics#imitation-learning#reinforcement-learning#robot-learningSim-to-Real — 把仿真中学到的东西带入现实 ♪ 可收听
分析仿真中学到的机器人策略为何在现实中崩溃的原因(现实差距),讲解域随机化、域适应、系统辨识、数字孪生等应对手法,以及触觉、摩擦等难以复现的物理因素,还有 zero-shot 迁移的可能性与局限,并配以图示和案例说明。
2026-06-29 · 28 分钟阅读 #ai-papers#robotics#sim-to-real#domain-randomization#digital-twin异步 Rust:async/await 与 Tokio 运行时 ♪ 可收听
Rust 的 async 和其他语言的路数不一样。Future 只是一个懒惰的状态机,没有执行器去轮询它,什么都不会发生。本文梳理 Future 的本质、.await 的含义、Tokio 运行时与任务/spawn、Send + 'static 约束、异步 trait、用 select! 处理并发,以及为什么绝不能把阻塞和异步混在一起。
2026-06-29 · 16 分钟阅读 #rust#async#tokio正则表达式从零到自信:字符类·量词·锚点·分组·环视·ReDoS 全面精通 ♪ 可收听
如果正则表达式一直看起来像密码,就用这篇文章把它理清楚。从字符类、量词、锚点、分组、选择到环视,逐一搭建构成要素,再讲清楚贪婪匹配与懒惰匹配的区别、灾难性回溯与 ReDoS,以及不该使用正则表达式的时刻(解析 HTML)。
2026-06-29 · 16 分钟阅读 #regex#programming#fundamentals有主见的工具 — 代码格式化器与 Linter 的哲学 ♪ 可收听
代码格式化器为何能终结争论、守住一致性。本文比较 gofmt 与 gofumpt、prettier、black、ruff,从实务角度梳理严格与灵活的哲学、与 linter 的区别、CI 强制与 pre-commit、团队引入策略,以及自动化的陷阱。
2026-06-29 · 36 分钟阅读 #devops#formatter#linter#developer-tools#tooling分布式事务:2PC vs Saga 模式 ♪ 可收听
在单一数据库里轻而易举的 ACID,为什么一跨多个服务就会崩溃 — 两阶段提交(协调者、阻塞、失败模式)的原理与局限,Saga 模式(编排 vs 编舞、补偿事务),解决双写问题的发件箱模式,以及最终一致性在实务中到底意味着什么。为微服务时代梳理事务这件事。
2026-06-29 · 21 分钟阅读 #distributed-systems#transactions#sagaDNS 深度剖析 — 名字背后隐藏的基础设施 ♪ 可收听
DNS 不只是一张简单的名片,而是撑起整个互联网的庞大分布式基础设施。本文从层级结构、递归/权威解析、记录类型、TTL 与缓存,一路讲到 Anycast 与 GeoDNS、DNSSEC、DoH/DoT,以实务视角深入剖析隐藏在名字背后的系统。
2026-06-29 · 35 分钟阅读 #network#dns#anycast#cdn#infrastructureAI 代码审查工具的兴起 — 自动化审查正在改变团队 ♪ 可收听
AI 代码审查工具正以开源形式大量涌现,重塑着开发工作流。本文从 Git diff 分析、缺陷检测、规约强制,到与人工审查的角色分工、误报管理、CI 集成,做一次实务视角的梳理。
2026-06-29 · 33 分钟阅读 #devops#ai#code-review#ci-cd#developer-tools触觉感知与精细操作 — 机器人用指尖去感受世界 ♪ 可收听
机器人开始用指尖感受世界。本文结合图示梳理了基于视觉的触觉传感器(GelSight 系列)与电子皮肤、触觉负责的滑移·力·材质感知、视觉与触觉的融合、精细的手内操作,以及触觉的 sim2real 与学习方法。
2026-06-29 · 35 分钟阅读 #ai-papers#robotics#tactile-sensing#manipulation#gelsight用 Rust 构建 Web API:Axum 与 Actix ♪ 可收听
一份用 Rust 构建 Web 后端的实战指南。以示例为主,梳理 Axum 的处理函数、提取器、路由与共享状态,tower 中间件,用 serde 处理 JSON,用 sqlx 连接数据库,健壮的错误处理,以及与另一位代表性竞争者 Actix Web 的比较。
2026-06-28 · 15 分钟阅读 #rust#web#axum#backendExactly-once 是幻觉吗:支付与消息传递的正确性 ♪ 可收听
投递保证的三个等级(at-most-once、at-least-once、exactly-once)究竟意味着什么,为什么 exactly-once「投递」原理上不可能,而 exactly-once「处理」却可以通过幂等性、去重、事务性发件箱来达成,两个将军问题告诉我们的道理,以及 Kafka 的 exactly-once 到底保证了什么。冷静地梳理支付与消息传递的正确性。
2026-06-28 · 22 分钟阅读 #distributed-systems#messaging#reliability像侦探一样读懂日志和堆栈跟踪 ♪ 可收听
堆栈跟踪是案发现场,日志是目击者证词。从上到下读懂堆栈跟踪的方法(一端是出事的地方,一端是起因)、追踪 "caused by" 链条、结构化·JSON 日志、关联 ID 与 traceid、用 grep·jq·ripgrep 挖掘日志,直到日志级别与采样。把日志和跟踪当作证据来对待的侦探技术。
2026-06-28 · 19 分钟阅读 #logging#debugging#stack-trace#observability机器人能看、能听、能动 — VLA 模型 RT-2 与 OpenVLA 评述 ♪ 可收听
视觉-语言-行动(VLA)模型接收摄像头画面和自然语言指令,直接输出机器人的动作。本文以 RT-2、Open X-Embodiment、OpenVLA 为主线,梳理 VLA 范式的思路、架构、动作分词方式,以及优势与局限。
2026-06-27 · 24 分钟阅读 #ai-papers#robotics#vla#rt-2#openvla