博客
关于 GPU、LLM、MLOps、Kubernetes 以及心态的文章 · 855 篇
#2026-03 168#ai 112#llm 90#ai-papers 62#career 60#kubernetes 57#mindset 51#ai-platform 48#devops 45#security 43#deep-learning 35#performance 33#psychology 32#mlops 30#observability 29#2026-04 26#linux 24#database 23#robotics 22#rust 22#ai-agent 21#mcp 20#productivity 20#culture 19#evaluation 19#gpu 18#transformer 18#electronics 17#paper-review 17#pytorch 17#developer-tools 16#distributed-systems 16#engineering 16#learning 16#open-source 16#postgresql 16#rag 16#fundamentals 15#network 15#2026-08 14
什么该学深,什么该略过 — AI 什么都能答的时代,如何制定学习策略 ♪ 可收听
AI 3 秒就能答出几乎一切的时代,什么该学深,什么该略过。认知心理学给出的答案并不讨喜。造就记忆的不是看见信息这一行为,而是自己把它提取出来这一行为。在 Roediger 与 Karpicke 的实验中,把文章平均通读 14.2 遍的一组,一周后只记住了 40%,而只读了 3.4 遍、却靠自己回想的一组记住了 61%。而且,记得更少的那一组反而对自己更有信心。把提取外包给 AI,最后留下的恰恰只有那份信心。本文提出的不是一份书单,而是
2026-07-12 · 20 分钟阅读 #career#learning#ai#software-engineering从 Senior 到 Staff — 工程师的成长中,真正被评估的是什么 ♪ 可收听
很多工程师相信,写得更多、更快就能晋升。可当你真的翻开公开的工程师职级阶梯 — Dropbox、CircleCI、Rent the Runway — 会发现哪里都没有“产出量”这个轴。有的是范围(Scope)、协作半径(Collaborative Reach)和影响力杠杆(Levers for Impact)。本文以 Will Larson 归纳的 Staff 工程师四种原型(Tech Lead、Architect、Solver、Rig
2026-07-12 · 19 分钟阅读 #career#software-engineering#growth#staff-engineerAI 真的让开发者更快了吗 — 被测量出来的数字说了什么
两项随机对照试验给出了截然相反的答案。一项说用了 AI 的开发者快了 55.8%,另一项说慢了 19%。可是给出后一个数字的 METR,在 2026 年 2 月发布后续研究的同时,亲手在 2025 年的结果上挂起了一条警告横幅:它已经不再反映当下 AI 模型的影响。故事并没有就此消失,反而变得更锋利 — 因为连后续实验都被参与者的自我选择偏差绊住,无法确定效应的符号。而且有一项发现始终没有被撤回:那些慢了 19% 的开发者,在做完实验之
2026-07-12 · 29 分钟阅读 #career#ai#productivity#software-engineering#developer-experience2026 年开发者招聘市场 — 数据说了什么,又没说什么 ♪ 可收听
体感是最差的,BLS 却预测未来十年增长 15%。两者都是真的。我直接取来 Indeed 招聘广告指数的原始数据(2020 年 2 月 = 100,2022 年 2 月高点 233.87,2026 年 6 月 72.51)、layoffs.fyi(截至 2026 年 7 月共 120,936 人)、BLS 2024–34 年预测、报告初级岗位下降 16% 的 Stanford 论文,以及正面反驳它的 EIG 报告,逐一对照。核心结论是:
2026-07-12 · 16 分钟阅读 #career#job-market#software-engineering#hiring与 AI 编程工具良好协作的五个习惯 ♪ 可收听
同一件工具,在一个实验里带来了 55.8% 的收益,在另一个实验里造成了 19% 的损失。改变符号的不是工具,而是用法。从 METR、GitHub Copilot 的 RCT、Stack Overflow 调查以及 Anthropic 的智能体设计文档中提炼出的五个习惯 — 任务选择、评审预算、机器护栏、上下文设计、自我度量。每一个都以一条你能亲手验证的规则收尾。
2026-07-12 · 16 分钟阅读 #ai#productivity#software-engineering#developer-experiencetts-bench:当质量主观时,如何比较本地 TTS
tts-bench 是开发者 5uck1ess 打造的本地基准测试,让你在手头的硬件上比较 55 个 TTS 模型。它把评测拆成三个视角:速度(TTFA、RTF、内存)、试听(用耳朵判断每一个模型)、评分(UTMOS、WER、SIM)。最有意思的是它对主观性的坦诚——没有一个"最好听"的单一分数,因为质量取决于你的耳朵和用途。本文梳理这个工具实际测量什么,客观指标在哪里有帮助、在哪里会误导,以及如何为自己的工作负载挑选合适的 TTS。
2026-07-11 · 8 分钟阅读 #tts#text-to-speech#benchmark#local-ai#evaluation即使 AI 来维护你的代码,也要为人类而写
2026 年 7 月 10 日,Scott Robinson 把一句老格言拧了个弯,让它重新焕发生机。由于 LLM 会把你的代码库当作风格指南来读,你合并进去的每一条捷径,都会成为模型以机器规模回敬给你的训练数据。在梳理了重复的访问权限检查示例,以及他那句“LLM 是海绵”之后,本文抛出一个更难的问题:当下一个维护者是机器时,为人类而写是否依然重要?依然重要。因为人类仍要评审和调试,而正是清晰让 diff 变得可评审。
2026-07-11 · 10 分钟阅读 #ai#llm#code-quality#maintainability#craft实践斯多葛主义 — 古老的人生智慧为何至今依然奏效 ♪ 可收听
斯多葛主义是公元前300年前后诞生于雅典的哲学,但它的核心工具与今天的焦虑竟出奇地契合。本文依据爱比克泰德、塞内卡、马可·奥勒留的实际文本,梳理控制的二分法(取决于我的与不取决于我的)、专注过程而非结果、预先设想最坏情况(premeditatio malorum)、自愿的不适、记住终有一死等实践。同时也点明诚实的局限 — 斯多葛主义不是压抑情绪,不是万灵药,也不是心理健康治疗的替代品。这不是自我提升的口号,而是每天都能一点点用起来的工具
2026-07-11 · 13 分钟阅读 #philosophy#stoicism#self-improvement#life-adviceTencent Hy3:冷静解读 295B 开放权重 MoE
Tencent 于 2026 年 7 月 6 日以 Apache 2.0 许可证公开了 Hy3。这是一个总参数 295B、每次仅激活 21B 的 MoE 推理·智能体语言模型。本文梳理它到底有什么新意、在中国系开放权重浪潮中处于什么位置,以及厂商自行公布的基准测试数字应当相信到什么程度。
2026-07-11 · 8 分钟阅读 #hy3#tencent#hunyuan#open-weights#moeVO2 max 与寿命 — 122,007 人真正告诉我们的事
心肺适能(VO2 max)是与寿命关联最强的指标之一。在克利夫兰诊所追踪 122,007 名成年人的 2018 年研究中,适能越高,死亡风险越低,而且这种益处没有观察到上限。不过这是相关而非因果,也不是针对个人的医学建议。本文不加夸张地梳理 VO2 max 究竟测量什么、为什么在 Zone 2 的基础上加一点高强度就能提升它,以及这些数据我们该相信到什么程度。
2026-07-11 · 11 分钟阅读 #fitness#health#longevity#vo2max#scienceRLHF 模型为何会钻奖励的空子——奖励破解的机制、症状与缓解方向
Xiaohua Wang 等 23 人于 2026 年 4 月发布在 arXiv 上的《Reward Hacking in the Era of Large Models》,是一篇梳理经 RLHF 对齐的大型模型为何、如何在奖励信号上钻空子的综述。核心提议是把奖励破解理解为目标压缩、优化放大、评估者–策略共同进化这三种力量的"代理压缩假说(PCH)"。它把可辨认的症状汇于一处:冗长偏好、谄媚、看似有理却错误的依据、基准过拟合,以及多模态
2026-07-11 · 9 分钟阅读 #ai#llm#alignment#rlhf#safety特斯拉 FSD v14 Lite 登陆韩国 — 把模型"蒸馏"进旧款 HW3,以及"监督型"这个诚实的名字
2026 年 7 月 10 日,特斯拉韩国开始在国内推送 FSD(监督型)v14 Lite。对象仅限美产 Model 3、Model Y 中搭载旧款 HW3 计算机的车辆。本文梳理:"Lite" 并非营销等级,而是把面向上位 HW4 的模型蒸馏进旧硬件的结果;韩国为何比加拿大、欧洲更早拿到,这一点为何耐人寻味;以及与名字相反,这依然是由驾驶员负责的 Level 2 辅助这一诚实现实。不夸张,只为准确地使用"自动驾驶"这个词。
2026-07-11 · 10 分钟阅读 #tesla#fsd#autonomous-driving#adas#hw3npm 供应链攻击为何挥之不去 — npm-scan 实际做的事,以及真正有效的防御 ♪ 可收听
npm 生态系统的供应链攻击不是偶发的意外,而是从安装脚本、传递依赖、typosquatting 这些结构中反复冒出来的。2025 年的 Shai-Hulud 蠕虫借助安装脚本自我繁殖,窃取 npm 令牌和云端密钥。最近在 Hacker News 上引发热议的 npm-scan,声称要用本地的静态与行为分析来抓住这个问题。本文以 README 为依据,厘清 npm-scan 究竟检查什么、又无法验证什么,并梳理锁文件、拦截安装脚本、pr
2026-07-11 · 12 分钟阅读 #npm#supply-chain#security#javascript#nodejs成功的公司是如何失明的 — 工程组织的能力失明
Ian Reppel 的文章指出,成功的公司会陷入他所称的"能力失明(competence blindness)"状态。就像墨西哥洞穴鱼主动抑制自己的眼睛一样,由于环境不再给予回报,公司也不再表现出那种细致的工程能力。这不是单纯的放任,而是主动的抑制,也与经典的颠覆式创新不同。本文先忠实地转述这一主张,再看它如何在工程组织中显现:无人敢质疑的遗留系统、现实在腐烂时却依然一片绿色的仪表盘,以及像瘢痕组织一样僵化的流程。
2026-07-11 · 14 分钟阅读 #engineering-culture#organizations#legacy#metrics#leadership在浏览器标签页里组装并运转一台发动机 — 拆解 Combustion Lab
Combustion Lab(combustionlab.net)是一款无需安装、在浏览器标签页里组装内燃机并按曲轴转角来运转的模拟器。它把进气、压缩、燃烧、排气四个冲程用 P–V 曲线和测功图呈现出来。本文梳理单区热力学模型能捕捉什么、又捕捉不到什么,以及为什么把实时物理放到浏览器里运行会成为一个很好的学习工具。
2026-07-11 · 10 分钟阅读 #simulation#thermodynamics#webassembly#physics#engine力量训练的基本功 — 基于证据,真正重要的那几件事
真正让人变强所需的原则其实屈指可数 — 渐进超负荷、大的复合动作、足够的训练量、蛋白质、恢复。本文依托经过同行评审的荟萃分析与权威指南(ACSM、WHO,以及 Morton、Schoenfeld、Refalo 等人的研究),只把这些核心提炼出来。对局部减脂、“肌肉混淆”、“女性练力量就会变壮”之类常见的误区,也用证据加以厘清,并附上初学者今天就能上手的简单框架与安全须知。本文志在成为一份不搞营销、也不讲“兄弟科学”的朴实参考。
2026-07-11 · 10 分钟阅读 #fitness#strength-training#health#exercise#evidence-basedModel Context Protocol(MCP)参考手册 — 将 AI 连接到外部世界的开放标准
Model Context Protocol(MCP)是一个把应用向 LLM 提供上下文的方式标准化的开放协议。本文是一份基于官方文档、面向工程师的 MCP 参考 — 为什么它能解决 M×N 集成问题,主机、客户端、服务器结构与两个层(数据/传输),三种服务器原语(工具、资源、提示),stdio 与 Streamable HTTP 传输。还涵盖了如何设计服务器,以及安全性、成熟度上诚实的取舍。
2026-07-11 · 10 分钟阅读 #mcp#ai#agents#llm#protocol爬虫如今来自数百万个家庭 IP — residential proxy 与开源基础设施的消耗战
2026年7月10日,LWN 的 Jonathan Corbet 发布了一篇爬虫现状的更新。核心有两点 — residential proxy(家庭代理)几乎让基于 IP 的封禁彻底失效,而 AI 爬虫的激增填满了这份需求。在一次攻击中,数小时内数百万个不同的 IP 各自只敲击站点两三次。本文诚实地梳理为什么封禁在结构上注定失败、开源 git 仓库为什么最先中招(以及 Anubis 为什么在那里诞生),以及工作量证明、CAPTCHA、数
2026-07-11 · 10 分钟阅读 #web-scraping#residential-proxy#ai-crawlers#anubis#infrastructureRTX 5090 单卡亲手跑几个小模型 — microGPT·OCR·音乐生成
用一张 RTX 5090(Blackwell,32GB),通过 SSH 连上去直接跑了三个小模型。从零开始用 28 秒训练出一个 char-level GPT(10.75M 参数,117 万 tokens/s),把专用 OCR(TrOCR)和小型 VLM(Qwen2-VL-2B)放到同一张图上用 CER 一决高下,再用 MusicGen 在 1.9 秒(实时的 4.2 倍)里生成一段 8 秒的音乐。连同过程中遇到的那些诚实的陷阱 — 没
2026-07-11 · 10 分钟阅读 #pytorch#gpu#llm#ocr#hands-onPlayStation 三年未使用账户删除条款:服务条款实际规定了什么,以及数字所有权问题 ♪ 可收听
2026年7月,"PlayStation 三年不登录就会删除你的全部数字游戏(EU 条款)"这一标题引发热议。实际读一读索尼的欧洲和英国服务条款第21条便会发现,这并不是挑出游戏来删除,而是一条"36个月未使用的账户可在6个月警告后关闭"的裁量条款;它自2019年就已存在,且未确认到实际的执行案例。本文冷静地梳理服务条款字面上规定了什么、这个标题真正指向的"数字购买不是所有权,而是可撤销的许可"这一问题,以及消费者权利与游戏保存一方的应
2026-07-11 · 12 分钟阅读 #digital-ownership#playstation#drm#consumer-rights#licensing