博客
关于 GPU、LLM、MLOps、Kubernetes 以及心态的文章 · 855 篇
#2026-03 168#ai 112#llm 90#ai-papers 62#career 60#kubernetes 57#mindset 51#ai-platform 48#devops 45#security 43#deep-learning 35#performance 33#psychology 32#mlops 30#observability 29#2026-04 26#linux 24#database 23#robotics 22#rust 22#ai-agent 21#mcp 20#productivity 20#culture 19#evaluation 19#gpu 18#transformer 18#electronics 17#paper-review 17#pytorch 17#developer-tools 16#distributed-systems 16#engineering 16#learning 16#open-source 16#postgresql 16#rag 16#fundamentals 15#network 15#2026-08 14
Cursor 实战指南:把 Background Agent、Memories、Bugbot、worktree 变成团队习惯的方法
Cursor 实战指南 — 围绕 Background Agent、Memories、Bugbot、worktree,把 Cursor 真正落地到日常开发中。涵盖引入判断、团队规则、rollout 策略。
2026-04-12 · 7 分钟阅读 #cursor#background-agent#bugbot#memories#worktreeLlamaIndex Workflows 实战指南:把事件驱动 agent 与 RAG 带到生产环境的方法
LlamaIndex Workflows 实战指南 —— 从事件驱动设计、observability、human-in-the-loop、LlamaDeploy 的角度进行整理,同时涵盖该在什么时候使用、以及如何落地到生产环境。
2026-04-12 · 9 分钟阅读 #llamaindex#workflows#agent-workflow#rag#observabilityOpenAI、Azure、AWS 企业级 Agent 可观测性与评估比较指南
对比 OpenAI、Azure、AWS 在 Agent 可观测性、评估、仪表盘、OpenTelemetry 集成上的差异,并为平台、产品、基础设施团队整理了一份做出上线决策的实务指南。
2026-04-12 · 5 分钟阅读 #openai#azure#aws#observability#evaluation用 Cloudflare Agents 与 Durable Objects 构建 AI 应用的实战指南 ♪ 可收听
一篇 2026 年的实战指南,讲清楚 Cloudflare Agents 与 Durable Objects 如何应用在 AI 产品上、为什么状态与长时间运行的任务如此重要、它与 stateless serverless 有何不同,以及一份可直接落地的上线检查清单。
2026-04-12 · 13 分钟阅读 #cloudflare#cloudflare-agents#durable-objects#ai-agent#mcp托管智能体平台对比指南:OpenAI AgentKit vs Azure AI Foundry Agent Service vs Amazon Bedrock AgentCore
基于官方文档,对截至 2026-04-12 的三个托管智能体平台进行实用对比,涵盖产品适配、治理、工具链、部署与上线检查清单。
2026-04-12 · 7 分钟阅读 #ai-platform#managed-agents#agent-platform#comparison#openaiCloudflare AI Gateway 实战指南: 观测和控制 AI 流量最快的方法
以 2026 年 4 月为基准,从实务角度梳理为什么要用 Cloudflare AI Gateway、能做哪些控制、以及应该如何搭配使用 Dynamic Routing 与自动重试。
2026-04-12 · 9 分钟阅读 #ai-platform#cloudflare#ai-gateway#observability#cachingOpenAI Responses API 与 Agents SDK 实战指南:2026 年团队重新规划架构的方法 ♪ 可收听
以 2025 年 3 月 11 日发布的 OpenAI Responses API 与 Agents SDK 为基准,从实务角度梳理哪些团队应该继续使用 Chat Completions、哪些团队应该转向 Responses API,以及 Assistants API 用户该在何时准备好哪些工作。
2026-04-12 · 17 分钟阅读 #openai#responses-api#agents-sdk#ai-agent#chat-completionsGemini 2.5 开发者实战指南:如何选择 Pro、Flash 与 Flash-Lite
本文以 2025 年 3 月 25 日发布的 Gemini 2.5 为基准,从实务角度梳理 Pro、Flash、Flash-Lite 该如何选择、reasoning 模型如何改变工作流,以及团队实际应该部署什么。
2026-04-12 · 9 分钟阅读 #google#gemini#gemini-2-5#coding#agentic-codingOpenAI AgentKit 与智能体评估工作流:数据集、轨迹评分、提示词优化实战指南 ♪ 可收听
以 2025 年 10 月 6 日发布的 OpenAI AgentKit 为基准,从实务角度梳理如何将基于数据集的评估、轨迹评分、自动提示词优化串联进运营工作流。
2026-04-12 · 15 分钟阅读 #ai-platform#agentkit#agent-evals#trace-grading#prompt-optimizationGPT-5 开发者实战指南:智能体编程、工具调用与成本优化 ♪ 可收听
本文以 2025 年 8 月 7 日发布的 GPT-5 为基准,从实务角度梳理开发者需要做出哪些改变、该如何选择模型规模与控制参数,以及如何把智能体编程与成本优化放在一起设计。
2026-04-12 · 13 分钟阅读 #openai#gpt-5#coding#agentic-coding#tool-use用 Vercel AI SDK 6 和 AI Gateway 构建多模型应用:2026 实战指南 ♪ 可收听
基于 2025 年 12 月 22 日发布的 Vercel AI SDK 6 与 AI Gateway,从实务角度梳理 2026 年设计多模型架构的方法,以及 fallback、provider routing、human approval、Next.js 落地清单。
2026-04-12 · 13 分钟阅读 #ai-platform#ai-sdk#ai-gateway#multi-model#fallbacks深度研究智能体实战指南:2026 年开发者与知识工作者该如何使用 ♪ 可收听
一份 2026 年实战指南,帮助你把 OpenAI 深度研究直接用于实际工作 —— 从概念和重要性,到提示词模式、MCP 集成、常见陷阱与检查清单,一次梳理清楚。
2026-04-12 · 13 分钟阅读 #deep-research#ai-agent#mcp#chatgpt#research-workflowClaude Code 团队工作流实战指南:安全运行终端优先 Agent 的方法
以 Claude Code 的终端优先工作流为基准,从实务角度梳理团队应如何划分使用 settings、memory、subagents、hooks,以及它与以 GitHub 为中心的后台 agent 有何不同。
2026-04-12 · 6 分钟阅读 #anthropic#claude-code#terminal-ai#subagents#hooksAI 网关平台比较指南:Vercel AI Gateway vs Cloudflare AI Gateway vs Amazon Bedrock AgentCore Gateway
一份截至 2026-04-12 的 AI 网关层实务比较,说明 Vercel AI Gateway、Cloudflare AI Gateway 与 Amazon Bedrock AgentCore Gateway 在技术栈中各自的位置。
2026-04-12 · 6 分钟阅读 #ai-platform#ai-gateway#comparison#vercel#cloudflare提示词缓存实战指南:让 Agent 应用的成本与延迟一起降下来 ♪ 可收听
梳理为什么提示词缓存在 Agent 应用里很重要、OpenAI 与 Anthropic 的差异、提示词结构化模式、ROI 判断方法、常见错误,以及迁移清单,全部从实务角度整理。
2026-04-12 · 13 分钟阅读 #prompt-caching#latency#cost-optimization#ai-agent#llmopsGitHub Copilot 编码代理实战指南:将云端后台任务安全引入团队的方法
本文以 GitHub Copilot 编码代理最新的 Cloud Agent 工作流程为基准,梳理团队应该在哪些场景使用它、哪些场景不该用、需要哪些护栏,以及应该如何与 Claude Code 这类以终端为先的代理分工使用。
2026-04-12 · 9 分钟阅读 #github#copilot#coding-agent#cloud-agent#pull-requestAzure AI Foundry Agent Service 实战指南:2026 年企业部署判断标准
这是一份从企业视角梳理 Azure AI Foundry Agent Service 的实战指南,说明为什么需要管理型智能体、如何利用工具目录和远程 MCP 服务器,以及如何以 tracing、evaluation、governance、private networking 为基准判断部署方案。
2026-04-12 · 7 分钟阅读 #azure#azure-ai-foundry#agent-service#ai-agent#mcpOpenAI RFT 与自定义评分器:面向产品和平台团队的实践指南
一份关于 OpenAI 强化微调(RFT)搭配自定义评分器的实践指南,涵盖何时该用它、如何准备数据、如何评估检查点,以及如何安全地上线。
2026-04-12 · 9 分钟阅读 #ai-platform#openai#rft#reinforcement-fine-tuning#custom-gradersGemini CLI 实战指南:如何判断是否要采用以终端为先的 AI 智能体
从 2026 年的时间点出发,梳理 Gemini CLI 与以 IDE 为先的工具有何不同,plan mode、hooks、MCP、脚本化对实际开发流程意味着什么,以及如何在团队里安全地落地它。
2026-04-12 · 11 分钟阅读 #gemini-cli#google-gemini#terminal-ai#ai-agent#mcpAmazon Bedrock AgentCore 实践指南:如何在 2026 年构建安全的生产级智能体 ♪ 可收听
Amazon Bedrock AgentCore 面向需要安全、可用于生产的智能体的团队,本文详细介绍 Runtime、Memory、Gateway、可观测性,以及上线前的检查清单。
2026-04-12 · 12 分钟阅读 #aws#bedrock#agentcore#ai-agent#mcp