블로그
GPU·LLM·MLOps·쿠버네티스, 그리고 마음가짐에 관한 글 · 3704 편
#2026-03 762#culture 283#deep-dive 275#kubernetes 262#career 233#ai 223#llm 217#devops 198#2026-04 158#security 149#observability 118#database 113#communication 108#history 107#architecture 101#productivity 98#performance 93#linux 90#networking 89#finance 87#economy 84#mindset 80#psychology 79#ai-papers 78#food 78#it 78#travel 78#japanese 76#deep-learning 75#english 74#gpu 74#ai-agent 69#business-travel 69#postgresql 67#cs-fundamentals 63#rag 63#systems 63#python 56#learning 54#self-improvement 53
Content-Encoding: zstd, Safari 26.3으로 3대 엔진이 채워졌다 — 그리고 다음 단계인 RFC 9842 사전 압축
2026년 2월 Safari 26.3이 Content-Encoding: zstd를 지원하면서, Chrome 123(2024-03)·Firefox 126(2024-05)에 이어 3대 브라우저 엔진이 모두 zstd 응답을 받게 됐습니다. 협상 기반이라 도입 리스크는 낮지만, 서버 쪽은 아직 비대칭입니다 — nginx와 Apache httpd에는 공식 zstd 모듈이 없고, 현실적인 경로는 CDN
2026-07-17 · 20 분 읽기 #performance#web#network#browser컨텍스트 엔지니어링은 프롬프트 엔지니어링을 대체한 말인가 — 측정된 것과 아닌 것 ♪ 들을 수 있어요
"프롬프트 엔지니어링은 죽었다"는 문장은 이 용어를 만든 어느 1차 출처에도 없습니다. Karpathy는 few-shot 예제와 태스크 설명을 컨텍스트 엔지니어링의 구성요소로 나열했고, Anthropic은 "프롬프트 엔지니어링의 자연스러운 진전(natural progression)"이라고 썼습니다. 즉 대체가 아니라 포함입니다. 그런데도 이게 진짜 다른 일이라는 근거는 있습니다 — Chrom
2026-07-17 · 37 분 읽기 #llm#context-engineering#prompt-engineering#long-context#ai-agentAI 코딩 에이전트, 무엇을 어떤 일에 쓰는가 — 네 벤더의 공식 문서로만 확인한 선택 기준 ♪ 들을 수 있어요
Claude Code · Cursor · GitHub Copilot · OpenAI Codex 중 무엇을 쓸지 고를 때 가장 많이 묻는 질문은 "뭐가 제일 싼가"입니다. 그런데 네 회사가 공개한 가격만으로는 이 질문에 답이 나오지 않습니다. 사용량을 파는 단위가 넷 다 다르기 때문입니다 — Anthropic은 Pro 대비 배수(5배·20배)로, Cursor는 포함된 API 사용액을 달러로,
2026-07-17 · 42 분 읽기 #ai#ai-coding-agent#claude-code#cursor#github-copilotFlux 2.9와 Weaveworks 이후 2년 — 스폰서를 잃은 GitOps 프로젝트는 어떻게 유지되고 있나
2024년 초 Flux의 원 개발사 Weaveworks가 문을 닫았을 때, GitHub 디스커션에는 "이 프로젝트의 미래는 위험한가?"라는 질문이 올라왔습니다. 2년 반이 지난 2026년 6월 30일, Flux는 2.9.0을 릴리스했습니다. 이 글은 그 사이에 실제로 일어난 일을 검증 가능한 1차 자료로 재구성합니다 — 릴리스 케이던스가 어떻게 흔들렸다 회복됐는지(v2.0부터 v2.9까지 릴
2026-07-17 · 21 분 읽기 #devops#gitops#fluxcd#kubernetes#open-sourceHome Assistant Matter 서버 9.0 — 공식 C++ SDK를 버리고 matter.js로 다시 쓴 이유
2026년 6월 23일, Home Assistant의 Matter 서버가 9.0으로 올라가면서 Python + 공식 C++ SDK(connectedhomeip) 기반 구현이 TypeScript로 처음부터 다시 쓴 matter.js 기반 서버로 통째로 교체됐습니다. 재시작과 재연결이 빨라지고(부분 인터뷰), OTA 업데이트가 컨트롤러에 통합되고, 테스트 인증서 기기의 커미셔닝이 옵트인으로 바뀌
2026-07-17 · 21 분 읽기 #iot#smart-home#home-assistant#matter#thread47일짜리 TLS 인증서까지의 일정표 — SC-081v3 원문으로 확인한 단계별 날짜, Let's Encrypt의 45일 전환, ACME ARI
2026년 3월 15일부터 공개 신뢰 TLS 인증서의 최대 수명은 이미 398일에서 200일로 줄었고, CA/B Forum 투표(SC-081v3)로 확정된 일정에 따라 2027년 3월 100일, 2029년 3월 47일까지 내려갑니다. 더 아픈 쪽은 수명이 아니라 도메인 검증 재사용 기간입니다 — 2029년 3월부터는 10일로 줄어서, 사실상 갱신할 때마다 검증을 다시 해야 합니다. 이 글은
2026-07-17 · 27 분 읽기 #security#tls#certificates#webpki#automationcurl 8.21.0의 CVE 18개 — 버그바운티 폐지 뒤에 온 "고품질 카오스"
2026년 6월 24일 curl 8.21.0은 한 릴리스에 CVE 18개를 발행하며 프로젝트 기록을 새로 썼습니다. 그런데 18개 전부가 Low 아니면 Medium이고, High 등급은 2023년 10월 이후 한 건도 없습니다. 이 숫자 뒤에는 AI 슬롭 보고서에 시달리다 2026년 1월 말 버그바운티를 폐지한 프로젝트가, 3월부터는 정반대로 "거의 전부 AI를 썼는데 품질은 높은" 보고서
2026-07-17 · 26 분 읽기 #network#security#curl#cve#open-sourceAI 에이전트는 프로덕션에서 어떻게 실패하는가 — 14가지 실패 모드, 그리고 재시도가 안전하지 않은 이유 ♪ 들을 수 있어요
에이전트를 프로덕션에 올리면 세 가지가 아픕니다. 첫째, 실패는 모델이 아니라 시스템 설계에서 납니다 — UC 버클리의 MAST 연구는 실행 트레이스 1642건을 분류해 14가지 실패 모드를 뽑았고, 그중 44.2%가 시스템 설계 이슈였습니다. 둘째, 가장 흔한 실패 모드 두 개(단계 반복 15.7%, 종료 조건 미인지 12.4%)가 곧바로 토큰 청구서입니다. 셋째, 바로 그 두 개가 재시도
2026-07-17 · 40 분 읽기 #ai#agents#observability#reliability#mcpAI 에이전트의 메모리는 실제로 어떻게 만드는가 — 네 가지 설계와, 벤치마크가 실제로 증명한 것 ♪ 들을 수 있어요
"에이전트 메모리"는 한 가지 기술이 아니라 최소 네 가지 서로 다른 설계를 뭉뚱그린 말입니다 — 파일 스크래치패드, 요약/컴팩션, 벡터 회수, 지식 그래프. 이 글은 각각이 실제로 무엇을 하는지 제품 문서로 확인하고, 그다음 훨씬 불편한 질문을 던집니다: 어느 쪽이 낫다는 근거가 실제로 측정된 적이 있나? Mem0 논문(arXiv:2504.19413)의 표를 직접 읽어 보면, 헤드라인인 "
2026-07-17 · 38 분 읽기 #ai#ai-agent#agent-memory#llm#benchmarkClickHouse lazy materialization — LIMIT 10짜리 트릭이 FINAL과 JOIN까지 자란 과정
ClickHouse의 lazy materialization은 정렬과 LIMIT이 끝나기 전에는 SELECT 컬럼을 읽지 않는 최적화로, 25.4(2025년 4월)에 LIMIT 10 이하에서만 켜지는 보수적인 기능으로 출발했습니다. 이후 행 단위 lookup을 조인 스타일 일괄 조회로 갈아엎은 25.12에서 게이트가 10,000까지 올라갔고, 2026년에는 26.2의 UNION ALL 전 브랜
2026-07-17 · 24 분 읽기 #database#clickhouse#olap#query-optimization#performance브라우저·컴퓨터를 조작하는 AI 에이전트, 지금 어디까지 왔나 — 벤치마크 숫자가 실제로 재는 것 ♪ 들을 수 있어요
"컴퓨터 유즈 에이전트가 OSWorld에서 83.5%를 찍었다"와 "가장 강한 에이전트도 20.6%밖에 못 끝낸다"는 둘 다 2026년에 나온 사실이고, 둘 다 맞습니다. 앞은 OSWorld 1.0, 뒤는 같은 팀이 만든 OSWorld 2.0입니다. 이 글은 그 간극이 어디서 오는지를 원 논문과 벤치마크 저자들의 자체 측정으로 따라갑니다. OSWorld 과제의 절반 가까이는 GUI를 거의 쓰
2026-07-17 · 46 분 읽기 #ai#computer-use#browser-agents#benchmark#prompt-injectionAI 코드 리뷰는 실제로 쓸 만한가 — 측정된 증거가 말하는 정확도와 거짓 양성 ♪ 들을 수 있어요
AI 코드 리뷰 도구의 마케팅 문구에는 "PR의 80%에 사람 코멘트가 필요 없다" 같은 숫자가 넘치지만, 정작 정밀도와 거짓 양성률을 함께 공개한 곳은 거의 없습니다. 공개된 측정치를 모아 보면 방향은 대체로 일치합니다 — 오픈소스 PR에서 AI 리뷰 코멘트가 실제 코드 변경으로 이어진 비율은 도구에 따라 0.9~19.2%로, 사람 코멘트의 60%에 크게 못 미쳤습니다(Gan 등, 깃허브
2026-07-17 · 47 분 읽기 #ai#code-review#static-analysis#evaluation#software-engineeringWayland 색 관리는 어느 릴리스에 실렸나 — 5년 걸린 프로토콜의 배포 연대기, 그리고 X 서버의 2026년
Wayland의 색 관리·HDR 프로토콜 color-management-v1은 2020년 1월에 열린 머지 리퀘스트가 2025년 2월에야 병합된 5년짜리 표준화의 결과물입니다. 이 글은 뉴스 기사가 아니라 저장소 기록으로 배포 시점을 핀으로 꽂습니다 — Mutter는 GNOME 48(2025년 3월)에서 공식 프로토콜을, 49에서 color-representation을, 50(2026년 3월
2026-07-17 · 25 분 읽기 #linux#wayland#hdr#color-management#x11PyTorch 2.13의 torchcomms — c10d를 대체하러 온 새 분산 통신 백엔드
2026년 7월 8일 릴리스된 PyTorch 2.13의 하이라이트 가운데 가장 구조적인 변화는 torchcomms — PyTorch Distributed의 새 통신 백엔드가 코어의 CI와 DeviceMesh 경로에 통합되기 시작한 것입니다. torchcomms는 2025년 10월 Meta가 발표한 실험적 통신 API로, 전역 상태 기반 c10d ProcessGroup의 기술 부채(NCCL 중
2026-07-17 · 19 분 읽기 #pytorch#distributed-training#nccl#deep-learning로컬에서 LLM 돌리려면 VRAM이 얼마나 필요한가 — 표 말고 공식으로 계산하기 ♪ 들을 수 있어요
"8B 모델에 몇 GB 필요한가요"의 정답은 표가 아니라 두 개의 공식입니다. 가중치는 파라미터 수 곱하기 bpw 나누기 8이고, KV 캐시는 2 곱하기 레이어 수 곱하기 KV 헤드 수 곱하기 headdim 곱하기 바이트 수 곱하기 토큰 수입니다. 이 글은 두 공식을 llama.cpp 소스와 공식 표에 직접 대조해 검증합니다 — ggml 블록 구조체에서 유도한 Q80의 8.5 bpw는 lla
2026-07-17 · 43 분 읽기 #llm#quantization#kv-cache#local-llm#gpuDeno 2.9 — deno desktop 실험, 락파일 그대로 마이그레이션, 그리고 24시간 공급망 기본값
2026년 6월 25일 나온 Deno 2.9는 세 가지 이야기로 요약됩니다. 웹 스택으로 네이티브 데스크톱 앱을 빌드하는 실험 기능 deno desktop(기본은 OS 웹뷰, 옵션으로 CEF 번들), npm·pnpm·yarn·Bun 락파일을 그대로 읽어 deno.lock을 시드하는 마이그레이션 경로, 그리고 갓 게시된 npm 패키지를 24시간 동안 설치 거부하는 min-release-age의
2026-07-17 · 25 분 읽기 #javascript#deno#javascript-runtime#node-compatibility#supply-chainCassandra 6.0-alpha1과 Accord 트랜잭션 — 5년 만의 "범용 트랜잭션"은 지금 어디까지 왔나
2021년 CEP-15로 제안된 Cassandra의 범용 트랜잭션 프로토콜 Accord가 2026년 3~4월, 마침내 6.0-alpha1이라는 실행 가능한 릴리스에 실려 나왔습니다. 리더 없는 합의로 멀티 파티션 strict-serializable 트랜잭션을 정상 조건에서 WAN 왕복 1회에 처리한다는 것이 프로토콜의 약속이고, BEGIN TRANSACTION 구문과 테이블별 transact
2026-07-17 · 24 분 읽기 #database#cassandra#distributed-systems#transactionsAirflow 2 EOL 이후 — 2에서 3으로 가는 실제 작업 목록, 그리고 3.3까지 온 3.x의 현재
Apache Airflow 2는 2026년 4월 22일에 EOL을 지났고, 이제 보안 패치도 나오지 않는 버전입니다. 그런데 2에서 3으로 가는 길은 pip 업그레이드가 아니라 아키텍처 전환입니다 — 워커의 메타데이터 DB 직접 접근이 사라지고, executiondate 계열 컨텍스트 키가 제거되고, 크론 스케줄의 기본 시맨틱까지 바뀝니다. 이 글은 공식 업그레이드 가이드와 릴리스 노트를 원
2026-07-17 · 27 분 읽기 #data-engineering#airflow#workflow-engine#migrationZig 0.16.0 — I/O를 인터페이스로 만든 릴리스, 그리고 그 청구서 ♪ 들을 수 있어요
2026년 4월 14일 발표된 Zig 0.16.0은 표준 라이브러리의 모든 입출력이 Io 인스턴스를 인자로 받도록 바꿨습니다. Allocator를 인자로 넘기던 Zig의 오래된 습관을 I/O에 그대로 적용한 것으로, 같은 소스 코드가 스레드 기반 구현 위에서도 이벤트 루프 위에서도 돌아가게 하려는 설계입니다. 하지만 릴리스 노트를 실제로 읽어 보면 완성된 구현체는 Io.Threaded 하나뿐
2026-07-16 · 43 분 읽기 #zig#systems-programming#async-io#compilerTriton Gluon — 컴파일러가 숨기던 레이아웃을 손으로 쓰는 언어 ♪ 들을 수 있어요
Gluon은 Triton과 같은 컴파일러 스택 위에 올라간 하위 레벨 GPU 언어로, Triton이 감춰 두던 레이아웃·공유 메모리·워프 특수화를 커널 작성자에게 그대로 넘깁니다. 존재 이유는 명확합니다 — Triton 컴파일러가 잘 못 뽑는 코드를 만났을 때, 지금까지는 손쓸 방법이 없었기 때문입니다. 이 글은 Gluon이 무엇을 노출하는지, BlockedLayout이 실제로 무엇을 뜻하는
2026-07-16 · 33 분 읽기 #gpu#triton#kernel#compiler#performance