블로그
GPU·LLM·MLOps·쿠버네티스, 그리고 마음가짐에 관한 글 · 3704 편
#2026-03 762#culture 283#deep-dive 275#kubernetes 262#career 233#ai 223#llm 217#devops 198#2026-04 158#security 149#observability 118#database 113#communication 108#history 107#architecture 101#productivity 98#performance 93#linux 90#networking 89#finance 87#economy 84#mindset 80#psychology 79#ai-papers 78#food 78#it 78#travel 78#japanese 76#deep-learning 75#english 74#gpu 74#ai-agent 69#business-travel 69#postgresql 67#cs-fundamentals 63#rag 63#systems 63#python 56#learning 54#self-improvement 53
Model Context Protocol(MCP) 레퍼런스 — AI를 외부 세계에 연결하는 열린 표준
Model Context Protocol(MCP)은 애플리케이션이 LLM에 컨텍스트를 제공하는 방식을 표준화한 열린 프로토콜입니다. 이 글은 MCP가 실제로 무엇인지를 공식 문서에 근거해 정리한 엔지니어용 레퍼런스입니다 — 왜 M×N 통합 문제를 푸는지, 호스트·클라이언트·서버 구조와 두 계층(데이터/전송), 세 가지 서버 프리미티브(도구·리소스·프롬프트), stdio와 Streamable
2026-07-11 · 13 분 읽기 #mcp#ai#agents#llm#protocol성공한 회사는 어떻게 눈이 머는가 — 엔지니어링 조직의 역량 실명
Ian Reppel의 에세이는 성공한 회사가 그가 "역량 실명(competence blindness)"이라 부르는 상태에 빠진다고 말합니다. 멕시코 동굴 물고기가 스스로 눈을 억제하듯, 환경이 더 이상 보상하지 않기 때문에 꼼꼼한 엔지니어링을 발현하지 않게 되는 것입니다. 이것은 단순한 방치가 아니라 능동적 억제이며, 고전적 파괴적 혁신과도 다릅니다. 이 글은 그 주장을 충실히 옮긴 뒤, 그
2026-07-11 · 18 분 읽기 #engineering-culture#organizations#legacy#metrics#leadershipRTX 5090 한 장으로 작은 모델들 직접 굴려보기 — microGPT·OCR·음악 생성
RTX 5090(Blackwell, 32GB) 한 장에 SSH로 붙어 작은 모델 셋을 직접 돌려봤습니다. char-level GPT를 밑바닥부터 28초 만에 학습시키고(10.75M 파라미터, 117만 tokens/s), 전용 OCR(TrOCR)과 소형 VLM(Qwen2-VL-2B)을 같은 이미지에 붙여 CER로 대결시키고, MusicGen으로 8초짜리 음악을 1.9초(4.2배 실시간)에 생성
2026-07-11 · 12 분 읽기 #pytorch#gpu#llm#ocr#hands-onMicrosoft Flint 읽기 — 에이전트가 차트를 그리게 만드는 시각화 언어
Microsoft Research가 공개한 Flint는 에이전트를 시각화하는 언어가 아니라, AI 에이전트가 데이터로부터 보기 좋은 차트를 안정적으로 만들게 해주는 중간 언어입니다. 컴파일러가 스케일·축·색·레이아웃 같은 낮은 수준의 결정을 데이터와 시맨틱 타입으로부터 대신 유도하고, 하나의 명세를 Vega-Lite·ECharts·Chart.js로 컴파일합니다. 이 글은 Flint가 실제로
2026-07-11 · 11 분 읽기 #ai#agents#data-visualization#llm#microsoftScarf는 왜 7년 쓴 하스켈을 아쉬워하며 떠났나 — 언어 선택의 진짜 비용
Scarf는 7년간 프로덕션에서 돌리던 하스켈을 파이썬으로 옮기고 있습니다. 흥미로운 건 그 이유입니다. 창업자 Avi Press는 하스켈이 신뢰성·타입 안전성·성능이라는 약속을 대부분 지켰다고 인정하면서도, 결정적 비용은 컴파일 시간과 에코시스템 마찰이었다고 말합니다. 여러 AI 에이전트가 브랜치를 병렬로 탐색하는 개발 방식에서, 콜드 빌드 대기 시간이 사소한 불편에서 가장 큰 비용으로 바
2026-07-11 · 16 분 읽기 #haskell#python#engineering-decisions#compile-times#ai-assisted-development스크래퍼는 이제 수백만 개의 가정용 IP에서 온다 — residential proxy와 오픈소스 인프라의 소모전
2026년 7월 10일 LWN의 Jonathan Corbet가 스크래퍼 상황 업데이트를 냈습니다. 핵심은 두 가지입니다 — residential proxy(가정용 프록시)가 IP 기반 차단을 사실상 무력화했고, AI 크롤러의 폭증이 그 수요를 채웠습니다. 한 번의 공격에서 몇 시간 동안 수백만 개의 서로 다른 IP가 각자 두세 번씩만 사이트를 두드립니다. 이 글은 왜 차단이 구조적으로 실패하
2026-07-11 · 12 분 읽기 #web-scraping#residential-proxy#ai-crawlers#anubis#infrastructureMac mini가 온디바이스 AI 머신이 된 이유 — 애플 실리콘 임원 인터뷰가 말하는 것, 말하지 않는 것
애플 실리콘 수석 프로덕트 매니저 더그 브룩스가 The Deep View 인터뷰에서 Mac mini와 Mac Studio에 대한 수요와 온디바이스 AI의 방향을 이야기했습니다. 개발자들이 왜 이 작은 데스크톱을 로컬 LLM·에이전트 머신으로 고르는지, 통합 메모리 구조의 진짜 이점은 무엇인지, 그리고 CUDA 생태계 격차와 최근 가격 인상이라는 정직한 트레이드오프까지 — 임원의 발언을 그대로
2026-07-11 · 11 분 읽기 #apple-silicon#on-device-ai#local-llm#mac-mini#inferencenpm 공급망 공격이 사라지지 않는 이유 — npm-scan이 실제로 하는 일과, 정말 효과 있는 방어
npm 생태계의 공급망 공격은 우연한 사건이 아니라 설치 스크립트, 전이 의존성, 타이포스쿼팅이라는 구조에서 반복적으로 나온다. 2025년 Shai-Hulud 웜은 설치 스크립트로 스스로 번식하며 npm 토큰과 클라우드 키를 훔쳐 갔다. 최근 Hacker News에서 화제가 된 npm-scan은 이 문제를 로컬에서 정적·행위 분석으로 잡겠다고 표방하는 도구다. 이 글은 README를 근거로
2026-07-11 · 13 분 읽기 #npm#supply-chain#security#javascript#nodejsK-pop은 왜 7위 시장의 몸집보다 커 보이는가: IFPI 2026으로 읽는 음악 경제
IFPI 「글로벌 뮤직 리포트 2026」에 따르면 2025년 전 세계 음반 시장 매출은 317억 달러로 전년 대비 6.4% 늘었고, 11년 연속 성장이자 처음으로 300억 달러를 넘었습니다. 그 표에서 한국은 세계 7위 시장입니다. 그런데 K-pop이 차지하는 존재감은 7위라는 숫자보다 훨씬 커 보입니다. 이 글은 시장 순위가 무엇을 재고 무엇을 재지 않는지, 스트리밍과 실물 음반의 묘한 균
2026-07-11 · 10 분 읽기 #kpop#music-industry#business#korea#streamingpgrust: Postgres를 Rust로 다시 쓰고 회귀 테스트 100%를 통과했다 — 그게 정말 뜻하는 것
Malcolm Matis(malisper)가 Postgres를 Rust로 다시 쓴 pgrust를 공개했습니다. Postgres 18.3 호환을 목표로 4만6천 개가 넘는 회귀 테스트 쿼리를 통과하고, 실제 18.3 데이터 디렉터리에서 부팅됩니다. 이 글은 그 마일스톤이 왜 진짜로 인상적인지, 그리고 "회귀 테스트 100% 통과"가 무엇을 증명하고 무엇을 증명하지 않는지를 정직하게 뜯어봅니다.
2026-07-11 · 12 분 읽기 #postgresql#rust#pgrust#database#regression-tests더 생각한다고 더 맞는 것은 아니다: 테스트타임 컴퓨트와 과잉사고
2026년 4월, Shu Zhou 등 6명은 "When More Thinking Hurts"에서 추론 토큰을 무작정 늘리는 흐름에 정면으로 질문을 던집니다. 저자들의 보고에 따르면 컴퓨트 예산이 커질수록 추가 추론 토큰의 한계 효용은 크게 줄어들고, 어느 지점부터 모델은 "과잉사고"에 빠져 이미 맞혔던 답을 스스로 뒤엎습니다. 최적 사고 길이는 문제 난이도마다 다르므로, 모두에게 같은 예산을
2026-07-11 · 12 분 읽기 #ai#llm#reasoning#inference#test-time-compute조던 피터슨의 책 세 권 — 사려 깊은 독자를 위한 안내
조던 피터슨은 임상심리학자이자 논쟁적인 공적 인물입니다. 이 글은 정치적 논쟁이 아니라 그의 대표 저서 세 권 — 12가지 인생의 법칙(2018), 질서 너머(2021), 의미의 지도(1999) — 의 실제 내용에 집중합니다. 각 책이 무엇을 말하는지, 책임·의미·질서와 혼돈이라는 핵심 아이디어가 무엇인지, 누가 도움을 받을 수 있는지를 정리했습니다. 많은 독자가 실질적 도움을 얻었다는 점과
2026-07-11 · 12 분 읽기 #books#self-improvement#psychology#jordan-peterson#philosophy습관은 21일에 만들어지지 않는다: 66일 연구로 다시 읽는 마이크로 습관
'습관은 21일이면 만들어진다'는 말은 실험이 아니라 1960년대 성형외과 의사의 임상 관찰에서 나온 오해다. 실제 일상을 추적한 2010년 Lally 연구는 자동성에 도달하기까지 걸린 시간의 중앙값이 66일, 개인별 범위는 18일에서 254일이었다고 보고한다. 이 글은 그 변동성을 핵심 발견으로 삼아 2026년 '마이크로 습관' 트렌드가 왜 이 데이터와 잘 맞는지 살펴본다. 습관 쌓기, 신
2026-07-11 · 10 분 읽기 #self-improvement#habits#psychology#productivity#behavior-change사전학습 체크포인트를 긴 컨텍스트 하이브리드로 — HyLo의 업사이클링 레시피
하이브리드 시퀀스 모델(어텐션 + 선형·SSM 블록)은 긴 컨텍스트에 유리하지만, 지금까지는 대부분 처음부터 새로 사전학습해야 했습니다. 2026년 4월 프리프린트 HyLo는 이미 학습된 Transformer 체크포인트를 값싼 후처리 학습만으로 하이브리드로 "업사이클링"하는 레시피를 제안합니다 — MLA(잠재 어텐션)와 Mamba2·Gated DeltaNet 같은 선형 블록을 섞고, 단계적
2026-07-11 · 11 분 읽기 #ai#llm#long-context#architecture#efficiencyHybrid SWA로 긴 컨텍스트 추론 최적화하기 — Xiaomi MiMo v2.5가 실제로 한 것
슬라이딩 윈도우 어텐션(SWA)과 풀 어텐션을 층별로 섞는 하이브리드 SWA는 긴 컨텍스트 추론의 KV 캐시 메모리와 연산량을 함께 줄이는 최근의 주류 설계입니다. Xiaomi가 공개한 MiMo v2.5 추론 최적화 글을 근거로, 하이브리드 SWA가 무엇이고 왜 중요한지, MiMo v2.5가 실제로 어떤 아키텍처와 시스템 엔지니어링을 했는지(70층 중 10층만 풀 어텐션, 윈도우 128, 이
2026-07-11 · 15 분 읽기 #ai#llm#inference#attention#optimizationGhostLock: 리눅스 rtmutex에 15년을 숨어 있던 스택 use-after-free (CVE-2026-43499)
GhostLock(CVE-2026-43499)은 리눅스 커널의 실시간 뮤텍스(rtmutex) 코드에 있던 스택 use-after-free다. nebusec.ai의 IonStack 2부 분석에 따르면 이 결함은 2011년 2.6.39-rc1부터 2026년 4월 패치까지 약 15년간 메인라인에 남아 있었다. 원인은 작다 — removewaiter()가 정리 중인 waiter를 늘 현재 스레드라고
2026-07-11 · 12 분 읽기 #linux-kernel#security#use-after-free#privilege-escalation#rtmutex멜 브룩스, 99세의 남자 — 노장 엔터테이너 헌정 다큐가 2026년 에미상을 이끈 이유
멜 브룩스의 100번째 생일에 맞춰, 그의 삶을 다룬 2부작 HBO 다큐멘터리가 2026년 에미상 논픽션 부문을 6개 지명으로 이끌었다. 같은 해 존 캔디, 마틴 쇼트, 마틴 스코세이지를 되짚는 회고 다큐들도 나란히 후보에 올랐다. 왜 스트리밍과 관객은 원로 예술가를 경건하게 기록하는 이 형식으로 몰려갈까. 헌정과 홍보 사이, 이 장르가 감당해야 할 정직함의 무게를 짚어본다.
2026-07-11 · 10 분 읽기 #film#documentary#comedy#culture#legacy은퇴한 DDR4를 되살리는 법 — Meta의 CXL 브리지 칩 Vistara
DDR5 가격이 오르는데 은퇴한 서버의 멀쩡한 DDR4는 창고에 쌓입니다. Meta가 ISCA 2026에서 공개한 Vistara는 자체 CXL 브리지 칩으로 이 옛 DDR4를 최신 DDR5 서버에 느리지만 훨씬 싼 두 번째 메모리 계층으로 되살립니다. 이 글은 CXL과 메모리 티어링이 무엇이고 왜 하이퍼스케일에서 중요한지, Vistara 칩과 MemServer가 실제로 어떻게 구성됐는지(DD
2026-07-11 · 13 분 읽기 #cxl#infrastructure#memory#hardware#sustainabilityLLM 번아웃 — 일이 "만드는 것"에서 "검토하는 것"으로 바뀔 때
개발자 Alec Scollon의 에세이 "I Think I Have LLM Burnout"이 해커뉴스에서 화제가 되었습니다. 하루가 코드를 "쓰는 일"에서 모델이 쓴 것을 "검토하는 일"로 조용히 바뀌었다는 감각을 정확히 짚었기 때문입니다. 이 글은 그 주장을 충실히 정리하고, 균형 잡힌 시각을 더합니다. 생성은 싸졌지만 검증은 그대로이고, AI 출력을 리뷰하는 일은 실제 인지 노동입니다.
2026-07-11 · 12 분 읽기 #llm#developer-experience#burnout#ai-tooling#code-review'일본식 걷기' 유행과 진짜 과학: 인터벌 워킹 트레이닝(IWT)의 근거와 한계
2026년 소셜미디어에서 퍼진 '일본식 걷기'는 사실 신슈대학교 연구진이 20년 가까이 다듬어 온 인터벌 워킹 트레이닝(IWT)을 새 이름으로 포장한 것이다. 프로토콜은 단순하다. 빠르게 3분, 천천히 3분을 다섯 번쯤 반복해 30분, 주 4일 이상. 2007년 Mayo Clinic Proceedings에 실린 약 246명 중장년 대상 연구는 같은 총 운동 시간의 일반 걷기보다 다리 근력,
2026-07-11 · 8 분 읽기 #fitness#health#walking#exercise#cardio