블로그
GPU·LLM·MLOps·쿠버네티스, 그리고 마음가짐에 관한 글 · 3704 편
#2026-03 762#culture 283#deep-dive 275#kubernetes 262#career 233#ai 223#llm 217#devops 198#2026-04 158#security 149#observability 118#database 113#communication 108#history 107#architecture 101#productivity 98#performance 93#linux 90#networking 89#finance 87#economy 84#mindset 80#psychology 79#ai-papers 78#food 78#it 78#travel 78#japanese 76#deep-learning 75#english 74#gpu 74#ai-agent 69#business-travel 69#postgresql 67#cs-fundamentals 63#rag 63#systems 63#python 56#learning 54#self-improvement 53
커널을 쓰는 세 가지 층위 — CUDA C++, Triton, CUTLASS를 같은 문제로 비교하기
같은 GPU 커널을 손으로 쓰는 CUDA C++, 파이썬으로 타일 단위로 쓰는 Triton, 템플릿으로 조립하는 CUTLASS와 CuTe로 각각 접근할 때 무엇이 달라지는지 비교합니다. 행 단위 softmax를 CUDA C++와 Triton으로 실제로 짜서 코드량과 성능을 나란히 재고, 그 차이가 어디서 오는지 컴파일 파이프라인 수준에서 설명합니다. Triton이 커스텀 어텐션 커널의 사실상
2026-08-02 · 28 분 읽기 #triton#cuda#cutlass#gpu-kernel#compiler도구인가, 상대인가 — 의식 질문을 미뤄 두고도 할 수 있는 이야기
사람들이 AI 앞에서 가장 먼저 집어 드는 질문은 "이것에 의식이 있는가"입니다. 가장 어려운 질문이고, 아마 가장 쓸모 있는 질문은 아닙니다. 이 글은 그 질문을 닫지 않은 채로 옆에 두고, 관찰 가능한 것부터 시작합니다. 도구가 문장으로 답하기 시작했을 때 무엇이 달라졌는지, 의인화가 왜 시스템이 아니라 우리에 대한 사실인지, 엘리자 효과가 보여 주는 것과 보여 주지 않는 것이 무엇인지,
2026-08-02 · 26 분 읽기 #humanities#ai#philosophy#cognition#technology로봇공학에 필요한 수학, 순서대로 — 그리고 무엇을 나중으로 미뤄도 되는가 ♪ 들을 수 있어요
로봇 팔을 만들려면 수학을 어디까지 알아야 하는지에 대한 답입니다. 선형대수, 삼각법과 회전 표현, 미적분과 다변수, 미분방정식과 제어이론, 확률과 추정, 최적화 순으로 여섯 갈래를 정리했습니다. 각 갈래마다 로봇 팔의 어느 부분에서 정확히 쓰이는지, 어느 수준까지 알면 충분한지, 그리고 무엇을 나중으로 미뤄도 되는지를 함께 적었습니다. 미뤄도 되는 것을 명시한 이유는 그것이 대부분의 사람이
2026-08-02 · 43 분 읽기 #robotics#math#electronics#linear-algebra#control로봇 팔은 무엇으로 이루어지는가 — 링크, 조인트, 그리고 관절을 실제로 움직이는 것들 ♪ 들을 수 있어요
로봇 팔을 만들려고 서보 여섯 개를 사면 대체로 팔이 자기 무게에 무너집니다. 이 글은 링크와 조인트와 엔드이펙터의 정확한 정의에서 시작해 자유도가 무엇을 세는 값인지, 왜 6이 기준인지를 설명하고, 관절을 실제로 돌리는 세 가지 선택지인 서보와 스테퍼와 BLDC를 제조사 공표 규격으로 비교합니다. 감속기가 토크를 몇 배로 키우고 백래시를 얼마나 만드는지, 하모닉 드라이브가 왜 로봇에 쓰이는
2026-08-02 · 47 분 읽기 #robotics#hardware#electronics#arduino#math2025~2026 일본 영화 드라마 애니 총정리 — 기록을 갈아치운 두 편과 그 그늘
2025년부터 2026년 상반기까지 일본 영화, 드라마, 애니메이션 중 실제로 화제가 되었던 18편을 정리했습니다. 일본 역대 흥행 1위를 갈아치운 극장판 귀멸의 칼날 무한성편, 실사 영화 역대 1위가 된 국보, 로카르노 황금표범상을 받은 여행과 나날, 그리고 25년 만에 칸 경쟁 부문에 세 편이 동시에 오른 2026년까지 다룹니다. 각 작품의 감독과 제작사, 확인된 시청 경로, 누가 좋아하
2026-08-02 · 31 분 읽기 #culture#japanese-film#anime#j-drama#movie-recommendation2025~2026 한국 영화 드라마 총정리 — 극장이 돌아온 해, OTT가 재편된 해
2025년부터 2026년 상반기까지 한국 영화와 드라마 중 실제로 화제가 되었던 18편을 정리했습니다. 1691만 관객을 모은 왕과 사는 남자, 베니스에서 공개된 박찬욱의 어쩔수가없다, 넷플릭스 글로벌 1위를 기록한 폭싹 속았수다와 참교육까지 다룹니다. 각 작품의 감독과 주연, 공개 플랫폼, 그리고 누가 좋아하고 누가 싫어할지를 한 줄로 정리했습니다. 결말은 밝히지 않고 전제만 소개합니다.
2026-08-02 · 29 분 읽기 #culture#korean-film#k-drama#movie-recommendation#netflix2025~2026 미국 영화 시리즈 총정리 — 오스카가 고른 것과 관객이 고른 것
2025년부터 2026년 상반기까지 미국 영화와 시리즈 중 실제로 화제가 되었던 17편을 정리했습니다. 제98회 아카데미 작품상을 받은 원 배틀 애프터 어나더, 오스카 역사상 최다인 16개 부문 후보에 오른 시너스, 넷플릭스 역대 최다 시청 영화가 된 케이팝 데몬 헌터스, 그리고 에미상을 휩쓴 더 핏과 더 스튜디오까지 다룹니다. 각 작품의 감독과 주연, 확인된 시청 경로, 누가 좋아하고 누가
2026-08-02 · 29 분 읽기 #culture#american-film#tv-series#movie-recommendation#oscars어려운 책 읽는 법 — 완독보다 중요한 다섯 가지 판단
어려운 책이 안 읽히는 이유는 대개 모르는 단어가 아니라 논증의 구조입니다. 이 글은 애들러의 독서법과 읽기 연구가 실제로 지지하는 것을 근거로, 느리게 한 번보다 빠르게 두 번 읽는 방법, 해설서가 도움에서 목발로 바뀌는 지점, 책이 끝난 뒤에도 남는 메모, 번역서를 정직하게 읽는 태도, 그리고 잘 포기하는 법을 정리합니다. 대중적 독서 조언이 근거보다 앞서 나간 지점도 함께 표시했습니다.
2026-08-02 · 25 분 읽기 #storytelling#reading#books#learning#culture공개된 학습 사례에서 배우기 — 무엇을 시도했고 무엇이 실패했나
공개된 대규모 학습 기술 보고서와 로그북 일곱 건을 골라 성공 지표가 아니라 실패와 대응만 뽑아 정리했습니다. Llama 3 405B의 54일간 419건 중단 통계에서 체크포인트 주기를 역산하고, DeepSeek-V3와 Kimi K2가 손실 스파이크를 각각 다른 층위에서 없앤 방식을 비교합니다. Olmo 계열이 안정성 수정을 아키텍처에 남긴 이유, OPT-175B와 BLOOM 로그북이 남긴
2026-08-02 · 24 분 읽기 #mlops#llm-training#case-study#training-stability#scaling이 모델들은 어떻게 만들어졌나 — 2026년 오픈 웨이트 파이프라인 해부
2026년 8월 기준 허깅페이스 상위권에 올라 있는 오픈 웨이트 모델들의 카드와 기술 보고서를 읽고, 데이터 수집부터 양자화 배포까지 제작 파이프라인을 순서대로 정리했습니다. MoE 희소성이 20배를 넘어선 이유, 전역 어텐션을 줄이는 네 가지 접근, 사전학습 토큰 예산과 안정화 기법, SFT 이후의 선호 최적화와 강화학습, 그리고 증류와 저비트 배포까지 실제 모델을 예시로 다룹니다. 중요한
2026-08-02 · 32 분 읽기 #llm#pretraining#moe#post-training#quantizationvLLM을 고쳐서 빠르게 만들기 — 설정, 내부 구조, 그리고 코드를 건드릴 지점 ♪ 들을 수 있어요
vLLM 성능을 올리는 작업을 코드를 고치지 않고 되는 것부터 순서대로 정리합니다. 배치 관련 인자와 프리픽스 캐싱, 청크드 프리필, 양자화 선택을 먼저 다루고, 그다음 PagedAttention과 연속 배칭 스케줄러가 내부에서 무엇을 결정하는지 실제 소스를 근거로 설명합니다. 실제로 코드를 건드릴 만한 세 지점인 커스텀 로짓 프로세서, 커스텀 어텐션 백엔드, 스케줄러 정책과 그 대가도 짚습
2026-08-02 · 35 분 읽기 #vllm#llm-inference#paged-attention#benchmark#scheduler2025~2026 중화권 영화 드라마 총정리 — 본토, 홍콩, 대만의 서로 다른 성적표
2025년부터 2026년 상반기까지 중화권 영화와 드라마 중 실제로 화제가 되었던 17편을 본토, 홍콩, 대만으로 나눠 정리했습니다. 전 세계 애니메이션 흥행 1위가 된 나타지마동뇨해, 금마장 최우수 극영화상을 받은 대만 영화 대몽, 홍콩금상장 작품상을 받은 재견UFO, 그리고 조우번 방언으로 만들어 더우반 9점을 받은 아마에게 보내는 편지까지 다룹니다. 각 작품의 출신지와 감독, 확인된 시
2026-08-02 · 29 분 읽기 #culture#chinese-film#hong-kong-cinema#taiwan-cinema#movie-recommendation글로 설득하기 — 디자인 문서와 RFC가 통과되는 구조
설계 문서, RFC, 제안서, 장애 후속 권고를 쓰는 사람을 위한 글입니다. 자신이 문제를 푼 순서가 아니라 원하는 결정을 맨 앞에 두는 법, 기각한 대안을 드러내는 것이 왜 제안과 광고를 가르는 유일한 표지인지, 아무것도 하지 않을 때의 비용을 어떻게 숫자로 만드는지, 훑어 읽는 결정자를 어떻게 상대하는지를 정리했습니다. 그리고 가장 중요한 것, 내가 없는 회의에서 인용될 문단을 어떻게 쓰
2026-08-02 · 25 분 읽기 #career#writing#persuasion#design-doc#engineering설득의 구조 — 말재주가 아니라 순서가 사람을 움직입니다 ♪ 들을 수 있어요
설득은 표현을 다듬기 한참 전에 구조에서 먼저 실패합니다. 주장보다 공유 전제를 먼저 세우는 일, 가장 강한 근거를 주의가 가장 높은 지점에 두는 일, 요구를 승낙할 수 있는 크기로 줄이는 일, 그리고 사람은 설득당하기를 거부한다는 비대칭까지 네 개의 축으로 정리했습니다. 정교화 가능성 모델과 접종 이론은 증거의 무게가 서로 다르다는 점, 문간에 발 들여놓기나 자아 고갈처럼 널리 인용되지만
2026-08-02 · 33 분 읽기 #career#persuasion#communication#influence#psychology반론을 다루는 법 — 사실 논쟁, 가치 논쟁, 지위 논쟁을 구별하기
설득을 배우는 사람 대부분이 건너뛰는 부분이 반론입니다. 상대의 논거를 상대보다 잘 정리해 소리 내어 확인하는 절차로서의 스틸맨, 가장 강한 반론을 내가 먼저 꺼내는 것이 왜 신뢰를 깎지 않고 올리는지, 사실 이견과 가치 이견과 지위 이견을 어떻게 구별하고 각각 무엇으로 대응해야 하는지를 정리했습니다. 논쟁 중간에 내가 틀렸다는 것을 알았을 때의 처리, 그리고 널리 인용되지만 대규모 재현에서
2026-08-02 · 27 분 읽기 #career#persuasion#communication#conflict#teamworkLLM 벤치마크 도구를 뜯어보기 — 같은 MMLU가 하네스마다 다른 점수를 내는 이유 ♪ 들을 수 있어요
벤치마크 점수는 모델의 속성이 아니라 특정 조건에서 수행된 측정의 결과입니다. 같은 LLaMA 65B가 같은 MMLU에서 63.6점과 48.8점을 동시에 받은 사건은, 하네스가 프롬프트를 어떻게 조립하고 정답을 어떻게 파싱하느냐가 점수의 상당 부분을 결정한다는 것을 보여 줍니다. 이 글은 평가 하네스가 내부에서 실제로 수행하는 여섯 단계를 분해하고 lm-evaluation-harness 0.
2026-08-02 · 35 분 읽기 #llm-evaluation#benchmark#lm-evaluation-harness#helm#reproducibility우리 서비스용 평가셋 만들기 — 트래픽 수집부터 통계적 유의성 판정까지 ♪ 들을 수 있어요
공개 벤치마크는 우리 문제를 대신 재 주지 않습니다. 입력 분포도, 정답의 정의도, 실패의 비용 구조도 다르기 때문입니다. 이 글은 실제 트래픽에서 사례를 건져 올려 실패 유형별로 층화하고, 정답을 정의할 수 없는 과제에 루브릭을 씌우고, 채점 스크립트를 붙이는 과정을 실제 코드로 따라갑니다. 예시가 몇 개면 충분한지 신뢰구간으로 감을 잡고, 작은 평가셋에서 두 모델의 5퍼센트포인트 차이가
2026-08-02 · 37 분 읽기 #llm-evaluation#eval-set#rubric#statistics#regression-testing텍스트·이미지·에이전트를 각각 어떻게 재는가 — 세 영역의 측정이 근본적으로 다른 이유 ♪ 들을 수 있어요
텍스트·이미지·에이전트는 같은 "성능"이라는 단어를 쓰지만 측정 구조가 전혀 다릅니다. 텍스트는 정답이 있는 척하는 객관식과 정답이 없는 생성형으로 갈라지고, 이미지는 분포 거리와 사람 판단이 어긋나며, 에이전트는 부분 성공·환경 상태·비결정성 때문에 애초에 하나의 숫자로 압축되지 않습니다. 이 글은 각 영역의 대표 지표가 실제로 계산하는 값을 정의 수준에서 뜯어보고, 영역마다 "지표는 높은
2026-08-02 · 37 분 읽기 #llm-evaluation#multimodal#llm-as-judge#agent-benchmark#metrics애플리케이션에 OpenTelemetry 붙이기 — 자동 계측에서 수동 스팬까지, 그리고 컬렉터를 두는 이유
계측은 SDK를 설치하는 일이 아니라 순서를 지키는 일입니다. 자동 계측으로 하루 만에 골격을 세우고, 리소스 속성을 먼저 확정한 뒤, self time이 큰 구간에만 수동 스팬을 넣는 순서를 실제 서비스 하나를 끝까지 계측하며 보여줍니다. 컨텍스트 전파가 끊기는 네 지점인 스레드풀, 메시지 큐, 백그라운드 작업, 헤더를 지우는 프록시를 각각 재현하고 고칩니다. 마지막으로 컬렉터를 앱과 백엔
2026-08-02 · 27 분 읽기 #observability#opentelemetry#instrumentation#otel-collector#tracing역기구학 — 가고 싶은 곳에서 관절 각도를 거꾸로 구하기 ♪ 들을 수 있어요
순기구학은 각도를 넣으면 위치가 나오는 한 번의 계산이지만, 역기구학은 해가 없을 수도 여러 개일 수도 무한할 수도 있는 문제입니다. 2링크 평면 팔의 해석해를 코사인 법칙에서 시작해 끝까지 유도하고, elbow-up과 elbow-down 두 해가 왜 반드시 쌍으로 나오는지, 작업공간 밖의 좌표를 넣으면 제곱근 안이 어떻게 음수가 되는지 숫자로 확인합니다. 그다음 자코비안과 의사역행렬로 반복
2026-08-02 · 35 분 읽기 #robotics#math#electronics#hardware#raspberry-pi