태그: #ai
GPU·LLM·MLOps·쿠버네티스, 그리고 마음가짐에 관한 글 · 223 편
AI가 전기를 삼킨다 — 전력 수요 폭증과 유틸리티 투자 테마 ♪ 들을 수 있어요
AI 데이터센터가 촉발한 전력 수요 폭증이 유틸리티와 전력장비, 송전 섹터를 새로운 투자 테마로 끌어올리고 있습니다. 강세와 약세 양쪽 시각, 규제와 금리 민감도, 그리고 투자자가 점검해야 할 리스크와 체크포인트를 균형 있게 정리했습니다.
2026-06-18 · 48 분 읽기 #finance#ai#power-demand#utilities#data-center온디바이스·엣지 AI — AI가 기기 안으로 들어온다 ♪ 들을 수 있어요
클라우드에 머물던 AI 추론이 스마트폰·PC·임베디드 기기 안으로 이동하고 있습니다. 지연·프라이버시·비용이라는 세 가지 동인과 NPU·온디바이스 LLM의 부상, 그리고 투자·산업 관점의 시사점과 리스크를 균형 있게 정리합니다.
2026-06-18 · 35 분 읽기 #ai#edge-ai#on-device#npu#llm양자컴퓨팅 상용화와 투자 — 과장과 현실 사이 ♪ 들을 수 있어요
양자컴퓨팅은 금융 최적화와 신약 분자 시뮬레이션에서 첫 적용 사례가 나오고 있지만, 상용화 시점과 투자 가치에 대해서는 과장과 회의가 공존합니다. 진척 상황, 양자내성암호, 주요 기업과 방식, 그리고 균형 잡힌 투자 관점을 정리합니다.
2026-06-18 · 40 분 읽기 #ai#quantum-computing#investing#cybersecurity#technology에이전트 AI 산업 지형 2026 — 투자 관점의 지도
2026년 들어 급부상한 에이전트 AI 산업을 투자 관점에서 지도처럼 정리합니다. 펀딩과 개발자 채택 흐름, 산업별 적용, 빅테크와 스타트업의 경쟁 구도, 수익화와 과열 논쟁, 그리고 강세와 약세 양쪽 시각을 균형 있게 다룹니다.
2026-06-18 · 29 분 읽기 #ai#agentic-ai#industry#investment#big-tech휴머노이드 로봇 투자 테마 — Figure, Tesla, 1X가 그리는 미래 ♪ 들을 수 있어요
휴머노이드 로봇은 2026년 가장 뜨거운 투자 테마 중 하나입니다. Figure, Tesla Optimus, 1X 등 주요 기업의 기술 현황과 밸류체인, 보급 시점 논쟁, 그리고 과열 리스크까지 강세와 약세 양쪽 시각으로 균형 있게 살펴봅니다.
2026-06-18 · 39 분 읽기 #ai#humanoid-robot#robotics#investing#tesla결국 자기만의 스토리가 필요하다 — 삶에 적용되는 배움 ♪ 들을 수 있어요
아무리 많이 배워도 자기 것으로 만들지 못하면 공허합니다. AI를 쓰더라도 그 배움이 내 삶에 적용되어야 진짜 잘 쓴 것입니다. 나의 언어로 바꿔 저장하고, 메타인지로 나를 객관화하며, 후회 없이 최선을 다해 자기만의 서사를 만드는 법을 정리했습니다.
2026-06-17 · 38 분 읽기 #learning#metacognition#storytelling#ai#authenticity두 번째 뇌 재설계 — AI 시대의 개인 지식 관리(PKM)
정보 과부하 시대에 노트를 진짜 지식으로 바꾸는 PKM 시스템 설계를 다룹니다. Zettelkasten과 PARA의 핵심, AI가 바꾼 노트의 역할, 로컬 LLM과 임베딩으로 노트에 질문하는 레시피, 4주 구축 플랜과 체크리스트까지 실전 중심으로 정리했습니다.
2026-06-12 · 28 분 읽기 #pkm#productivity#obsidian#zettelkasten#ai장인과 빌더 — LLM이 커리어를 잠식할 때 개발자가 서야 할 곳 ♪ 들을 수 있어요
Stack Overflow 블로그의 Artisans and builders와 HN에서 화제가 된 LLMs are eroding my software engineering career라는 두 글을 축으로, AI 시대 개발자 정체성의 재정의를 다룹니다. 빌더의 민주화와 장인 가치의 재조명, 10년차 도메인 전문가의 차별화 전략, 분기별 실천 플랜까지 정리합니다.
2026-06-12 · 43 분 읽기 #career#ai#engineering-culture#llm#senior-engineerOSS 메인테이너와 AI 기여의 충돌 — jqwik 사건이 던진 질문
JVM 속성 기반 테스트 엔진 jqwik 메인테이너의 반-AI 조치가 2026년 6월 HN과 GeekNews를 달궜습니다. AI 기여가 메인테이너에게 지우는 비대칭적 부담, curl 등 다른 프로젝트의 정책 사례, AI 기여 정책 스펙트럼과 CONTRIBUTING.md 템플릿, 기여자 에티켓까지 균형 있게 정리합니다.
2026-06-12 · 33 분 읽기 #opensource#ai#maintainer#contribution-policy#community30배 AI 엔지니어의 조건은 속도가 아니라 취향이다 ♪ 들을 수 있어요
GeekNews와 서브스택에서 화제가 된 How to be a 30x AI engineer with taste의 논지를 소개하고 확장합니다. AI가 코드 생산을 커머디티화하는 시대에 차별화 요소는 생산 속도가 아니라 무엇을 만들지 판단하는 평가 능력, 즉 취향이라는 주장과 그 취향을 기르는 구체적 훈련법을 다룹니다.
2026-06-12 · 38 분 읽기 #ai#career#engineering-culture#productivity#code-review루프 엔지니어링 — 에이전트를 프롬프트하는 시스템을 설계하라
에이전트에게 매 턴 수동으로 프롬프트를 입력하는 시대가 끝나가고 있습니다. plan-act-verify-self-correct 루프 설계, 테스트와 린트를 에이전트 피드백으로 연결하는 검증 루프, CLAUDE.md 같은 리포 수준 가이드 파일 설계법, 멀티 에이전트 분업, 장시간 자율 작업의 체크포인트, 루프 폭주와 보상 해킹 같은 실패 모드까지 실전 관점에서 다룹니다.
2026-06-12 · 30 분 읽기 #ai#loop-engineering#ai-agent#claude-code#devops컨텍스트 엔지니어링 — AI 에이전트에게 기억을 설계해주는 법
프롬프트 엔지니어링의 시대가 저물고 컨텍스트 엔지니어링이 핵심 역량으로 떠올랐습니다. 컨텍스트 윈도우의 경제학, 메모리 계층 설계, 대화에서 사실을 자동 추출해 사용자 프로필을 구축하는 패턴, RAG와 메모리의 구분, compaction 전략, 평가 방법과 함정까지 실무 관점에서 정리합니다.
2026-06-12 · 31 분 읽기 #ai#context-engineering#llm#ai-agent#memoryAI가 짠 코드, 어떻게 리뷰할 것인가 — 코드리뷰의 재설계
AI 생성 코드가 급증하면서 코드리뷰가 개발 파이프라인의 최대 병목이 되었습니다. 사람 코드와 AI 코드의 결함 패턴 차이, 스펙 대조와 테스트 우선 검증 중심의 리뷰 전략 재설계, AI 1차 리뷰와 인간 최종 판단의 조합, OSS 메인테이너의 AI 기여 정책, 팀 정책 템플릿과 측정 지표까지 정리합니다.
2026-06-12 · 33 분 읽기 #ai#code-review#ai-agent#engineering-culture#open-sourceAI는 정말 둔화하고 있는가 — 데이터센터 경제학으로 읽는 2026 AI 버블 논쟁 ♪ 들을 수 있어요
2026년 상반기를 달군 AI is slowing down 논쟁을 데이터센터 경제학의 관점에서 분해합니다. 2030년까지 연 2조 달러 매출이 필요하다는 주장과 190GW 데이터센터 계획의 산수, 토큰 단가 하락과 마진 구조, 추론 수요 폭증이라는 반론, 닷컴 버블과의 비교, 그리고 개발자와 기업이 취해야 할 실용적 전략까지 균형 있게 다룹니다.
2026-06-12 · 41 분 읽기 #ai#economics#datacenter#gpu#infrastructure모방 기계는 발견할 수 없는가 — Rich Sutton의 도발과 RL의 반격 ♪ 들을 수 있어요
강화학습의 대부 Rich Sutton이 지도학습 기반 생성 AI는 모방 모델이라 새로운 과학적 발견에 한계가 있다고 주장하며 2026년 6월 커뮤니티를 달궜습니다. Bitter Lesson의 맥락에서 그의 주장을 해부하고, 모방 학습과 강화학습의 본질적 차이, 반론, 그리고 에이전트 설계에 주는 실무적 교훈을 정리합니다.
2026-06-12 · 44 분 읽기 #ai#reinforcement-learning#llm#research#ai-agentAI의 말은 누구의 말인가 — 독일 법원의 Google AI Overviews 책임 판결 ♪ 들을 수 있어요
2026년 6월 독일 법원이 Google AI Overviews를 검색 결과의 나열이 아닌 Google 자신의 발화로 분류하고, 허위 답변에 대한 직접 책임을 인정했습니다. 판결 논리를 해부하고, 기존 플랫폼 면책 법리와의 충돌, AI 답변 엔진을 만드는 개발자와 기업이 지금 점검해야 할 것들을 정리합니다.
2026-06-12 · 41 분 읽기 #ai#law#liability#rag#governance중국 AI 랩 2026 — DeepSeek·Qwen·Kimi·GLM·Yi·Doubao·Hunyuan 심층 가이드 (오픈 웨이트의 새로운 무게 중심) ♪ 들을 수 있어요
2024년 12월 DeepSeek-V3가 671B MoE를 공개하고 2025년 1월 R1이 reasoning까지 오픈 가중치로 풀었을 때, 세상은 잠시 멈췄다. 그 사이 알리바바 Qwen 3는 235B-A22B로 사실상 오픈 웨이트의 새 기준이 됐고, Moonshot의 Kimi K2는 1T MoE와 long-context로 long-form 챔피언이 됐고, Zhipu의 GLM-4.5는 age
2026-05-15 · 40 분 읽기 #ai#china#deepseek#qwen#alibabaLLM 에이전트 실전 완전 가이드: ReAct, Plan-Execute, Tool Use, 다중 에이전트 (2025)
2024년 "에이전트의 해" 다음으로 온 2025년은 "에이전트가 제품이 된 해"다. ReAct와 Plan-Execute의 경계, Tool use 설계 원칙, LangGraph 상태 머신, 다중 에이전트 오케스트레이션, MCP와 에이전트의 관계, 그리고 실패 루프와 보안까지. 현업 관점으로 정리한 한 편.
2026-04-15 · 25 분 읽기 #llm-agent#ai#react#plan-execute#tool-useMCP (Model Context Protocol) 완전 해부: 스펙, 전송, 보안, 서버 만들기, 엔터프라이즈 (2025)
Anthropic이 2024년 말 공개하고 2025년에 사실상 표준이 된 MCP. Resources·Tools·Prompts·Sampling 스펙과 전송 계층, OAuth 2.1 인증, 주요 서버(GitHub/Slack/Linear/Chrome/Playwright), 직접 서버 만들기, 보안 공격 벡터, 엔터프라이즈 운영까지. "LLM 시대의 USB-C"를 한 글로 해부합니다.
2026-04-15 · 21 분 읽기 #mcp#llm#ai#claude#protocolRAG 실전 완전 가이드: 검색, 임베딩, 벡터 DB, Fine-tuning의 경계 (2025)
LLM에 외부 지식을 붙이는 가장 실용적인 패턴, RAG. 2025년 시점에서 임베딩 모델 선택, 청킹 전략, 벡터 DB 선택, Rerank, Hybrid Search, 그리고 Fine-tuning과의 경계까지. Notion AI와 Claude의 검색 아키텍처를 해부하고, 한국어 RAG의 특수성과 비용·지연시간 최적화 체크리스트를 한 호흡에 정리합니다.
2026-04-15 · 33 분 읽기 #rag#llm#ai#vector-db#embedding