ブログ
GPU・LLM・MLOps・Kubernetes、そしてマインドセット · 3516 件
#2026-03 764#japanese 587#deep-dive 254#kubernetes 249#culture 236#career 224#ai 217#llm 209#devops 196#2026-04 144#security 141#observability 113#database 110#communication 107#architecture 100#productivity 88#finance 87#mindset 80#ai-papers 79#history 79#it 78#psychology 78#english 75#networking 74#deep-learning 73#gpu 70#linux 70#performance 70#cs-fundamentals 63#ai-agent 61#postgresql 60#rag 59#economy 57#mlops 53#self-improvement 53#python 52#ai-platform 51#food 51#learning 51#travel 51
Servoの埋め込みはcrates.ioに載り、Versoは止まった — ウェブビュー断片化問題の2026年中間点検
Tauriがバイナリを小さく保つ秘訣は、OSのウェブビュー(WebKitGTK・WKWebView・WebView2)を借りて使うことであり、その代償が、プラットフォームごとに微妙にレンダリングが異なるウェブビュー断片化です。この問題からの脱出口として注目されていたServoベースのウェブビューVersoは、2025年10月にGitHubミラーが「もはやメンテナンスされていない」という告知とともにアーカイブされ、tauri-runtim
2026-07-17 · 21 分で読めます #desktop#tauri#servo#webview#rustRAG・ファインチューニング・ロングコンテキスト — 自分の問題には何を使うべきか:論文が実際に測ったもの、そして誰も測っていないもの ♪ 聞けます
LLMアーキテクチャで最も頻繁に出る質問ですが、大半の答えは出典のない意思決定ツリーです。本稿は測定されたものだけで答えます。ファインチューニングが新しい知識の注入に失敗することは複数の論文で繰り返し測定されており(Ovadiaら、Gekhmanら)、正反対に見える農業のケーススタディは実は別の介入(教師なし継続事前学習 vs 教師ありQ&Aチューニング)を測ったものなので、矛盾ではありません。ロングコンテキストは位置・長さ・語彙という
2026-07-17 · 43 分で読めます #rag#llm#fine-tuning#long-context#aiOpenBaoはVaultから実際どれだけ乖離したか — v2.6のネームスペース封印まで、リリースノートで辿る分岐点
OpenBao v2.0.0 GA(2024-07-17)からちょうど2年が経ち、3日前にはv2.6.0が出ました。本稿は「BUSL移行は裏切り」対「持続可能性」といった陣営論理を退け、両プロジェクトが自ら公開したリリースノート・チェンジログ・コミットだけをもとに、フォークが実際どこで分岐したかを確認します。OpenBaoはVault Enterprise専用だったネームスペースをv2.3.1でオープンソース化し、v2.6.0ではアップ
2026-07-17 · 17 分で読めます #security#open-source#devops#licensingWayland色管理はどのリリースに載ったか — 5年かかったプロトコルの配布年代記、そしてXサーバーの2026年
Waylandの色管理・HDRプロトコルcolor-management-v1は、2020年1月に開かれたマージリクエストが2025年2月にようやくマージされた、5年がかりの標準化の産物です。本稿はニュース記事ではなく、リポジトリの記録から配布時点をピンで留めます — MutterはGNOME 48(2025年3月)で公式プロトコルを、49でcolor-representationを、50(2026年3月)でプロトコルv2とHDR画面共
2026-07-17 · 23 分で読めます #linux#wayland#hdr#color-management#x11SvelteKit 3.0 プレリリースを読む — 壊れるもの、締まるデフォルト、そしていまだexperimentalなもの
2026年6月5日からnpmに@sveltejs/kit 3.0.0-nextのプレリリースが上がり始め、7月14日にnext.8まで来ました。チェンジログを最初から最後まで読むと、SvelteKit 3は機能メジャーではなく、土台上げと負債清算のメジャーだとわかります — Node 22・TypeScript 6・Vite 8(rolldown 1.0内蔵)・Svelte 5.48を最低ラインに引き上げ、$app/storesと$ap
2026-07-17 · 20 分で読めます #svelte#sveltekit#frontend#vite#migrationPodman 6.0 — slirp4netns・CNI・cgroups v1削除、macOSのデフォルトプロバイダーはlibkrunに
2026年6月24日、Podman 5.0以来27ヶ月ぶりのメジャーリリースとなる6.0.0が公開されました。slirp4netns・CNI・iptables・cgroups v1・BoltDBのサポートが一挙に削除され、Intel MacとWindows 10のサポートも打ち切られ、macOSのデフォルトmachineプロバイダーがapplehvからlibkrunに変わりました。CNCFへの移管に伴い、GitHub組織とGoインポート
2026-07-17 · 21 分で読めます #container#podman#docker#linux#macossystemd v261 — PID 1に来た段階的ロールアウト、クラウドIMDSの取り込み、そしてdlopen移行の完成
2026年6月19日にリリースされたsystemd v261は、ユニットをfleetの指定割合でしか有効にしないConditionFraction=、マシンタグでリングを分けるConditionMachineTag=、そして9つのパブリッククラウドのインスタンスメタデータをシステムcredentialとして取り込む新しいIMDSサブシステムを搭載し、libcを除くすべての外部ライブラリリンクをdlopen()に置き換える複数年がかりの作
2026-07-17 · 27 分で読めます #linux#systemd#devops#cloud#sysadminMinIO Community Edition はこうして終わった — リポジトリの記録から再構成したタイムラインと、Garage・SeaweedFS・Ceph RGW の現在地
2026年4月25日にminio/minioリポジトリがGitHubでアーカイブされ、7月14日にはmcクライアントのリポジトリまで読み取り専用になりました。怒りに満ちたスレッドは数多くありますが、本稿は怒りではなく記録をたどります — 2025年5月のコンソール機能削除、9月のDocker Hubイメージ停止、10月15日の最終リリースとソースコード専用配布の宣言、12月のメンテナンスモード、2026年のアーカイブ連鎖まで、すべてリポ
2026-07-17 · 24 分で読めます #storage#object-storage#s3#minio#open-sourceNATS Server 2.14 — 高速バッチパブリッシュ、サーバー内蔵スケジュール、そして2.15前に片付けておく宿題
2026年4月30日にリリースされたNATS Server 2.14は、JetStreamにフロー制御を内蔵した高速バッチパブリッシュ(fast batch publish)、cron形式の繰り返しスケジュールとサブジェクトサンプリング、WorkQueue・Interestストリームソーシングの永続(durable)コンシューマーへの切り替え、コンシューマーリセットAPIを追加しました。2.13はスキップされましたが、理由は公式に説明さ
2026-07-17 · 24 分で読めます #messaging#nats#distributed-systems#release-notesPyTorch 2.13のtorchcomms — c10dを置き換えにきた新しい分散通信バックエンド
2026年7月8日にリリースされたPyTorch 2.13のハイライトのうち、最も構造的な変化はtorchcomms — PyTorch Distributedの新しい通信バックエンドが、コアのCIとDeviceMeshの経路に統合され始めたことです。torchcommsは2025年10月にMetaが発表した実験的な通信APIで、グローバル状態ベースのc10d ProcessGroupの技術的負債(NCCL中心の設計、lazy init
2026-07-17 · 18 分で読めます #pytorch#distributed-training#nccl#deep-learningJPEG XL の復活、どこまで本物か — Chromium の方針転換から8か月、ソースで確認した現在地
2022年10月、Chromium はエコシステムの関心不足を理由に JPEG XL のコードを削除し、この決定は3年以上にわたって画像フォーマット論争の代表例であり続けました。2025年11月22日、Chrome の ATL は4年前のまさにその blink-dev スレッドで方針を転換しました — ただし「性能が良くメモリ安全なデコーダーの貢献」と「デフォルト有効化に向けた長期的な保守の約束」という条件付きです。本稿は、この方針転換
2026-07-17 · 23 分で読めます #multimedia#jpeg-xl#chromium#browser#web-performanceNeo4j カレンダーバージョニング時代の中間点検 — ブロックフォーマット、Cypher 25、そしてGQLがエンジンに着地する方法
Neo4jは2025年初頭にカレンダーバージョニング(CalVer)へ移行して以来、約17か月で18件のフィーチャーリリースを出しており、各リリースのホットフィックス提供は次のリリースが出た瞬間に終わります。この記事を書いている2026年7月時点で、CalVerラインにはまだLTSが存在せず、安定サポートが必要なら5.26 LTS(ホットフィックスは2028年6月まで)に留まる必要があり、その代償としてCypher 25、VECTOR型
2026-07-17 · 24 分で読めます #database#neo4j#graph-database#cypher#gqlRay 2.56のラベルロカリティスケジューリング — 配置グループがノードではなくNVLinkラックを見始めた
2026年6月29日に出たRay 2.56.0は、配置グループにドメインレベルのスケジューリング層をアルファとして追加しました。これまでPACKやSTRICTPACKといった配置戦略はすべてノード単位でしか動かず、GB200・GB300 NVL72のようにNVLinkドメインが複数ノードにまたがるラックでは「この配置グループを1つのラックの中に全部入れてくれ」を表現する方法がありませんでした。新しいラベルロカリティスケジューリングは、r
2026-07-17 · 19 分で読めます #ray#gpu#scheduling#distributed-systemsLLM APIコストを実際に下げる方法 — 「キャッシング90%割引」が請求書ではなぜ25%なのか ♪ 聞けます
プロンプトキャッシングのキャッシュ読み取りは入力価格の10分の1です。しかし、それが請求書を90%削ってくれるわけではありません。Anthropicが自社ドキュメントに載せている計算例をそのまま追うと、キャッシュが完全に効いた状態でも総額は0.705ドルから0.525ドルへ、25.5%しか減りません。理由は単純です — 割引はその項目に使うお金の割合の分だけしか請求書を減らさず、出力トークンがすでにコストの60%を食っているからです。こ
2026-07-17 · 38 分で読めます #llm#cost-optimization#prompt-caching#api#aiOPAは今、誰がメンテナンスしているのか — StyraチームのApple合流、その後11か月の検証可能な記録
2025年8月20日、OPAの創始者たちとStyraのチームメンバー多数がAppleに合流するという発表があり、コミュニティには「AppleがOPAを買収した」という噂が流れました。一次情報で確認すると実態は異なります — 会社や資産を買収したという発表はどこにもなく、人々が転職しただけで、OPAはCNCF卒業プロジェクトのまま残りました。本稿は、その発表の正確な文言、その後11か月間に実際に起きたこと — 月次リリースケイデンスの維持
2026-07-17 · 20 分で読めます #security#opa#authorization#open-sourceGraphQL スペック、ほぼ4年ぶりのリリース — September 2025 エディションと GraphQL.js 17 GA に入ったもの、まだ外にあるもの
GraphQLスペックはOctober 2021以来ほぼ4年ぶりにSeptember 2025エディションへ更新され、参照実装のGraphQL.jsは4年を超えるアルファ期間を経て2026年6月15日にv17 GAを出しました。本稿は両リリースに実際に入ったもの — OneOf入力オブジェクト、Schema Coordinates、実行器の分離、AbortSignal — と、依然として入っていないものを、スペック原文・npmレジストリ
2026-07-17 · 22 分で読めます #graphql#graphql-js#api-design#federationローカルでLLMを動かすにはVRAMがどれだけ必要か — 表ではなく数式で計算する ♪ 聞けます
「8Bモデルには何GB必要ですか」の正解は表ではなく2つの数式です。重みはパラメータ数 × bpw ÷ 8、KVキャッシュは2 × レイヤー数 × KVヘッド数 × headdim × バイト数 × トークン数です。本稿はこの2つの式をllama.cppのソースと公式の表に直接照らして検証します — ggmlのブロック構造体から導いたQ80の8.5 bpwはllama.cppが公表した8.5008と小数第3位まで一致し、同じやり方で逆算
2026-07-17 · 43 分で読めます #llm#quantization#kv-cache#local-llm#gpuHome Assistant Matter サーバー 9.0 — 公式C++ SDKを捨ててmatter.jsで書き直した理由
2026年6月23日、Home AssistantのMatterサーバーが9.0にアップグレードされ、Python + 公式C++ SDK(connectedhomeip)ベースの実装が、TypeScriptで最初から書き直されたmatter.jsベースのサーバーへ丸ごと置き換わりました。再起動と再接続が速くなり(部分インタビュー)、OTAアップデートがコントローラーに統合され、テスト証明書デバイスのコミッショニングがオプトインに変わる
2026-07-17 · 20 分で読めます #iot#smart-home#home-assistant#matter#threadコンテキストエンジニアリングはプロンプトエンジニアリングを置き換えた言葉なのか — 測定されたものと、そうでないもの ♪ 聞けます
「プロンプトエンジニアリングは死んだ」という文は、この用語を生んだどの一次出典にもありません。Karpathyはfew-shotの例とタスク説明をコンテキストエンジニアリングの構成要素として列挙し、Anthropicは「プロンプトエンジニアリングの自然な進展(natural progression)」と書きました。つまり代替ではなく包含です。それでも、これが本当に別の仕事だという根拠はあります — ChromaのLongMemEval実
2026-07-17 · 37 分で読めます #llm#context-engineering#prompt-engineering#long-context#ai-agentMedia over QUIC の現在地 — 仕様は draft-19、最大の実配備は draft-07、最初の提案者は moq-lite へ
WebRTCのインタラクティブな低遅延とHLS/DASHのスケーラビリティを一つのアーキテクチャに統合しようとするIETFのMedia over QUIC(MoQ)は、2026年7月6日にdraft-ietf-moq-transport-19まで来ており、ワーキンググループのマイルストーンは2026年末のIESG提出を目標に据えています。ところが現実の配備は別の場所にあります — 誰でもつなげる最大のリレーであるCloudflareのネ
2026-07-17 · 22 分で読めます #network#quic#streaming#webrtc#rfc