ブログ
GPU・LLM・MLOps・Kubernetes、そしてマインドセット · 3516 件
#2026-03 764#japanese 587#deep-dive 254#kubernetes 249#culture 236#career 224#ai 217#llm 209#devops 196#2026-04 144#security 141#observability 113#database 110#communication 107#architecture 100#productivity 88#finance 87#mindset 80#ai-papers 79#history 79#it 78#psychology 78#english 75#networking 74#deep-learning 73#gpu 70#linux 70#performance 70#cs-fundamentals 63#ai-agent 61#postgresql 60#rag 59#economy 57#mlops 53#self-improvement 53#python 52#ai-platform 51#food 51#learning 51#travel 51
Langfuseのセルフホスト — 配備経路、シークレット、そして初回起動で引っかかるもの
Langfuseを自分で運用するには、コンテナ二つとデータストア四つを同時に立てる必要があります。本記事は公式ドキュメントを基準に、docker compose の経路とHelmチャートの経路をそれぞれ整理し、必ず自分で作って入れるシークレットは何か、PostgresとClickHouseの接続文字列がなぜ二つずつ必要か、オブジェクトストレージの設定でMinIOが要求するオプションは何かを押さえます。マイグレーションが自動で走る仕組みと
2026-08-14 · 15 分で読めます #observability#langfuse#self-hosting#docker-compose#kubernetesトレースが費用になるとき — Langfuseの保持、サンプリング、マスキング
トレーシングはトラフィックが少ないうちは無料のように見え、ある時点から保存費用と個人情報の問題として戻ってきます。本記事はLangfuseで量が費用に変わる地点を四つに分けて整理し、公式ドキュメントを基準にサンプリングがtrace単位で決まるという事実とそれが実務で何を意味するか、PythonとJSそれぞれのマスキング方式がデータをどの時点で隠すのかを確認します。保持ポリシーの既定値が削除しないであること、最小の保持期間と削除の基準にな
2026-08-14 · 16 分で読めます #observability#langfuse#cost#sampling#data-retentionRHEL 閉域網インストールが本当に難しい理由 — 依存関係はグラフであり、内側からは解けません
金融・公共・防衛の閉域網に RHEL パッケージを持ち込んでインストールするとき、なぜ「rpm ファイルを 1 つコピーする」で終わらないのかを構造から整理します。RPM の依存関係がリストではなくシンボル単位のグラフであること、そのグラフを解く depsolver がリポジトリメタデータ全体を必要とするのに閉域網の内側にはそれが存在しないこと、したがって問題は「ファイルを移すこと」ではなく「解決済みのトランザクションをまるごと移すこと
2026-08-14 · 15 分で読めます #linux#rhel#air-gap#dnf#rpm閉域網でのモジュールとバージョン固定 — RHEL 8・9・10 はそれぞれ違う話をします
RHEL 8 のモジュラリティが閉域網でどこでどう詰まるのか、そして RHEL 9 と RHEL 10 でその話がどう変わるのかを、公式ドキュメント基準で分けて整理します。核心は、モジュラー RPM をただコピーして作ったローカルリポジトリでは、それらのパッケージが静かに見えなくなるという点です。dnf がモジュールメタデータを使って RPM をフィルタリングするためで、解決策は reposync に --download-metada
2026-08-14 · 15 分で読めます #linux#rhel#air-gap#dnf#modularity閉域網の中にローカルリポジトリを作る — createrepo_c、repodata、.repo ファイルと GPG キー
持ち込んだ rpm の束を閉域網の中で正常な dnf リポジトリに仕立てるまでの全工程を扱います。createrepoc が生成する repodata ディレクトリの構造と repomd.xml の役割、パッケージを追加したときに --update で増分更新する方法、そしてチェックサムタイプとメタデータ圧縮オプションを公式 man ページ基準で整理します。続いて baseurl に file スキームを使う単一サーバー構成と、社内 H
2026-08-14 · 15 分で読めます #linux#rhel#air-gap#dnf#createrepo閉域網の運用プレイブック — セキュリティパッチに追随し、ロールバックし、CVE 遅延を管理する
持ち込み手順が完成したあとの話、つまり閉域網を何年も回していく運用編です。まず閉域網で CVE 対応が遅れるのはチームの怠慢ではなく持ち込み周期という構造のせいであることをはっきりさせ、その遅延をなくせないのなら、どう測定して管理するかを扱います。dnf updateinfo と --security 系のオプションで何が滞留しているかを数える方法を公式ドキュメント基準で整理しつつ、持ち込みリポジトリでこれらのコマンドが何も出力しないと
2026-08-14 · 19 分で読めます #linux#rhel#air-gap#dnf#security閉域網へのコンテナイメージ持ち込み — podman save と skopeo は別の道具です
RPM の持ち込み手順が固まると、次に来る要求はほぼ必ずコンテナイメージです。podman save と skopeo copy 系がどう違うのか — 一方はローカルのイメージストアを経由し、もう一方はレジストリからレジストリへ直接運ぶという点 — から整理し、複数のイメージをまとめて扱う閉域網ミラーリングになぜ skopeo sync が正解なのかを公式ドキュメントの表現とともに説明します。トランスポート表記を一つずつ確認し、持ち込み
2026-08-14 · 18 分で読めます #linux#rhel#air-gap#podman#skopeo閉域網の持ち込み手順と完全性 — 6 か月後も同じインストールが再現できるバンドルを作る
持ち込み媒体に何を入れて何を検証するのか、そしてそのバンドルを 6 か月後に開き直したときに同じ結果が出るようにする方法を整理します。閉域網では署名検証が接続網よりむしろ重要になる理由 — 媒体が内側に入った時点で、あとからオンラインで突き合わせる手段が失われること — をまず押さえ、rpm と rpmkeys の署名検査コマンドを最新の man ページ基準で区別して説明します。続いて再現可能なバンドルの核心であるマニフェストを具体的に
2026-08-14 · 13 分で読めます #linux#rhel#air-gap#rpm#gpg閉域網への持ち込みのために外側で受け取る — dnf download、reposync、yumdownloader はそれぞれ別の問題を解きます
インターネットに接続された機材で RHEL パッケージを依存関係ごとまとめて受け取り、閉域網へ持ち込むための実際の手順をコマンド単位で整理します。dnf download の --resolve と --alldeps が正確に何を変えるのか、なぜすでにインストール済みのパッケージのせいで依存関係が静かに抜け落ちるのか、そして --installroot で空のルートを作ってその落とし穴をなくす方法を、公式ドキュメントの文章とともに扱い
2026-08-14 · 15 分で読めます #linux#rhel#air-gap#dnf#rpmQwen3.8-27Bのハイブリッドアテンション — 64層のうちKVキャッシュを積むのは16層だけ
27Bのモデルが26万トークンのコンテキストをノートパソコンで扱える理由は、パラメータ数ではなく層の構成にあります。Qwen3.8-27Bは64層のうち48層を線形アテンション(Gated DeltaNet)に、16層だけを通常のアテンションに配置し、KVキャッシュが伸びる層そのものを4分の1に減らしました。この構造が何を節約して何を失うのか、FP8ブロック量子化はどこに効くのか、そしてローカル推論を検討するとき実際に計算すべき値は何か
2026-08-14 · 13 分で読めます #llm#inference#quantization#local-llm#attention分類せずに作り出せという技法とその検証 — 偽ラベルが元の問い合わせより良い理由
数百項目の分類体系をプロンプトに入れる代わりに、小さなモデルにもっともらしい偽の分類を作らせ、それを埋め込みで実際の分類に結び付ける技法が議論されました。なぜこれが動きうるのかは埋め込み空間の非対称性で説明されます。ただし原文には測定結果がなく、コメントにはこの技法が本当に元の問い合わせを直接埋め込むより良いのかを問う正確な反論と、より安い代替が並びました。何をどう測るべきかまで整理します。
2026-08-14 · 14 分で読めます #llm#embedding#classification#search#retrievalDRAMアドレススクランブリングとセキュリティ境界の下層 — 柵が変換より上にあると起きること
CPU内部で最も隠されたメモリ領域を、DRAMコントローラのアドレス変換を揺らして読み出す研究ツールが公開されました。脆弱性は暗号にも権限チェックにもありません。保護の柵がアドレス変換より上の層に建てられているという配置そのものにあります。この構造がなぜ崩れるのか、別名アドレスをGF(2)上の線形代数とSMTソルバでどう復元するのか、そしてこの研究が実際に何を要求し何を要求しないのかを範囲を明確にして整理します。
2026-08-14 · 13 分で読めます #security#hardware#memory#reverse-engineering#firmwareMistral OCR 4.1のブロック単位の信頼度スコア — 文書パイプラインで人をどこに置くかを決める値
MistralがOCR 4.1を公開し、段落単位のバウンディングボックスと構造ブロックのラベル、そしてブロックごとの信頼度スコアを出しました。文書パイプラインを作ったことがある人にとって実際に重要なのは3つ目です。信頼度スコアがあれば全数レビューと無レビューの間に閾値という選択肢が生まれるからです。その閾値をどう決めるか、信頼度を確率と取り違えると何が壊れるか、そしてページ単価を基準に自前構築がいつ有利になるかを計算します。
2026-08-14 · 12 分で読めます #ocr#document-ai#data-pipeline#human-in-the-loop#cost-optimization準同型暗号コンパイラHEIRとコストという条件 — 発表文にない数字をコメントが埋めた事例
Googleが準同型暗号向けのオープンソースコンパイラツールチェーンHEIRを公開しました。ここでの本当のニュースは暗号ではなくコンパイラです。これまで準同型暗号の実配備を阻んできたのは数学ではなく、暗号の専門家にしかできなかったパラメータ選択の作業だったからです。ただし発表文はオーバーヘッドの数値を1つも示しておらず、その空欄をこの分野を研究したコメント投稿者たちが埋めました。どのワークロードが適用対象で、どれがまだそうでないかをその
2026-08-14 · 14 分で読めます #cryptography#privacy#compiler#machine-learning#securityDeepSeek Harnessのプラグインカーネル構造 — 巻き戻せるエージェントは何が違うのか
DeepSeekが公開したオープンソースのコーディングエージェントHarnessは、モデルもツールもUIもすべてプラグインにした構造です。ただし実際に興味深いのはプラグインという言葉ではなく、2つの設計判断です。1つはすべての実行を追記専用のイベントログに残し、再開・分岐・再生を同じストリーム上で扱うこと、もう1つはプラグインを外すときに副作用を巻き戻すことを強制する点です。この構造が何を可能にするのか、そしてプラグイン生態系への古い反
2026-08-14 · 13 分で読めます #ai-agent#architecture#plugin-system#observability#open-source理解がボトルネックだという主張とその循環 — 説明を生成した側が検証対象であるとき
エージェントがコードを作る速度が人の読む速度を超えたとき何が残るかを扱った記事が議論を集めました。著者は検証のための理解から参加のための理解へ目標を移そうと提案し、3つの仕掛けを出します。ところがコメントで出た最も強い反論は、その説明自体をモデルが書くなら検証が成り立つのかという循環の指摘でした。提案された仕掛けのどれがこの反論に耐え、どれが耐えないかを切り分けます。
2026-08-14 · 13 分で読めます #engineering-culture#code-review#developer-experience#documentation#ai-assisted-development657,607本のリンクを辿った結果とURLの寿命 — リンクはなぜ404ではなく接続失敗で死ぬのか
2009年から2014年の間に作られた短縮リンク65万本あまりを2026年にすべて辿った調査が公開されました。結果より重要なのは失敗の内訳です。死んだリンクの大半は404ではなく接続そのものが成立しない状態であり、これは内容が移動したのではなくインフラが消えたという意味です。調査手法の限界まで押さえたうえで、外部URLをデータとして保管するシステムで何を変えるべきかを整理します。
2026-08-14 · 13 分で読めます #web#data-engineering#archival#reliability#url-designGemini 3.7 Flashの導入価格と3週間サイクル — モデル原価を固定費ではなく条件付きの値として扱う理由
Gemini 3.7 Flashの発表で実務者が見るべきはベンチマークの上げ幅ではなく、2つの事実です。1つは特定の日付で単価が2倍になる導入価格の構造、もう1つは直前のモデルが3週間前に出たという点です。2つが重なると、モデル原価は固定費ではなく期限付きの条件付きの値になります。公開されたベンチマークが何と比較し何と比較していないのか、そして発表で最後まで公開されなかった2つの数字がなぜアーキテクチャを決める数字なのかを整理します。
2026-08-14 · 12 分で読めます #llm#cost-optimization#benchmark#api-design#capacity-planningCerebras Ultrafastとエージェントループのボトルネック — 毎秒750トークンでも減らない時間
CerebrasとOpenAIが毎秒最大750トークンを出す推論ティアを公開しました。発表文が挙げる原理は演算量ではなくデータ移動であり、重みをウェハ上のSRAMに置く方式です。なぜバッチ1のデコードがメモリ帯域に縛られるのか、公開された倍率が何を測り何を測っていないのか、そしてトークン生成が速くなっても減らない時間が自分のエージェントループで何パーセントかを計算する方法を整理します。
2026-08-14 · 13 分で読めます #llm#inference#hardware#latency#performanceいま注目のオープンソース (6) スター数が語ってくれないこと
スター数は人気の指標であって、リスクの指標ではありません。オープンソースを本番に入れる前に実際に確認すべきシグナルを整理します。最近のコミットとリリース周期、イシューへの応答、コントリビューターの分布とバス係数を GitHub API で自分で数える方法、ライセンスが自動分類されないときに LICENSE ファイルを直接読む必要がある理由、そして導入前のチェックリストをまとめました。シリーズで実際に確認した事例を根拠にしており、リポジト
2026-08-12 · 10 分で読めます #open-source#governance#supply-chain#risk#devops