ブログ
GPU・LLM・MLOps・Kubernetes、そしてマインドセット · 3516 件
#2026-03 764#japanese 587#deep-dive 254#kubernetes 249#culture 236#career 224#ai 217#llm 209#devops 196#2026-04 144#security 141#observability 113#database 110#communication 107#architecture 100#productivity 88#finance 87#mindset 80#ai-papers 79#history 79#it 78#psychology 78#english 75#networking 74#deep-learning 73#gpu 70#linux 70#performance 70#cs-fundamentals 63#ai-agent 61#postgresql 60#rag 59#economy 57#mlops 53#self-improvement 53#python 52#ai-platform 51#food 51#learning 51#travel 51
エージェントを五つ回せば本当に五倍速くなるのか — 並列作業のボトルネックは生成ではありません
コーディングエージェントを複数同時に回す専用環境が増えています。Orcaはそのひとつで、プロンプトひとつを複数のエージェントに撒き、それぞれを別々のgit worktreeに隔離したうえで結果を比べ、ひとつをマージする方式を掲げます。ところがスループットを上げてもボトルネックは消えず、場所を移します。移った先がレビューとマージであることを待ち行列理論の一行で押さえ、ツールを入れる前にgit worktreeだけで同じワークフローを試す方
2026-08-09 · 16 分で読めます #developer-tools#git#worktree#code-review#workflowドメインが自ら売り物だと告げる方法 — DNSはいつから主張を載せるチャネルになったのか
登録済みでサイトもちゃんと表示されるドメインが、実は売る意思を持っている。その事実を機械が知る方法はこれまでありませんでした。RFC 10023は、アンダースコアで始まるノード名ひとつとTXTレコードの形式でその信号を定義します。この文書を手がかりに、DNSが古くから名前解決を超えてドメインに関する主張を載せる公開チャネルとして使われてきた経緯と、そのパターンが配備しやすい代わりに信頼を与えられない理由を整理しました。レコードの正確な文
2026-08-09 · 14 分で読めます #dns#rfc#networking#domain#protocol遅かったのはCPUではなくシステムコールの経路だった — スマホをサーバーにして学ぶこと
CMF Phone 1を個人インフラのサーバーにした事例を通じて、Linux互換レイヤの実際のコストがどこに付くのかを整理します。著者はpostmarketOSのフラッシュに失敗したあとストックのAndroidを維持し、Termuxをホストの制御プレーンとしました。一般的なウェブサービスはPRootで十分でしたが、Chromiumベースのワークロードだけはユーザースペースの変換レイヤのせいで余っているCPUに到達できませんでした。解決は
2026-08-09 · 17 分で読めます #linux#termux#chroot#proot#self-hostingハーネスは設定ではなくデプロイ成果物です — 自己改善ループの本当のボトルネック
Lilian Wengが2026年7月にまとめたハーネスエンジニアリングの記事は、モデルを包むシステム全体にひとつの工学対象としての名前を与えます。この記事はその定義を移すのではなく、ハーネスを設定ファイルではなくバージョンの付いたデプロイ成果物として扱うと何が変わるのかを扱います。ハーネスの指紋を取って回帰を捕まえる方法、コンテキストを伸び続けるプロンプトではなくプレイブックとして扱う方法、そして自己改善ループの本当のボトルネックがな
2026-08-09 · 13 分で読めます #llm#agent#harness-engineering#context-engineering#evaluationバス係数は知っている人の数ではなく、決められる人の数だ
Nixpkgsのコアチームが10か月で解散しました。貢献者が数千人いるリポジトリで、委任された意思決定権限を持つ人は二人であり、その二人が退いたことでその管轄は直接の持ち主がいない状態になりました。この出来事を根拠に、依存関係のリスクを評価するときスター数やコミット数ではなく、承認権限を持つ人の数、委任構造の実効性、エスカレーション経路を見るべき理由を整理し、GitHub APIで自分で数えられる指標とその限界も併せて扱います。原文の発
2026-08-09 · 16 分で読めます #devops#open-source#governance#nix#supply-chain300倍はPostgreSQLをチューニングして出た数字ではない — 火山モデルとベクトル化実行
pgrust 0.2のリリースとともに公開された300倍という数字を正確に解剖します。この数値はPostgreSQLの設定を変えて出たものではなく、Rustで新しく実装したデータベースをClickBenchで測定した結果であり、著者本人が別に提示したSUMクエリの実験は火山モデルの1.3秒からSIMDの135ミリ秒まで9.6倍を示します。バッチ、演算子融合、SIMDがそれぞれ何を取り除くのかをコードのレベルで追い、著者が自ら明かした限界
2026-08-09 · 15 分で読めます #postgresql#database#performance#query-engine#simdレジストリを増やしたのに可用性は変わらない — zotのスケールアウトが実際に売っているもの
zotを例にコンテナレジストリの拡張設計を分解します。一貫性ハッシュでリポジトリをインスタンスに割り当て、所有者でないノードはプロキシとして転送する構造はシャーディングであって高可用性ではなく、公式ドキュメントも自己修復しないと明記しています。コンピュート専用の拡張とコンピュート兼ストレージの拡張がそれぞれ何を諦めるのか、boltdbキャッシュドライバがインスタンス数を事実上ひとつに縛る理由、ミラーリングでダイジェスト固定が壊れる条件、
2026-08-09 · 14 分で読めます #devops#oci#registry#zot#container参照コストが読めるものを決めます — 2000年前のテキストからコード探索まで
ギリシア語とラテン語の原典1,060編を集め、どの単語を押してもその場で見出し語と形態解析と辞書項目が出てくるサイトが公開されました。すごいのはテキストの量ではなく、参照コストをゼロにしたことです。1回20秒を200回やれば、そのテキストは読めないテキストになるからです。このサイトがどう作られ、何を限界として明示しているかを確認したうえで、同じ論理が私たちのコードベースでどう働くかへつなげます。
2026-08-09 · 14 分で読めます #developer-tools#code-navigation#ide#reading#tooling画面は十文字で書かれます — カスタムウィジェットを作る前に問うべきひとつのこと
ヤコブ・ニールセンは、ほぼすべてのユーザーインターフェースが十個ほどの要素で組み立てられると整理しました。アルファベット二十六文字ですべての英単語を書くのと同じように、です。この一覧が有用なのは何を作るべきかを教えるからではなく、新しいウィジェットを作るとき実際には何を捨てているのかを見せてくれるからです。順位が含んでいる情報、慣習を半分だけ破ってしまう四つのよくあるやり方、そして自分たちのデザインシステム一覧に今日つけられるラベルまで
2026-08-09 · 14 分で読めます #ui-design#ux#design-system#frontend#usabilityウェブエディタに定規が無い本当の理由 — 測る定規が無いのではなく、測る紙が無いのです
Wordにあってウェブエディタに無いもののうち、もっともよく要望される機能がルーラーです。誰も作っていないからではありません。ウェブにはページというモデルが無いので、センチメートルが何に対するセンチメートルなのかから決められないからです。最近公開されたeditor-rulerを手がかりに、ルーラーをつけるという決定がなぜUI部品ひとつではなく文書モデルひとつを引き入れる決定なのか、そしてその決定に何がついてくるのかを整理しました。
2026-08-09 · 14 分で読めます #frontend#rich-text-editor#ui-design#contenteditable#developer-tools同じ会社の二つのプロジェクトがAI寄与に正反対の結論を出した理由
OpenJDKは2026年4月に生成AIで作った寄与を全面的に禁止し、同じオラクル傘下のGraalVMは同じ時期にAIコーディングアシスタントの使用を明示的に許可しました。二つのプロジェクトは同じ寄与者協定を使っています。この記事は三つの文書を並べて読みます。OpenJDKの原文、GraalVMの方針ファイル、そして両方が参照したLinuxカーネルの文書です。結論は、この違いがAIに対する態度の違いではなく、レビューの負担を誰に請求する
2026-08-09 · 15 分で読めます #culture#open-source#ai#policy#code-review提出物が安くなると評価はどこへ移るのか — デンマークが口頭試問を選んだ理由
デンマーク教育省が、家で書く試験課題に口頭での弁明を義務づける緊急パッケージを打ち出しました。書く費用がゼロに近づくと提出物だけでは何も分からなくなり、評価は成果物から著者性の証拠へ移ります。発表された措置が正確に何であり、三つがそれぞれ何を狙っているのかを原文どおりに整理したうえで、この論理を採用課題とコードレビューへ移すときにどこまでが成り立ちどこで壊れるのかを分けて書きました。
2026-08-09 · 16 分で読めます #assessment#hiring#code-review#education#engineering-culture摩擦が消えると目利きが残るのではなく、目利きを育てる道が消えます
2026年8月に話題になったエッセイ Taste Is All That Is Left は、作ることが安くなるにつれて、何を作る価値があるのかを判断する能力だけが希少になったと言います。この記事はその診断に同意しつつ、もう一歩踏み込みます。目利きは努力という濾過装置の副産物であり、濾過装置が消えれば目利きが自動的に残るのではなく、目利きを育てていた経路が一緒に消えます。ですから必要なのは摩擦を意図的に復元する具体的な習慣であり、個人と
2026-08-09 · 14 分で読めます #career#craft#ai#code-review#mentoringデータレジデンシーはドロップダウンではなく複製トポロジーだ
Fastmailが2026年8月3日にEUデータリージョンを開くにあたって公開した文書を教材にして、データの所在地がなぜリージョンの選択ひとつで決まらないのかを整理します。主コピー、レプリカ、災害用バックアップ、全世界に複製されるメタデータ、ログ、サードパーティ連携、そして障害時のフォールバック経路は、それぞれ別の場所を持ちうるし実際に持っています。FastmailはEUアカウントのレプリカが米国にあり、バックアップはフィラデルフィアに
2026-08-09 · 16 分で読めます #architecture#data-residency#gdpr#replication#complianceデプロイこそが負荷テストだ — キャッシュを満たす費用を設計しないと起きること
Canvaがゲートウェイのインメモリなセッション無効化キャッシュをMySQLからS3へ移した過程を分解します。問題は定常状態の参照費用ではなく、デプロイのたびに数百のポッドが同時にキャッシュを満たしながらデータベースを叩く起動費用であり、解決策はキャッシュ層をもうひとつ載せることではなくデータの表現を変えることでした。12時間のスライディングウィンドウを30分の断片に切り、無効化ひとつを16バイトに押し込んで整列した配列にすると、ゲート
2026-08-09 · 16 分で読めます #architecture#caching#s3#scalability#deployment写真の入ったQRコードは何を対価に払っているのか — 誤り訂正は予算です
QRコードのなかに写真を入れる技法を分解すると、それがデザインの決定ではなく予算配分の決定だという事実が見えてきます。きれいに見せるために使われる余裕は、もともとくしゃくしゃになった紙と悪い照明のために残しておいたものだからです。モジュールひとつを九マスに割る方法、その結果生じる九分の一のノイズ、そして誤差拡散を二度回すことで予算を使わずにより清潔な絵を得る方法まで、元資料の説明をたどりながら整理しました。
2026-08-09 · 15 分で読めます #algorithm#qr-code#error-correction#dithering#image-processingLLMができないのは証明ではなく前提を立てることです
ICML 2026の立場論文 Position: LLMs can not jump は、生成AIが帰納をすでにマスターし演繹も急速に征服しつつある一方で、新しい説明仮説を作り出すアブダクションには構造的に到達できないと主張します。この記事はその主張を要約する代わりに、それが事実だと仮定したときに、いま私たちが作っているシステムの設計をどう変えるべきかを扱います。仮説空間をどこから供給するのか、提案と反証をなぜ分離すべきなのか、そしてこ
2026-08-09 · 15 分で読めます #ai#llm#reasoning#abduction#research評価駆動開発で最初に較正すべきなのは審査者です
Airbnbエンジニアリングが2026年7月に公開した評価駆動開発の振り返りは、評価セットを先に書けという話ではなく、採点する側のモデルがまず計測器として認められなければならないという話に近いものです。この記事は、審査者モデルをゴールデンセット50〜100件で較正する手順、一致度を単純な正確度ではなくカッパで測るべき理由、そして較正されていない審査者がどうやってチーム全体を誤った方向へ最適化させてしまうのかを、実行可能なコードとともに整
2026-08-09 · 16 分で読めます #ai#llm#eval-driven-development#llm-as-judge#evaluation型検査を通った二つのサービスが互いを待って止まるとき — コレオグラフィという別のアプローチ
メモリ安全を保証する言語を使っても、二つのサービスが互いのメッセージを待って止まることは防げません。型検査器の視野がプロセスひとつで終わるからです。コレオグラフィプログラミングはシステム全体をひとつのプログラムとして書き、コンパイラにノードごとのコードを取り出させることで、この境界自体をなくします。最近公開されたWyzerを手がかりに、エンドポイント射影とは何か、なぜデッドロックが設計上消えるのか、そしてこの言語がいまどの段階にあるのか
2026-08-09 · 14 分で読めます #programming-languages#compiler#distributed-systems#type-systems#concurrencyコードは難しい部分ではなかったという言葉が、なぜあれほど腹立たしいのか
2026年8月にHacker Newsの上位を占めたあるエッセイは、コードはもともと難しい部分ではなかったという言葉がすべてのプログラマーへの侮辱だと主張します。この記事はその反論に同意しつつ、理由を別のところに見ます。あの文が腹立たしいのは間違っているからではなく、コードという単語の意味を途中ですり替えるからです。コードを三つの層に割れば、双方の主張がそれぞれどこで真なのかが見え、自分のチームが実際どの層に時間を使っているのかも測れま
2026-08-09 · 15 分で読めます #career#craft#ai#engineering-culture#skills