ブログ
GPU・LLM・MLOps・Kubernetes、そしてマインドセット · 3516 件
#2026-03 764#japanese 587#deep-dive 254#kubernetes 249#culture 236#career 224#ai 217#llm 209#devops 196#2026-04 144#security 141#observability 113#database 110#communication 107#architecture 100#productivity 88#finance 87#mindset 80#ai-papers 79#history 79#it 78#psychology 78#english 75#networking 74#deep-learning 73#gpu 70#linux 70#performance 70#cs-fundamentals 63#ai-agent 61#postgresql 60#rag 59#economy 57#mlops 53#self-improvement 53#python 52#ai-platform 51#food 51#learning 51#travel 51
GPT-5.6とコストパフォーマンスの限界 — 曲線の上で自分のワークロードの位置を見つける方法
OpenAIが2026年7月30日にGPT-5.6 Lunaの価格を80%、Terraを20%下げました。7月9日の正式リリースから3週間後で、最上位のSolの価格は据え置きです。Lunaは100万トークンあたり入力1ドル・出力6ドルから、入力0.20ドル・出力1.20ドルになりました。この記事は値下げ幅を紹介する代わりに曲線を計算します — 値下げ後の三つのティアの単価比が両軸ともちょうど25対10対1に固定され、系列の中ではトークン
2026-07-31 · 20 分で読めます #ai#llm#openai#inference-cost#prompt-caching2026年のデータツール地形の読み方 — ツール一覧ではなく層ごとの決定として
2026年7月28日、GeekNewsに「開発者のためのデータツール地形ガイド」が投稿され51ポイントを獲得しました。良い地図ですが、地図は目的地を選んでくれません。この記事は同じ地形を五つの層に分け、各層で実際に下すべき決定が何かを整理します。テーブルフォーマット戦争がIceberg v3で事実上終結し、争いがカタログへ移った経緯、DuckDB級の単一ノードエンジンがクラスタの仕事をローカルへ引き寄せる流れ、FivetranとdbtL
2026-07-31 · 26 分で読めます #data-engineering#lakehouse#iceberg#duckdb#data-platformGCCのAI方針とオープンソースの選択 — 15行という境界線は何を守ろうとしているのか
2026年7月29日、GCC運営委員会がAI方針作業部会の勧告を受け入れました。核心は、法的に重要な貢献にLLM生成コンテンツが含まれる、またはそれに由来する場合は受け付けないというもので、その基準線はGNUメンテナーガイドラインのおよそ15行です。ただしテストケースは例外で、研究・分析・バグ発見・パッチレビューにLLMを使うこと自体は制限せず、AI補助作業にはAssisted-byトレーラーを要求します。この記事は方針の実際の要求事項
2026-07-31 · 23 分で読めます #ai#open-source#gcc#licensing#governance偽の著者名を持つ論文が口頭発表に採択された — AI時代のピアレビューにおけるシステム的失敗の分析
2026年7月30日、二人のレビュアーが今夏担当した機械学習系学会の投稿22本のうち15本で、捏造された引用、実在しない著者、または明白なLLM生成の痕跡を見つけたと公開しました。うち二本は実在する論文の著者名を架空の名前に差し替えて引用しており、リジェクト意見と組織委員会への直接通報にもかかわらず、「幻覚の参考文献だけ直せばよい」という条件で口頭発表に採択されました。この記事は怒りではなくシステムの失敗としてこの事件を読みます。フラグ
2026-07-31 · 25 分で読めます #ai#peer-review#research-integrity#llm#academiaリファクタリングの経済学、コストはいつ回収されるか — 変更頻度で計算する方法
2026年7月30日にmartinfowler.comに掲載されたThe Economic Benefit of Refactoringは、約1万7千行のモジュールを15段階でリファクタリングしながら、同じ変更要求を毎回繰り返し実行し、入力トークンが159,564個から27,360個へと83パーセント減少することを測定しました。興味深い実験ですが、著者自身が単一の実験であり、グリーンフィールドのアプリ一つに限られると釘を刺しています。こ
2026-07-31 · 29 分で読めます #refactoring#engineering#technical-debt#ai#metricsマークダウン/MDXパイプライン性能 — satteriとネイティブコアが実際に変えるもの
JavaScript生態系向けの高性能Markdown・MDXプロセッサsatteriがGeekNewsに上がり、ドキュメントサイトのビルド時間が再び話題になりました。この記事は数千ページ規模のMDXビルドで時間が実際にどこへ行くのかを、パース・変換・コンパイル・バンドル・プリレンダリングの五段階に分けて示し、推測ではなく計測するプロファイリング手順を提示します。unified/remark/rehypeのプラグインチェーンがなぜコスト
2026-07-31 · 25 分で読めます #mdx#markdown#build-performance#unified#static-siteGemini Robotics 2とロボット基盤モデル — 全身制御が実際に変えるもの
2026年7月30日、Google DeepMindがGemini Robotics 2を公開し、ヒューマノイドのつま先から指先までを一つのビジョン・ランゲージ・アクションモデルで制御すると発表しました。一緒に公開された数字は興味深いことに自慢ではなく現状の正直な記録に近いものです — 電球を緩めるのに92パーセント、締めるのに36パーセント、床から物を拾うのに45.7パーセント。この記事はVLAが実際に何なのか、全身制御がなぜ上半身操
2026-07-31 · 25 分で読めます #ai#robotics#vla#foundation-models#evaluationJava の Value Objects(JEP 401)が変えるもの — アイデンティティを手放して得るものと失うもの
2026年7月31日00時45分UTC、JEP 401 Value Objectsの実装がOpenJDKのメインラインにマージされました。JEP 539(Strict Field Initialization)とひとつのコミットにまとめられ、1,888ファイルに約20万8千行が追加されました。Project Valhallaが2014年に始まってから12年目のことです。この記事はアイデンティティを持たないオブジェクトとは正確に何か、性能
2026-07-31 · 27 分で読めます #java#jvm#valhalla#jep-401#performance蒸留で転移するものとしないもの — DeepSeekをGPT-OSSに蒸留したら検閲は付いてこなかった
2026年7月30日にShow HNへ上がったCTGTの実験は、DeepSeek V4 Flashを教師、GPT-OSSを生徒として金融推論能力を蒸留したところ、能力は移ってきたのに政治的検閲は移ってこなかったと報告しています。対応ペア152組で教師はセンシティブな質問と対照群のあいだに45.45点の検閲ギャップを示しましたが、生徒は0.43点と3.94点でベースラインにとどまりました。この記事はその実験ひとつを拡大せず、出発点としてだ
2026-07-31 · 22 分で読めます #ai#llm#distillation#alignment#open-weightsAIが6月のたった1か月で2年分のChromeバグを直した方法 — 1,072という数字の読み方
2026年7月30日にGoogleが発表した内容によれば、6月にリリースされたChrome 149と150の2バージョンだけで1,072件のセキュリティバグを修正し、これは過去2年間・23のマイルストーンで修正した1,036件を上回ります。その中には13年以上コードベースに潜んでいたサンドボックスエスケープのバグもありました。この記事は見出しの数字ではなくメカニズムを見ます — 2023年のLLMベースのファズターゲット生成から、202
2026-07-31 · 22 分で読めます #ai#security#chrome#fuzzing#vulnerabilityAIエージェントを本番で運用するということ — 冪等性、予算、そして自信満々の誤答
エージェントをプロトタイプから本番へ移すとき、遅れて見つかる運用面があります。リトライされたツール呼び出しの冪等性、予算とステップ上限、非決定的な制御フローの可観測性、ツール単位の権限境界、そしてエージェントが自信満々に間違えたときのエスカレーション経路です。最近GeekNewsのAsk GNに投稿された分析は、ベンチマークのトレース6,780件から重複ツール実行8,042件を見つけ、そのうち159件は状態を変えるツールが実際に重複リソ
2026-07-31 · 29 分で読めます #ai#agents#observability#reliability#mcpプロンプトで3D CADを作るということ — メッシュとB-rep、そして制約条件というボトルネック
GeekNewsのShow GNに、プロンプトで3D CADモデルを作るツールCAIDが投稿されました。作った本人が自ら明かした限界がこの分野全体の状態を正確に要約しています — 寸法の自動検証がなく、公差とDFMと加工性を判断できず、出力物をそのまま製造に使ってはいけない検証済みプロトタイプにすぎないということです。エンジニアリングの視点からの問いは一つです。CADはパラメトリックで制約ベースなのに、メッシュを生成することと編集可能な
2026-07-31 · 22 分で読めます #ai#cad#llm#manufacturing#geometryマネージャーになるということの真実 — シニアエンジニアに会議が足される話ではない
2026年7月末にGeekNewsへ投稿された「マネージャーになるということの真実」は、14項目を並べた個人の経験エッセイです。この記事は、その項目群がなぜ繰り返し現れるのかを構造として説明します。マネージャー職の本質は仕事量の増加ではなく出力関数の入れ替えであり、アンディ・グローブの定義どおり出力がチームの出力に変わった瞬間、フィードバックループは分単位から四半期単位へ伸び、判読可能性を失います。個人スループットという指標がなぜ機能し
2026-07-31 · 26 分で読めます #career#engineering-management#leadership#ic-to-manager#feedback-loop社内ナレッジベースをLLMで作るということ — 権限認識検索、鮮度、そして公開前の評価セット
Cerebrasが2026年7月15日に公開した社内ナレッジベース構築記は、1日15,000件を超える問い合わせを人間と自動化とエージェントが一緒に投げるシステムの内部構造を明らかにしています。しかし社内ナレッジベースでチームが実際に過小評価しがちなのは、チャンキングやリランキングではなく、権限、鮮度、削除伝播、そして真実源の衝突です。HR文書を漏らす検索はないほうがましで、すでに廃止されたランブックを自信満々に引用する検索はウィキより
2026-07-31 · 26 分で読めます #ai#rag#enterprise-search#llm#platform-engineeringミッチェル・ハシモトの二社目Superlogical — 公開されたことと公開されていないこと
2026年7月29日、ミッチェル・ハシモトが新会社Superlogicalを公開し、Hacker Newsで776ポイント、コメント452件を集めました。最初の製品はターミナルマルチプレクサで、libghosttyをMITライセンスの部品として使います。この記事はファン心理を抜きにして整理します。発表で実際に公開されたこと(チーム4人、投資家名簿、Ghosttyは非営利のまま)と公開されていないこと(調達額、バリュエーション、リリース時
2026-07-31 · 23 分で読めます #developer-tools#startup#ghostty#terminal#infrastructureBunのZigからRustへの書き換え11日間 — AI大規模マイグレーションで実際に持ち帰れるもの
Bunが53万5千行のZigコードを11日でRustへ移した過程を一次ソースで追いかけます。2026年5月3日から14日まで、最大64個のClaudeインスタンス、約50個のワークフロー、6,502個のコミット、API定価換算で約16万5千ドルがかかりました。この記事が関心を持つのは11日という数字ではなく、その数字を成立させた条件です — 言語に依存しないテストスイートというオラクル、ファイル対ファイルで対応する構造保存の翻訳、そして
2026-07-31 · 24 分で読めます #ai#bun#rust#migration#testingAIでコードベースを移す実践手順 — 審判を先に立て、行数ではなくレビュー率を測る
2026年上半期に公開された大規模LLMマイグレーションの事例(53万5千行のZigからRustへ、16万5千行のPythonからTypeScriptへ)から共通の手順を抜き出し、実行可能な順序に整理します。核心は順序です — 翻訳を始める前に振る舞いのオラクルを立て、わざと壊したコードでそのオラクルが落ちるかどうかをまず確認します。そのうえで検証可能な境界で切ってキューを作り、完了判定をディスクの状態に任せてすべての工程を元に戻せるよ
2026-07-31 · 23 分で読めます #ai#migration#refactoring#testing#engineeringセルフホスト型デプロイ基盤の選び方 2026 — Coolify・Dokploy・CapRover・Kamal・Openshipを分ける五つの軸
内蔵CI/CDを備えたセルフホスト型デプロイプラットフォームOpenshipがGeekNewsに上がり、また同じ問いが戻ってきました。マネージドPaaSを離れて自前運用に踏み切るべきか。本稿はCoolify、Dokploy、CapRover、Kamal 2、Openship、そして素のcompose構成を、実際に判断を分ける五つの軸 — コントロールプレーンの所在、ロールバック経路、シークレットの扱い、マルチノード対応、運用負担 — で
2026-07-31 · 21 分で読めます #self-hosting#deployment#paas#kamal#coolifyエンジニアはGo-to-Marketプレイブックをどう読むべきか — 流通が製品品質に勝る領域
2026年7月末、GeekNewsにNFXの「アップグレードされたGo-To-Marketプレイブック」が投稿されました。VCが書いた視点記事であり、中の数字はサンプルではなく選び抜かれたエピソードです。この記事はそのプレイブックを技術者読者向けに翻訳します。流通が製品品質に勝る領域はどこか、開発者向けセルフサーブの実際のコンバージョン率はどれくらいか(開発者向け製品の中央値コンバージョン率は非開発者向けの半分です)、time to f
2026-07-31 · 25 分で読めます #startup#go-to-market#product-led-growth#developer-tools#careerDeepSeek V4 Flashが実際に変えるもの — リーダーボードではなく能力あたり単価の問題
2026年7月31日、DeepSeekがV4-Flash APIを公開ベータに切り替えました。アーキテクチャは4月のプレビューと同じ284Bの総パラメータ・13BアクティブのMoEに1Mコンテキストで、変わったのはポストトレーニングだけです。公式チェンジログが公開したスコアはTerminal Bench 2.1で82.7、Toolathlon verifiedで70.3ですが、これらの数字はDeepSeekが自社ハーネスで測ったベンダー
2026-07-31 · 19 分で読めます #ai#llm#deepseek#inference-cost#moe