powered by TechFeed
表示モード
Deep Dive

Deep Dive

2026.06.30
ローカルLLMの速度はTFLOPSより「メモリ帯域幅」で決まる — 中古RTX 3090が最新RTX 5090より速い理由
6月30日、Vetted Consumerが「Bandwidth, Not TFLOPS: What Sets Your Local LLM Speed (and Why the Newest Card Isn't Always Fastest)」と題した記事を公開した。36 TFLOPSの中古RTX 3090が122 TFLOPSのAMD RX 7900 XTXを生成速度で3倍近く上回り、最大帯域幅を誇る最新RTX 5090すら下回る——この逆転現象の原因を、16種のGPU/Macの実測データで解き明かした記事だ。ローカルLLMのトークン生成速度を決める真の指標はTFLOPSではなくメモリ帯域幅であることが、データをもって示されている。
2026.06.30
OpenAI の システムは、Broadcom の Network 技術だけど、どこが違うの?
vengineer.hatenablog.com
2026.06.30
MozillaがAIコーディングエージェントの新たな脅威を実証 — 悪意あるコードが一切ないリポジトリで開発者マシンを完全掌握するリスクを実証
2026.06.30
RAGパイプラインがエンタープライズ初年度に高確率で失敗する理由と、クエリタイプ別に使い分ける4つの代替アーキテクチャ
2026.06.30
プロンプトに1,000件の例を入れても出力は変わらない — AIという「媒体」に何を持ち込むかで結果が決まる理由
2026.06.30
AIエージェントの「なりすまし」問題、DNSとTLS証明書の仕組みで解決へ — Linux FoundationがANS標準化に乗り出す
2026.06.30
ChatGPTのソース選定をネットワーク通信レベルで解析 — 「契約パブリッシャー枠」「商用スクレイパー枠」など内部ラベルの存在が明らかに
2026.06.30
Claude Code・Cursor・GitHub Copilot、どれを使うべきか — Collabnixが徹底比較した結果、3つ併用が現実解に
2026.06.30
AIに判断を任せたら実運用で失敗した — アジェンティックBIの中核をLLMではなくルールエンジンにした理由
2026.06.30
AIエージェントの「ツール説明文」が命令に化ける — MicrosoftがMCPポイズニング攻撃の実態を警告
2026.06.30
プロンプトを「設定ファイル」扱いすると本番が静かに壊れる — 回帰テストでサイレント劣化を検出する
2026.06.30
AIエージェントの指示ファイルを「学習パラメータ」として自動最適化するSkillOpt — GPT-5.5×ダイレクトチャット×6ベンチマーク平均で+23.5ポイント改善、全52評価セルで最良
2026.06.30
RAGを超えるAIエージェントの長期メモリ設計「Wikiメモリ」— ログや実験記録を「読める知識」に圧縮するアプローチが注目を集める
2026.06.30
AIエージェントが「読む」から「行動する」に変わると、攻撃も「情報漏洩」から「業務操作」に変わる — MCPツールポイズニングとその防御策
2026.06.30
米政府のAI輸出規制が中国モデルの追い上げを後押し — AnthropicモデルのシャットダウンのタイミングでGLM 5.2がトークン単価4分の1で市場へ
2026.06.30
RAGの回答品質はプロンプトではなく「コンテキスト設計」で決まる — 4種の型付き入力でLLMへの情報渡しを構造化する
2026.06.30
AIエージェントの「記憶」問題にMicrosoftが本気で向き合う — 「検索」を記憶の代わりに使うアーキテクチャの限界と、新研究Memoraの設計思想
2026.06.30
Claude Codeがシステムプロンプトに「見えないUnicode文字」でユーザー環境を分類している可能性——バイナリ解析で浮上した実装の不透明さ
2026.06.30
AIエージェントブラウザの7製品中4製品で30年分のブラウザセキュリティを迂回可能 — ワシントン大が警告「公開に値する水準にない」
2026.06.30
MCPサーバーの大半は存在すべきでない — 作る前にAPIとCLIを直すべき理由、8つのチェックリスト
2026.06.30
研究者がAIコーディングエージェント11種中10種を数十年前のシェル攻撃で突破 — 「テキストで検査、bashで実行」という設計の盲点