powered by TechFeed
表示モード
Deep Dive

Deep Dive

2026.09.03
ChatGPTに3つのデータセットを分析させたら毎回同じ箇所で間違えた — コードは正しくても答えが2.4倍ズレる理由
9月3日、KDNuggetsが「I Asked ChatGPT to Analyze 3 Datasets. It Made the Same Mistakes Every Time」と題した記事を公開した。ChatGPTに「平均配送時間は?」と聞いたところ、返ってきた数字は正解の2.4倍小さい値だった。コードにバグは一切なく、エラーも出ない。それでも答えは間違っている——この実験レポートは、LLMをデータ分析に使う際に見落とされがちな構造的な問題を、3つの小規模データセットを通じて記録している。
2026.09.03
LinkedInのAI採用アシスタントがレジュメ確認を80%削減 — 採用担当者との「1+1が10」を目指す
2026.09.03
AIが勝手に送金する時代、米議会が問う「そのエージェントは誰だ?」— 本人確認・責任の所在・ステーブルコイン規制をめぐる公聴会の論点
2026.09.03
AIエージェントのシステムプロンプトはセキュリティ対策にならない — AWS・SANSが示す「モデルを信頼しない」実装ガイド
2026.09.03
「まず自動化ありき」は失敗のもと — AWSが語る本番エージェント自動化の設計原則
2026.09.03
AIトークン価格が半年で60%暴落 — ハイパースケーラーが注ぎ込んだ6000億ドルのインフラ投資は回収できるのか
2026.09.03
AIがLinuxの脆弱性を1リリースあたり最大2,000件規模で発見し始め、人間のメンテナが対応しきれなくなっている
2026.09.03
AIエージェントの大規模運用で「トークンを詰め込むほど良い」は間違い — コスト爆発を防ぐシステム設計の原則
2026.09.03
企業AIのトークンコストを最大51分の1に削減する「組織の記憶層」OM2 — AIが毎回コンテキストを再構築する無駄をなくす
2026.09.03
英国・スウェーデンの議会文書の最大15%がAI生成と判定 — 開示した議員はゼロ件
2026.09.03
AIエージェントの「記憶」が攻撃の隠れ蓑に — 「動作確認して問題なし」がセキュリティの証明にならない時代へ
2026.09.03
AIコーディングエージェントがコードを書く前に攻撃される — GitSpawnがClaude Code・Codex・Cursorなど7ツールで任意コード実行を可能に
2026.09.03
45のAIエージェントを評価したら満点ゼロ — 「できる」と謳うブラウジング自動化の実態
2026.09.03
ランサムウェア攻撃がAIで10時間以内に完結する時代へ — 人間主体の対応フローは構造的に間に合わなくなりつつある
2026.09.03
AIがコードを増産する時代に「レビューの質」を守る — 「コーディング先行・AI二番手」アプローチと小規模チームが持続可能な開発の鍵になる
2026.09.03
ShopifyがLLMのシステムプロンプトを4分の1に圧縮する「Gisting」を実装 — レイテンシ38%改善とGPU削減を同時に実現
2026.09.03
LLMエージェントは16ステップで成功率がほぼ0%に崩落する — 1万件超の実験が示す「ベンチマーク合格≠本番で使える」の数学的証明
2026.09.03
370年間誰も解けなかった暗号をAIが44分で解読 — 「疲れずに試し続ける能力」がブレークスルーを生んだ
2026.09.03
AIエージェントのWebアプリ構築は「単純な質問」の最大1万倍の環境負荷 — タスクの複雑化で見えてきたカーボンコストの現実
2026.09.03
「Copilot、Word文書まとめて」で社内全滅? 勝手に増殖するAIウイルスで大騒ぎ
kn.itmedia.co.jp
2026.09.03
大手テック企業がプロプライエタリAIからオープンモデルへ移行——UberやStripeはコストを約50%削減