Deep Dive
Deep Dive

2026.07.16
AIエージェントにAWSの権限を渡したら1日で数万ドルの請求が来た — 人間速度を前提に設計された課金ガードレールは自律型AIに通用しない
7月16日、Steef-Jan Wiggersが「AI Agents with Cloud Credentials Are Outrunning Billing Guardrails Built for Human-Speed Mistakes」と題した記事を公開した。この記事では、クラウド認証情報を持つAIエージェントが、人間のスピードを前提に設計された課金ガードレールを突き破り、数時間で数万ドルの請求を発生させる事例について詳しく紹介されている。

2026.07.16
AIエージェントは「命令の密輸」より「事実の偽造」に弱い — 既存防御をすり抜ける新攻撃手法ADIが全6モデルで成立

2026.07.16
DeepSeekが75%値下げしても解決しない問題 — 1つの質問が3万5000トークンになるAIエージェントの収益構造

2026.07.16
GPT-5.6 Solの物体検出スコアが前世代から3倍超に — ただしコストとレイテンシではGemini 3.5 Flashが依然優勢

2026.07.16
LLMの次に来るのはこれ。「ワールドモデル」を今のうちに理解する
qiita.com

2026.07.16
AIは本当に「考えている」のか Apple論文が問いかけた推論モデルの限界とその行方
itmedia.co.jp

2026.07.16
日本有数のメガバンクは、いかにして「AI-Ready」な組織へ変わるのか。大手金融機関が挑むデータ基盤再設計のリアル - エンジニアtype
type.jp

2026.07.16
LLMの修復ループは何回で頭打ちになる?
ai-data-base.com

2026.07.16
GPT‑Redとは?OpenAIがAIでAIを攻撃し、GPT‑5.6の堅牢性を高めた仕組み
innovatopia.jp

2026.07.16
迷惑メール1通をサイバー脅威インテリジェンスへ変える ― AIサンドボックスと市民参加型防衛モデルの技術設計
qiita.com

2026.07.16
AIエージェントに性格を設定すると、コーディングの特徴が大きく変化する場合がある
ai-data-base.com

2026.07.16
AIで変える鉄道保全と、「クローズド」を読み解くクラウド設計 — AWS Summit Japan 2026 展示ブース開催報告
aws.amazon.com

2026.07.16
OpenAIがGPT-Redを本番モデルの訓練へ投入、攻防の共進化で安全性を自己改善
xenospectrum.com

2026.07.16
AIが書いたコードに人間のレビューは必要か——APIキーを直書きされて考えたこと
qiita.com

2026.07.16
「AIと壁打ちはもう古い」 業務タスクを任せる「Claude Cowork」の落とし穴
atmarkit.itmedia.co.jp

2026.07.16
AIによる工数削減を計測して見えた結果と考察
techblog.zozo.com

2026.07.16
【開催報告】AWS Summit Japan 2026 ― AI で加速する製品イノベーション 〜マルチエージェントで実現する製品開発
aws.amazon.com

2026.07.15
RAGのハルシネーション、犯人はLLMではなく検索だった — 正解ページが55位中最下位にランクされた実験が示す「プロンプト改善より先にやるべきこと」

2026.07.15
AIがテストコードの80%を書いても「残り20%と人間のレビュー時間」が本当のコスト — マルチエージェント導入の落とし穴

2026.07.15
紙1枚でロボットを1分以上止める「考えすぎ攻撃」 — カメラに映るだけで有効、印刷機があれば誰でも実行できる

2026.07.15
Gemini CLIへのロシア語一行プロンプトを起点に、6分でC&Cインフラを移行 — AIがコードもデバッグも自律実行、人間の作業はわずか11%