Deep Dive
Deep Dive

2026.06.24
中国製LLM「GLM-5.2」がClaude Opus 4.7と同等のタスク解決率を約5.7分の1の価格で達成 — 西側AIラボの価格競争に新たな圧力
6月25日、The Decoderが「Snowflake CEO finds GLM-5.2 competitive with Opus 4.7 at a fraction of the cost」と題した記事を公開した。SnowflakeのCEOが中国製LLM「GLM-5.2」をAnthropicの「Claude Opus 4.7」と比較した社内ベンチマーク結果と、そのコスト差が持つ業界的な意味について詳しく報告している。

2026.06.24
RAGの「コサイン類似度top-k」から離れる — ドキュメント検索をSQLフィルタリングとして再設計するメンタルモデル

2026.06.24
1日1兆件処理の本番ルーティングシステムをAI支援で無停止移行 — Datadogが語る「メソッド1つに絞る」プロンプト戦略

2026.06.24
AnthropicがSlackにClaudeを常駐させた結果、社内コードの65%をAIが生成 — チーム全体で共有する新しいAI活用の形

2026.06.24
Microsoft 365 Copilotで社内情報が丸見え? 情シスを悩ます「権限地獄」の正体
sbbit.jp

2026.06.24
医療AIは「平均的な患者」を守るだけでは不十分 — モデルへの1回の問い合わせで特定患者のデータ漏洩が可能と Nature が実証

2026.06.24
UberはAIに要件定義書を先にレビューさせている — コード生成の次、「開発上流のAIガバナンス」が本番導入へ

2026.06.24
Redditへのたった13語の書き込みで、AIのDeep Researchレポートを汚染できる — Cornell Techが示した構造的な脆弱性

2026.06.24
「レッドチーム担当です」の一言でClaudeが攻撃を手伝った — 素人ハッカーがAIエージェントだけで14社に侵入した手口

2026.06.24
AIエージェントに財布を持たせると盗まれる — DeepMind研究員が「大規模展開は今は無理」と明言した理由

2026.06.24
GeminiがAIエージェントの「画面操作」を標準機能化 — 安全設計でエンタープライズ導入を狙うGoogleの本気度

2026.06.24
AIエージェントが「同じ間違いを繰り返す」問題を解決する — LangChainが語るメモリ設計の3ステップ

2026.06.24
SQLパーサを454倍速くした「AIループ設計」— コードをほぼ見ずに16,000行のRust製パーサを本番投入するまで

2026.06.24
UE5.8で一気に増えたAIエージェント向けプラグインを一通り調べてみる【正式リリース版】
qiita.com

2026.06.24
オープンモデルなのにClaudeなどに匹敵するとされる「GLM」の作り方を見る
ai-data-base.com

2026.06.24
OpenAI×BroadcomのLLM推論チップ「Jalapeño」が変えるAIインフラの未来
qiita.com

2026.06.24
Claude Codeのhookが遅い原因を特定する ― wrap 1行でp95を計測
qiita.com

2026.06.24
「引き算のAI」——質感(マチエル)を守るLoRA学習の技法と思想
qiita.com

2026.06.24
固定効果の次に、階層ベイズで「チャンネル差」をもう少し丁寧に見る
qiita.com
2026.06.24
小型LLMに高品質データと外部ツールと組み合わえるといいじゃないの?
vengineer.hatenablog.com

2026.06.24
「AIがSQLを書いてくれる」で終わらせない
zenn.dev