powered by TechFeed
表示モード
Deep Dive

Deep Dive

2026.07.29
AIの回答を疑ったら、32B MoE蒸留が2.65倍速くなった ─ RTX 3090でGPU利用率37%の原因を追跡した記録
はじめに 大規模言語モデルの知識蒸留では、教師モデルのlogitsを事前計算して保存する手法が有効です。学習時にGPU上に教師モデルをロードする必要がなくなり、VRAM制約の厳しい環境でも大規模な生徒モデルを学習できます。 しかし、教師モデルが32B規模のMoE(Mixt...
2026.07.29
自動運転、AI丸投げに「ちょっと待ったー!」 E2Eが急ブレーキ?
jidounten-lab.com
2026.07.29
なぜAIのコストは想定以上に高くなるのか? 企業に迫られる「推論設計」への転換
itmedia.co.jp
2026.07.29
AI研究自動化に備える「国際ブレーキ」、フロンティア企業の従業員1,272人が整備要求
xenospectrum.com
2026.07.29
【論文著者インタビューあり】そのAIエージェントはどれくらい危ない恐れがあるのか、点数で決める方法
ai-data-base.com
2026.07.29
クリーンアーキテクチャはコーディングエージェント(Claude Code)に不利か、同一仕様の2実装で64ラン測った
qiita.com
2026.07.29
そのAIエージェント、いつから本番を任せますか?
m3tech.blog
2026.07.29
AIと外部ツールをつなぐ共通規格「MCP」が過去最大のアップデート、セッション廃止で何が変わったのか?
gigazine.net
2026.07.29
MCP の tool と resource の使い分け
tech-lab.sios.jp
2026.07.29
「SVGとして正しい」だけでは足りない:Gemini Nanoによるブラウザ内ベクター生成の品質改善
qiita.com
2026.07.29
Synapse 開発日記: LLM 切り替えで露呈する社内 AI エージェントのモデル依存性
tech.kanmu.co.jp
2026.07.28
MetaがGPUを遊ばせるストレージボトルネックを解消 — データ取り込みを150分から10分に短縮した多層キャッシュ設計
2026.07.28
完璧なMCPサーバーが38%と判定された — 嘘をついていたのは評価の方だった
2026.07.28
DatabricksがAIコーディングエージェントの青天井コストを解決した方法 — 日次・月次の2段階管理に切り替えたら承認チケットがほぼゼロになった
2026.07.28
最新AIモデルへの課金、ほとんどの用途では不要 — ベンチマーク改善はコーディング寄りで、日常的な質問・調査は旧モデルで十分なケースが多いという現実
2026.07.28
AIの本番運用で「8,432行目のクラッシュ」にどう対処するか — Salesforceが語る、失敗しないワークフロー設計の原則
2026.07.28
AIエージェントは「コンテキストなし」だと推測するだけ — Databricks・AWS・Snowflakeら主要ベンダーが相次いでコンテキスト層の整備へ
2026.07.28
AIがLinuxカーネルのゼロデイ解析を「既知の脆弱性と同じ難度」に下げた — root権限奪取エクスプロイトの開発過程を研究者が公開
2026.07.28
なぜSkild AIだけコードを公開しないのか:GR00T・openpiとの違い
qiita.com
2026.07.28
AIが生成したコードは「セキュリティ機能だけ作って、認可チェックを忘れた」 — 金融システムで全ユーザーデータが筒抜けになった実例
2026.07.28
UberがAIコストに月1,500ドルの上限設定、7万CPUコア削減も実現した「ハードウェアを増やさずにスケールする」戦略とは