powered by TechFeed
表示モード
Deep Dive

Deep Dive

2026.07.12
GPT-5.6 vs. Claude Fable 5、何が違うのか — 入力価格10倍差・3層構成vs単一モデル、用途で選び分ける時代に
7月10日、TechStartupsが「GPT-5.6 vs. Claude Fable 5: Which AI Model Is Better? The Ultimate 2026 Comparison」と題した記事を公開した。OpenAIの「GPT-5.6」はSol/Terra/Lunaの3層構成、AnthropicのClaude Fable 5は単一Mythosクラスモデル——設計思想の違いは、API入力価格にして**$1対$10という最大10倍の差**にも表れている。どちらをどの用途に選ぶべきかについて、アーキテクチャ・価格・コーディング性能・エンタープライズ適性など複数の観点から比較されている。
2026.07.12
2016年の文字列結合アルゴリズムをLLMの「忘却バイアス」に応用 — Sequential比95%高速化、情報網羅率100%を両立する「Pyramid Aggregation」
2026.07.12
AIコードレビューが「読む側のコスト」になっている — ボットがボットに返信する時代に失われる開発者の注意力
2026.07.12
AIエージェントにサブエージェントを使うべきか、ツールで十分か — 「推論が必要かどうか」だけで判断する設計原則
2026.07.12
RPAの「壊れやすさ」を構造で解決する — AIエージェント自動化を5層に分解すると何が見えるか
2026.07.12
動画生成モデルの「流用」をやめてロボット制御用AIをゼロから作ったら — 推論速度6.5倍・制御周波数225Hzを達成したAnt Groupの新アーキテクチャ
2026.07.12
AIエージェントがインフラを使う時代、プラットフォームエンジニアリングはどう変わるか — CNCFが整理した「2.0」への5つの変化
2026.07.12
AIコードレビューのベンチマークは「正確に的外れを射抜いている」 — 人間向けとエージェント向けで問題が分裂しているのに、同じ指標で測ることの根本的な誤り
2026.07.12
AIエージェントは「ちょっとした誘導」に人間より圧倒的に従順 — デフォルト選択には99〜100%、悪い選択肢のハイライトにも83〜100%が追従することが判明
2026.07.12
AIが書いたコードは誰も理解していない — 「レビュー負債」という見えないコストを定量化する試み
2026.07.12
LangChain・LlamaIndex・生APIコール、どれを選ぶべきか — プロトタイプで固定すると本番で外せなくなる、フレームワーク選定の判断基準
2026.07.12
RAGは「何を答えるか」、ファインチューニングは「どう答えるか」 — LLMカスタマイズ2大手法の本当の使い分け
2026.07.12
チャットログを5層の構造化メモリに置き換えたAIエージェントがSlay the Spire 2で勝率2倍に — 「コンテキスト腐敗」問題への実践的な解法
2026.07.12
Claude Codeはプロンプトを読む前に3.3万トークンを消費している — OpenCodeと実測比較して判明したAIエージェントの隠れたコスト構造
2026.07.12
DeepSeekより34倍高いGPT-5.6を中国エンジニアが選ぶ理由 — 「トークン単価」より「タスクあたりの実コスト」で比べると逆転する
2026.07.12
GPT-5.6への移行で2.2倍速・27%コスト削減 — ツール引数の「発明」やキャッシュ設計の落とし穴を本番データで解説
2026.07.12
「最大モデルが勝つ」時代の終わり — AIレースの競争軸がベンチマークからコスト効率へ移行しつつある
2026.07.12
LLMは何を考えているのか? アンソロピックが見つけた「隠れた領域」
technologyreview.jp
2026.07.12
Claude Codeはプロンプト入力前に33,000トークン消費している — OpenCodeの4.7倍のオーバーヘッドをAPIレベルで実測
2026.07.12
公開3日で停止された「Claude Fable 5」はなぜ復活できたのか、解除の裏側と実際に使って分かった実力とは
iotnews.jp
2026.07.12
Claude Codeの組み込みブラウザは何がすごいのか?DOMについて理解すると少し見えてくるはず。
qiita.com