僕が引っかかっているのは、コンテキストウィンドウが逼迫してからの振る舞いです。50万トークンを超えたあたりで、「判断を誤っていました」とオーケストレーター自身が言い出す。阿部さんが挙げたのは、そこではなく調査の詰めの甘さでした。エフォートを上げると逆に品質が落ちるという噂の理由も、意外な角度から出てきます。
話は、自作のメディエーターに作っている見守り機能へ広がります。長時間の実行を見守る監視役を任せるのは、Codexなのか、Opusなのか。レビューを任せると元の方針までガラッと変わるという阿部さんの実感に、スキルづくりだけは任せられないという僕の線引きが並び、結論は宿題として残りました。
終盤は価格の話に移ります。100万トークンあたり入力2ドル・出力10ドルというClaude Sonnet 5の値付けを、OpenRouterの画面でDeepSeek V4 ProやKimi、GPT-5.6 Lunaと見比べました。Sonnetに求めていたものは何だったのかを考え直しています。
【関連リンク】
▼Claude Opus 5 発表(Anthropic)
https://www.anthropic.com/news/claude-opus-5
▼Claude Fable 5 / Mythos 5 発表(Anthropic)
https://www.anthropic.com/news/claude-fable-5-mythos-5
▼Claude Sonnet 5 発表(Anthropic)
https://www.anthropic.com/news/claude-sonnet-5
▼GPT-5.6 Luna(OpenAI 開発者ドキュメント)
https://developers.openai.com/api/docs/models/gpt-5.6-luna
▼OpenRouter
https://openrouter.ai/
▼Codex(OpenAI 公式リポジトリ)
https://github.com/openai/codex
【配信サービス】
▼Spotify
https://open.spotify.com/show/5b4x1u0M2f0Kmr1Xnv1Z7r?si=12580ee9ade0414e
▼Youtube
https://youtube.com/@ai-nichijo-fm
▼Apple Podcasts
https://podcasts.apple.com/jp/podcast/ai%E9%A7%86%E5%8B%95%E9%96%8B%E7%99%BA%E9%83%A8%E3%81%AE%E6%97%A5%E5%B8%B8/id1843990202
▼amazon music
https://music.amazon.co.jp/podcasts/4fd4926b-a654-4dc7-a858-01ff5e0e8c25/ai%E9%A7%86%E5%8B%95%E9%96%8B%E7%99%BA%E9%83%A8%E3%81%AE%E6%97%A5%E5%B8%B8
▼stand.fm
https://stand.fm/channels/68dc82a9036795923c400b4f
▼LISTEN
https://listen.style/p/ai-nichijo-fm?xtIZk9qq
---
stand.fmでは、この放送にいいね・コメント・レター送信ができます。
https://stand.fm/channels/68dc82a9036795923c400b4f
感想
まだ感想はありません。最初の1件を書きましょう!
サマリー
今回のエピソードでは、Claude Opus 5のリリースを起点に、Fable 5との比較や実際の使用感について語られています。Opus 5は多くのベンチマークでFable 5を上回る性能を示しましたが、特にコンテキストウィンドウが逼迫した際の挙動や、調査の詰めが甘い点が課題として挙げられました。また、長時間実行の見守り機能や、モデルの価格設定についても議論が展開され、DeepSeek V4 ProやKimi、GPT-5.6 Lunaといった他のモデルとの比較も行われました。
コメント
似ているエピソード
タイトル・AI要約・文字起こしの話題をもとにおすすめしています。
-
49【Opus 4.8とどう違う?】Claude Fable 5に任せた開発
AI駆動開発部の日常
今回のエピソードでは、Claude Fable 5の利用期間延長を機に、開発者の山本さんと阿部さんが実際にAIに任せたタスクについて語ら...
-
42【圧倒的性能】Claude Fable 5のファーストインプレッション
AI駆動開発部の日常
本エピソードでは、Anthropicがリリースした最新モデル「Claude Fable 5」のファーストインプレッションを共有します。Claude Fa...
-
60【Claude Fable 5.1の実力】ファーストインプレッション
AI駆動開発部の日常
今回のエピソードでは、AnthropicのClaude Fable 5.1のファーストインプレッションについて語られています。ベンチマークスコア...
-
356. Fable5がすごかった
aozora.fm
今回のエピソードでは、高性能なAIモデル「Fable5」について掘り下げています。特に、壁打ち(ブレインストーミング)におけるFa...
-
[7月7日:速報回]Fable5復活!AI開発は今後どう変わる?(ep.84)
おちつきAIラジオ
今回の速報回では、Anthropicの強力なAIモデル「Fable5」の復活と、その一時的な公開停止、そして高額な利用料が話題の中心とな...
-
2【Claude Sonnet 4.5】GPT-5-Codexより優っている?
AI駆動開発部の日常
このエピソードでは、クロードソネット4.5の機能とGPT-5-Codexの比較が主なテーマとなっています。AI駆動開発における新しいモデ...
-
[7月21日:速報回]Fable 5が実質解禁!Fable相当のKimi K3は1/3コスト。NVIDIA CEOにも会ってきた(ep.88)
おちつきAIラジオ
今回のエピソードでは、最新のAIトレンドとパーソナルな体験が語られました。まず、Anthropicの最上位AIモデル「Claude Fable 5...
-
#138 GPT-6 Astra vs Claude Fable 5.1
耳で学ぶAI、ロボシンク
OpenAIのGPT-6 AstraとAnthropicのClaude Fable 5.1という両社の最新最上位モデルを比較しました。API価格やコンテキストウィン...