Video yükleniyor...

Video Yüklenemedi

Ana Sayfaya Dön

Fable 5の後継モデル「Claude Fable 5.1」について知っておくべきことまとめ Claude Fable 5.1について重要な情報をまとめました。入出力の単価はFable 5と同じまま、キャッシュ読み取りが75%安くなり、公式は典型用途で約25%、エージェント用途で最大約45%の実効コスト減と説明しています。 ・AnthropicがClaude Fable 5.1を発表。Fable 5の後継で、長時間のagentic coding、知識労働、リサーチ向け。同時発表のMythos 5.1は招待制 ・コンテキストウィンドウは1Mトークン、最大出力は128kトークン。アダプティブ・シンキング(adaptive thinking)は常時有効 ・API価格は入力$10/出力$50(100万トークンあたり)でFable 5と同額 ・プロンプトキャッシュの読み込み(prompt cache read)は$1→$0.25/100万トークン(75%減)。同じ文脈を繰り返し読み込むエージェント用途で効果的 ・公式ベンチマークでは、Terminal-Bench-Science 0.1スコアがFable 5の24.7%から52.6%に向上 ・提供先はClaude API、Amazon Bedrock、Google Cloud、Microsoft Foundry。モデルIDは claude-fable-5-1(Bedrockは anthropic.claude-fable-5-1)

205,289 görüntüleme • 1 ay önce •via X (Twitter)

0 Yorum

Yorum bulunmuyor

Orijinal gönderinin yorumları burada görünecek

Benzer Videolar

ついに一般提供が始まったMythos級モデル、「Claude Fable 5」について知っておくべきことまとめ Claude Fable 5 について重要な情報をまとめました。5,000万行のコードベース移行を1日で完了するなど、必見の内容です。 ・Anthropic は Claude Fable 5 を発表。Opusの上位に位置する「Mythos級」として初の一般提供で、Claude 5ファミリーの第1弾 ・APIモデル名は claude-fable-5。Claude API・AWS・Google Cloud・Microsoft Foundryで本日より利用可能 ・ほぼ全ベンチマークでSOTA。SWE-bench Proで80.3%を記録し、Opus 4.8(69.2%)、GPT-5.5(58.6%)、Gemini 3.1 Pro(54.2%)を上回る ・タスクが長く複雑なほど差が拡大。Stripeの検証では、5,000万行のRubyコードベース全体の移行を1日で完了(従来はチームで2か月超) ・視覚タスクでもSOTA。ポケモン ファイアレッドを画面情報のみの最小構成でクリア ・Claude Codeでは1Mトークンのコンテキストウィンドウに対応(Pro/Max/Team/Enterprise) ・サイバー / 生物化学 / 蒸留に関する質問は分類器が検知し、Opus 4.8が代わりに応答(通知あり)。発動はセッションの5%未満で、1,000時間超の外部バグバウンティでもユニバーサル・ジェイルブレイクは未発見 ・価格は$10/$50(入力/出力、100万トークンあたり)。プロンプトキャッシュの入力90%割引も適用 ・Pro/Max/Team等のサブスクでは6/22まで追加費用なしで利用可能。6/23以降は使用量クレジットが必要に(容量が整い次第、プラン標準への復帰を予定) ・ビジネス利用では、Mythos級モデルの全トラフィックに30日間のデータ保持が適用(安全性監視のためで、モデル学習には不使用) Anthropicのデスクトップ責任者Felix Rieseberg氏: 「Fable 5で第3の時代が始まった。質問→タスク→責任へ」 氏はクラッシュ調査を依頼するのをやめ、全レポートを監視するループをClaudeに常時実行させているとのこと。 仕事の単位が「タスク」から「責任」に変わる、という見立て。

AGIラボ

163,568 görüntüleme • 3 ay önce

【動画解説】Claude Opus 5の性能比較と公式発表のOpus 5の性能を上げる方法 普段使いはもうこれで良いと思います。 触った感じFable 5級を感じます。動画編集も今回Opus 5で全て行いましたが、精度は良かったです。 また、試しに1行だけ指示してポケモン風ゲームを作らせたら、テスト65項目まで自分で通して一撃で完成しました。 ・自律コーディング 43.3%(Opus 4.8の約2倍) ・未知のルールへの対応は約3倍(ARC-AGI-3) ・PC操作はFable 5の1/3のコスト ・業務ワークフローは同コストで1.5倍のパス率 ・逸脱行動スコアが最少で、長時間まかせても暴走しにくい そしてもう一つ大きいのが、Anthropic自身がClaude Codeのシステムプロンプトを80%以上削除しても、社内のコーディング評価は落ちなかったという話。 これからは「AIを管理する」より「AIが判断しやすい環境を作る」。 指示の書き方そのものが変わります。 使い分けと、明日からやることまで全部まとめました👇 ■動画 ■タイムライン 00:00 オープニング(速報:Opus 5が公開) 02:07 価格と基本スペック($5 / $25) 02:39 ベンチマークで見る実力 04:22 未知への対応が約3倍 05:29 1行の指示でポケモン風ゲームを作らせた 09:32 本当のニュースはコスト曲線 12:26 Claude 5時代のコンテキスト設計 17:49 今日からの3アクション

チャエン | デジライズ CEO《重要AIニュースを毎日最速で発信⚡️》

32,520 görüntüleme • 2 ay önce

Qwen3.8-27Bがでたのでシューティングゲームを作ってもらったのだけど、Claudeの作業ルールを読んで実装していて驚いた😊 4090一枚でQwen3.8-27B(Q4量子化)をllama.cppで動かして、opencodeから指示。全部ローカルで完結してるのでAPI代はもちろんゼロです。 ここまではまあ想定通りだったわけですが、ゲームを作る手順がかなり効率的だった🤔 自分がClaude用に書いてた作業ルール(CLAUDE.md)を、opencodeが勝手に読んでくれてた。 そこに「作業を始める時はまず知見ファイルを読め」と書いてあるので、Qwenがその通りに読みに行く。 さらに面白いのがここで、その知見ファイルは索引になっていて「ゲームを作る時はこれ、動画の時はこれ」と分岐が並んでる。 Qwenは索引を読んで、ゲーム制作用のファイルだけを自分で選んで開いてました。全部読むでも読まないでもなく、今回必要な分だけ。 これは指示してません。索引を渡しただけです。 で、出てきたコードに実際その知見が入ってた。HUDの更新を1箇所にまとめる書き方とか、数値を設定ファイルに集約するとか、前に自分がハマって書き残したやつ。 数字にするとこう。 ・最初の指示から最後のファイルまで15分 ・13ファイル/583行 ・生成速度38.2 tok/s(1回の返答で約15,000トークン書いてる) ・コンソールエラー0 ・タイトル→自機移動→弾→敵→当たり判定→スコア→ウェーブ進行まで動く ゲーム自体は素朴です。この前Grokに作ってもらったやつと比べるとコード量で1/5くらいだし、1回の返答で15,000トークン使うので64Kのコンテキストは4〜5往復で埋まる。作り込んでいく用途には向いてない。 それでも使い方は広がりそう。 なにより、自分が積んできた知見が別の道具でもそのまま使えるのはいいね。移植作業は一切せずにこれができるのは楽だ😊

LUTA@AI

15,740 görüntüleme • 1 ay önce