Claude Opus 5とFable 5比較|受託原価と粗利の測り方

「Claude Opus 5はFable 5の半額なら、受託案件でも切り替えるほど得なのではないでしょうか?」表示価格だけでは見えない確認時間や手直しを含め、合格成果物1件あたりの原価と粗利で比べる方法をまとめました。

Conclusion

Anthropicの「半額」は Fable 5との価格比較 であり、すべてのモデルや契約から一律に利用費が半減する意味ではありません。準備・確認・手直しに使う人の時間まで加えた 案件全体の原価 で必ず評価します。

検証は機密情報を外した30〜60分の課題を用意し、入力資料、完了条件、確認者、試行回数を固定します。各モデルを同種課題で3回ずつ試し、初回合格率合格成果物1件あたり原価、最大手直し時間を必ず比べます。

判断は全面切替だけではありません。品質同等、納期内、原価5%以上改善を例示基準とし、定型作業はOpus 5、失敗コストの高い難所はFable 5とする 併用 や、差が小さい場合の 据え置き まで明確に選び分けます。

Contents (12)

7月25日にOpus 5動画が集中—「半額」「より安い」を受託判断へ読み替える

2026年7月26日05:00 JSTに取得したYouTube最新30件では、Claude Opus 5を明示する動画が10件あり、そのうち9件が7月25日公開でした。公開直後の関心が、性能だけでなくFable 5との価格差へ集まったことがわかります。

価格比較を前面に出した動画は3本です。「Fable 5に勝ち、価格は半分」とする動画は取得時390回、「自社の最上位モデルに半額で勝った」とする動画は268回でした。

「Fable 5に匹敵し、より安い」とする動画は1,048回でした。視聴数は取得時点の値であり、公開後も変動します。また、これらは投稿者が動画タイトルで示した評価で、公式の保証値や本記事の実測結果ではありません。

「半額」は動画投稿者だけの表現でもありません。Anthropicの2026年7月24日の公式紹介も、Opus 5はFable 5の最先端の知能に近づき、価格は半分だと説明しています。

ただし、比較対象はFable 5です。Opus 4.8を含むすべてのモデル、定額利用の全契約、受託案件の総原価が一律に半分になるという説明ではありません。「半額」を案件採算へ直結させるには、利用費の外側にある人の時間を測る必要があります。

当日の公式情報日報では、Anthropicのニュース一覧更新情報に7月25日付の新規掲載はなく、最新掲載は7月24日でした。そのため、未確認の追加変更を推測せず、公開翌日に起きた反応と選定方法へ焦点を絞ります。

当日の収集では公式アカウント差分の取得に失敗したため、別系統で取得したYouTube最新一覧と7月24日の公式紹介を根拠にしました。ここから先は「どちらが常に上か」ではなく、「自社の合格基準を満たす成果物を、どちらが低い原価で作れるか」を判断します。

モデル単価だけでは案件の得失が決まらない—粗利を左右する4つの原価

受託案件で残る利益は、モデルの表示単価だけでは決まりません。基本式は 粗利 = 案件価格 − モデル利用費 − 人件費 − その他の直接費 です。交通費や外注費が変わらない比較なら、モデル利用費と人件費の変化が判断の中心になります。

利用費から機会損失までを同じ案件単位でそろえる

比較へ入れる原価は4つあります。見落としやすいのは、安い試行を何度も繰り返す費用と、確認のやり直しです。請求明細だけでなく、作業記録と合否記録を一つの案件番号へ結び付けると、モデルごとの得失を追えます。

  1. モデル利用費を記録します。入力と出力の量、試行回数、長い資料を渡した回数によって増減するため、月額の総額ではなく比較課題に対応する費用へ分けます。

  2. 人の作業時間を記録します。課題の準備、指示文の作成、成果物の確認、顧客へ説明する資料の作成まで含め、モデルが処理している時間とは分けて測ります。

  3. 手直しの負担を記録します。誤りの発見、再試行、修正指示、差し戻し後の再確認は、利用費と人の時間を同時に増やします。初回合否と最終合否を分けることが重要です。

  4. 失敗による機会損失を補足します。納期遅延、別案件へ使えなかった時間、担当者の予定変更など、金額へ直しにくい影響は無理に平均へ混ぜず、最大所要時間とともに残します。

高いベンチマーク得点が示すのは、定められた評価課題での能力です。自社案件の命名規則、保守方針、説明責任、顧客固有の品質基準と一致しなければ、その得点が粗利へそのまま移るわけではありません。

比較単位は「1回いくら」ではなく「顧客へ渡せる合格成果物1件をいくらで作れたか」にします。単価が安くても初回合格率が低ければ、再試行と再確認で差は縮みます。反対に単価が高くても、一度で通るなら総原価は下がり得ます。

合格成果物を先に定義して安さの錯覚を防ぐ

「合格」は、動いた、文章が出た、見た目が整っただけでは決めません。不具合修正なら再現条件の解消と回帰確認、実装案なら制約の充足と保守性、調査なら根拠の追跡可能性など、顧客が受領できる条件を先に書きます。

完了条件を後から変えると、片方のモデルだけに甘い採点になります。確認者が成果物を見てから基準を足さないよう、必須条件、減点条件、即時不合格条件を比較開始前に固定します。これが原価計算の分母となる「合格件数」を守ります。

Opus 5とFable 5を同条件で比べる—小さな受託課題を作る手順

最初から顧客案件全体を切り替えると、失敗時の影響が大きく、原因も追いにくくなります。実案件から機密情報を除いた30〜60分規模の課題を切り出し、同じ開始条件で小さく比べます。

課題例は、再現条件が明確な不具合修正、仕様書から作る実装案、既存コードへの改善提案です。成果物の種類が違えば得意不得意も変わるため、三種類を一つの平均へまとめず、案件種類ごとに比較します。

比較課題シートを作る7つのステップ

以下の順序で1枚の比較課題シートを作ります。各モデルへ渡す情報量をそろえ、確認者が途中で助言しない状態を作ることが目的です。顧客データはそのまま使わず、契約条件と社内の情報管理ルールを確認して検証用データへ置き換えます。

  1. 実案件から30〜60分で完了できる作業を1つ選びます。納期へ影響しない過去課題か、同じ構造を持つ模擬課題が安全です。

  2. 入力資料を固定します。仕様、対象ファイル、再現手順、禁止事項を一つの資料へまとめ、モデルごとに有利な補足を追加しません。

  3. 対象範囲と完了条件を固定します。変更可能な範囲、提出形式、満たすべき機能、説明に含める項目を明記します。

  4. 品質基準と採点表を先に作ります。正確性、保守性、説明の明瞭さ、確認項目の充足を同じ配点にし、即時不合格となる条件も書きます。

  5. 制限時間と確認者を固定します。同じ人が同じ採点表で確認し、モデル名による先入観を減らせるなら、成果物のモデル名を隠して採点します。

  6. 同種の課題を各モデルで3回ずつ試します。偶然の当たり外れを減らしつつ、利用費が膨らまない回数として3回から始めます。

  7. 再試行回数と手直し時間に上限を置きます。無制限に直せば最終合格率だけは上がるため、案件として許容できる上限で打ち切ります。

比較課題シートの項目 記入例
課題 既存画面で発生する入力エラーの修正案
入力資料 再現手順、対象コード、期待結果、禁止変更
完了条件 原因説明、修正案、確認項目を提出
品質基準 正確性40点、保守性25点、説明20点、充足15点
制限 45分、再試行1回、手直し20分まで
確認者 同じ担当者1名
試行回数 各モデル3回

入力資料を完全に同一にできない課題では、「不足情報を質問できる回数」を同じにします。片方だけに過去の正解例や追加の背景を渡すと、モデル性能ではなく情報差を測ることになるからです。

3回の結果は、次のすべての案件へ一般化しません。不具合修正でOpus 5が有利でも、長い仕様整理や失敗コストの高い設計判断では結果が変わる可能性があります。案件種類が変わるたびに基準値を取り直します。

合格成果物1件あたり原価を正しく出す—実測記録表と採算の判定式

比較中は、感想ではなく試行ごとの数字を残します。最低限必要なのは、モデル利用費、AIの処理時間、人の準備時間、人の確認時間、初回合否、手直し回数、最終合否です。

人の時間は社内原価か目標時給のどちらかへ統一して金額換算します。営業上の請求単価と混ぜると案件ごとの比較がぶれるため、社内で一つの基準を選び、比較期間中は変えません。

実測記録表で初回合否と手直しを分けて残す

初回合否は、モデルが一度で顧客受領可能な水準へ到達した割合を示します。最終合否だけを残すと、何度も手直しした試行と一度で通った試行が同じ1件に見えるため、確認負担を比較できません。

項目 Opus 5で記録 Fable 5で記録
モデル利用費 試行ごとの金額 試行ごとの金額
AIの処理時間 開始から提出まで 開始から提出まで
人の準備時間
人の確認時間
初回合否 合格・不合格 合格・不合格
手直し回数
手直し時間
最終合否 合格・不合格 合格・不合格
最大所要時間

計算式は 合格成果物1件あたり原価 = (モデル利用費 + 人の作業時間 × 時間単価)÷ 合格件数 です。人の作業時間には準備、確認、手直し、顧客説明を含めます。

AIの処理時間は、担当者が別作業をできるなら全時間を人件費へ足しません。ただし、待機が必要だった時間や納期を押した時間は、人の作業時間または納期リスクとして別に記録します。

仮の数値で価格差が逆転する条件を確かめる

たとえば各モデルを3回試し、担当者の時間単価を4,000円とします。以下は計算方法を示す仮例であり、両モデルの公式料金や編集部の性能測定値ではありません。

モデル 3回の利用費 人の作業時間 最終合格 1件あたり原価
Opus 5 1,800円 150分 3件 約3,933円
Fable 5 3,600円 108分 3件 3,600円

Opus 5は利用費が1,800円低くても、人の作業時間が42分長いため、合格成果物1件あたりでは約333円高くなります。安いモデルが悪いという結論ではなく、「確認時間がどこまで増えると価格差が消えるか」を自社の時間単価で見つける例です。

逆に、Opus 5の初回合格率が同等で人の時間も増えなければ、低い利用費がそのまま原価改善へつながります。モデル単価、初回合格率、人の確認時間の三つを同時に見て、どの条件が差を生んだか説明できる状態にします。

平均値だけでは納期リスクを隠します。3回の平均原価に加え、最大所要時間、最大手直し回数、即時不合格の内容を残します。納期が厳しい案件では、平均が安くても最悪値が大きい選択を避ける判断ができます。

切替・併用・据え置きを迷わず決める—利益を守る3つの判断基準

比較結果は、勝敗表ではなく配分の判断へ使います。改善率だけで全面切替を決めず、品質、原価、納期の三条件を同時に満たすかを確認します。

5%以上の原価改善は説明用の例です。案件価格が低く確認時間の比率が高い会社と、品質保証が厳しく失敗コストが高い会社では、必要な改善幅が異なります。自社の粗利目標と許容リスクから基準を決めます。

3つの選択肢を同じ順番で判定する

判定では、まず品質基準を満たすか、次に納期を守れるか、最後に原価が十分下がるかを見ます。安さを先に判定すると、品質不足を追加確認で補い続け、担当者の時間が増えるためです。

  1. 切替を選ぶのは、品質が同等以上で、合格成果物1件あたり原価が基準以上に下がり、最大所要時間でも納期を守れる場合です。別の同種課題でも再確認してから対象範囲を広げます。

  2. 併用を選ぶのは、定型作業ではOpus 5が有利でも、難所や失敗コストの高い作業ではFable 5が有利な場合です。作業種別ごとに入口を分け、途中で切り替えた費用も記録します。

  3. 据え置きを選ぶのは、原価差が小さい、品質のばらつきが大きい、確認負担が増える、契約上の検証が足りない場合です。差がないことも、不要な移行コストを避ける有効な結果です。

判定 品質 1件あたり原価 納期 選ぶ行動
切替 同等以上 例として5%以上改善 最大値でも許容内 同種課題から範囲拡大
併用 作業別に優位差 全体で改善 振り分け後も許容内 定型と難所を分ける
据え置き ばらつき大 差が小さい 確認増で不安定 現状維持して再測定

削減できた原価をすべて値下げへ回す必要はありません。確認強化、納期の予備時間、短納期対応、粗利確保のどこへ配分するかを先に決めると、安くなった分が気付かないまま追加作業へ消えるのを防げます。

顧客への説明はモデル名の優劣ではなく、成果物、品質基準、納期、修正範囲を中心にします。内部でモデルを使い分けても、顧客が買うのは合格した成果物と約束した対応だからです。

最初の行動は、次の案件で比較する30分課題を一つ決めることです。入力資料と合格条件を1枚にし、各モデル3回の記録を取れば、「半額」という見出しを自社の粗利へ置き換えて判断できます。

参照した公式情報と公開直後の比較動画—検証範囲がわかる出典一覧

本記事は、2026年7月25日を対象にした公式情報の確認結果、7月24日の公式紹介、7月26日05:00 JST時点のYouTube最新一覧を使用しました。動画タイトルの性能評価は投稿者の主張として扱い、比較手順や仮の原価例と区別しています。

料金の具体額を自社の試算へ入れる際は、契約形態と利用場所によって条件が異なる可能性があるため、執筆時点の表示だけを固定値として使い続けないでください。比較を実施する日に公式の料金表示と単位を確認し、その確認日を記録表へ残します。

Helpful? ♡
Clauder Navi Editorial Team
@clauder_navi

Delivering the latest Claude / Claude Code news and practical insights daily. Learn more about us at About this site.