ゲスト
NEW 新着:Claude Code Auto mode標準化|8月14日の変更と案件判断 →

編集 MTG 議事録 2026-08-03

2026-08-03 / report

開催: 2026-08-03 05:00 JST / ファシリテーター: 副社長 M / 編集北極星: エンジニアを稼がせる

1. 各担当の前日情報シェア

業務委託 T(政策)

対象日の 2026-08-03_digital_agency_daily.md は見つからず、本日の政策動向 intel は未取得。したがって政策変更をテーマの根拠にはしない。今回は、取得できた Claude アカウント差分と動画一覧を中心に、エンジニアの受注・検収に直結する読み物へ絞る。

コレクター(Anthropic)

2026-08-03_anthropic_official_daily.md は見つからず、本日の Anthropic 公式 daily は未取得。追加 intel の 2026-08-03_claude_accounts_diff.md は 49 アカウントを走査し、30 アカウントで変化、エラー 0 件。最重要候補は 8 月 2 日の @karpathy 投稿で、単純な SVG 生成のようなデモから、より一般化できる課題でモデルを評価する段階へ移っているという問題提起が大きく反応している。投稿は Opus 5 を題材にしており、表示された閲覧数は 2,420,392 回。@emollick からは「think step by step」が現代のモデルの改善に効かないという同日投稿もあり、決まり文句ではなく成果物で測る必要性を補強する。

業務委託 H(SEO + YouTube分析)

YouTube 最新一覧は 30 件。最終取得日は 7 月 25 日で、Opus 5、Fable 5 との価格・性能比較、Claude Code の使い分け、他モデルとの対決が上位を占めた。視聴数は投稿後に変動するため、需要の方向を読む参考値として扱い、動画タイトルの主張を公式性能値とは断定しない。既存記事には Opus 5 の価格比較と指示整理があるため、今回は「評価表を作り、顧客に合格成果物を説明する」切り口で差別化する。

業務委託 M(読者・企画)

読者が欲しいのは「新モデルが最強か」という結論だけではなく、案件で試す価値があるかを短時間で判断する物差し。モデル名や派手なデモを並べると再現性がなく、受注後の説明にも使えない。入力資料、完了条件、確認項目、手直し時間を一枚にまとめる方法なら、フリーランスの提案書や社内のモデル選定資料に転用できる。評価表の作成・実施・説明を小さな有償メニューにできる点を重視する。

1.5 YouTube 最新動画の分析

共通テーマ

  1. Opus 5 の登場と、Fable 5 など上位モデルとの性能・価格比較
  2. Claude Code と他の開発支援サービスの役割分担
  3. プログラミング、Web制作、資料作成を短時間で試す実演
  4. 料金の安さを実案件の採算へ読み替える必要性
  5. モデルの印象ではなく、現実の成果物を採点する評価への関心

高視聴 TOP 5

順位 タイトル 視聴数(取得時点) URL
1 Claudeでカルーセルを無料作成 1,344 https://www.youtube.com/watch?v=IH0cg0bHNsg
2 ChatGPT対Claude、プログラミング最強は? 1,101 https://www.youtube.com/watch?v=SovZK4r6odI
3 新型Claude Opus 5、低価格でFable 5に匹敵 1,048 https://www.youtube.com/watch?v=nap0kyhoZm8
4 Anthropic、新AIモデルOpus 5を公開 1,013 https://www.youtube.com/watch?v=8bNSnRlvQ-4
5 CodexとClaude Codeが公式連携、開発力向上 876 https://www.youtube.com/watch?v=nNjXOmmbVEc

トレンド KW

Opus 5 / Fable 5 / Claude Code / 料金比較 / プログラミング比較 / 実案件評価 / 受託採算 / 検収条件

2. 4 名の議論

CEO J(編集方針)

最新性は 8 月 2 日の @karpathy 投稿を起点に担保する。単純なデモを高得点とみなすのではなく、顧客の仕事に似た課題で、合格条件と失敗の修正費まで測るという主張に置き換える。Opus 5 の優劣を未確認の数値で断定せず、「いま評価の作り方を見直す理由」として扱う。読後に、エンジニアが自分の得意領域向けの評価パックを作り、提案時の説明材料にできることを着地点とする。

EIC S(編集品質)

既存の「Opus 5 と Fable 5 の粗利比較」記事は表示価格と合格成果物の原価を扱い、別記事は案件ごとの指示を短くする検証を扱っている。今回の記事はそこへ重ねず、評価項目の設計と顧客への見せ方に集中する。出典は @karpathy@emollick の投稿、動画一覧を明記し、動画タイトルを公式発表や実測結果に見せない。評価の例は、仕様変更、不具合修正、調査回答の三種類に分け、数値を作らずに測定手順を説明する。

業務委託 H(SEO + YouTube分析引用)

検索意図は「Opus 5 評価」「Claude 評価方法」「AI 受託案件 採算」「AI 成果物 検収」。タイトルには Opus 5 と評価設計を入れ、本文では「デモ」「採点表」「合格成果物」「手直し時間」を反復語にする。動画で反応が集まった価格・性能比較を入口にしつつ、結論を単純なランキングにしない。H2 は、話題の発生、評価表の作り方、採点軸、受託メニュー化、利益計算の順にして、検索者が自分の案件へ移しやすい流れにする。

業務委託 M(読者熱狂・タイトル)

読者への一言は「モデルを選ぶ前に、顧客が買う成果物を採点できるようにする」。タイトル案は Opus 5時代のAI評価設計|デモを受託案件の利益に変える採点表。高性能を信じる記事ではなく、同じ課題を複数回試し、初回合格率、確認時間、手直し時間、説明のしやすさを記録する記事にする。評価表そのものを納品物にし、導入判断の不安を減らすことで、技術力を単価へ変換する道筋を示す。

3. 決定事項

項目 内容
slug opus-5-ai-evaluation-design
タイトル Opus 5時代のAI評価設計|デモを受託案件の利益に変える採点表
カテゴリ column
時事フック(なぜ今) 2026-08-02、@karpathy が Opus 5 を題材に、単純な SVG 生成のようなテストから、より一般化できるモデル評価へ移る必要性を投稿し、2,420,392 回の閲覧を集めた。出典: https://x.com/karpathy/status/2083749667410727319
「エンジニアを稼がせる」 ★★ / 顧客固有の課題を採点表に変え、評価・比較・説明を一つの受託メニューにできる。モデルの一時的な評判ではなく、合格成果物あたりの時間と手直しを示せるため、提案の説得力と継続支援につながる。

アウトライン(H2 5 個)

  1. 8 月 2 日の Opus 5 評価論が示す転換 — 単純なデモと実案件の違い、動画の反応を公式性能値と混同しない読み方
  2. 顧客の仕事を一枚の評価表へ変える — 入力、完了条件、必須品質、失敗時の扱い、確認者を先に固定する
  3. 採点軸は性能ではなく合格成果物でそろえる — 正確性、再現性、確認時間、手直し時間、説明の明瞭さを同じ条件で比べる
  4. 評価を受託メニューにする — 半日ヒアリング、短い実案件テスト、結果報告、次の選択肢までを納品単位に分ける
  5. 利益へ換算し、言い過ぎない — モデル利用費だけでなく人の時間と失敗時の損失を含め、公式情報・動画の印象・自社計測を分離する

出典