CUSTOMER SUPPORT
FAQ対応のサポート担当
- 困りごと
- 同じ質問の分類と、例外対応の確認が同じ担当者に集まる。
- 組み込み方
- 問い合わせと承認済みFAQ → 分類・根拠照合 → 回答案を人が確認。
- 残る成果物
- 分類、短い要約、根拠位置、回答案、未解決事項。
- 測るもの
- 分類正解率、誤案内、確認・修正時間、保留の妥当性。
- 限界と責任
- 権限付き検索は別実装。例外判断と外部送信は担当者が担う。
AIを、仕事の難しさで使い分ける
同じ種類の問い合わせを大量に扱う現場へ。分類・要約・項目抽出を一次処理に切り出し、難しい判断に予算と確認時間を使う。Haiku 5.5の公式仕様を起点に、品質・総費用・待ち時間を測る分業案を考える。
本号の業務フローと評価計画は編集部提案。自社データでの精度・時間短縮・費用削減は未検証です。
まず定型処理をそろえ、根拠と業務ルールで振り分ける。AIの自己申告した「自信」だけで通過させない。
問い合わせ → Haiku 5.5で分類・要約・項目抽出 → 形式・根拠・業務ルールを検証。定型で根拠がある案件は下書きへ。複雑な案件は上位モデルへ。情報不足や矛盾は保留して追加確認へ。どの経路でも人が回答内容と宛先を確認し、必要に応じて送信します。効果は、品質・総費用・待ち時間を自社データで測って判断します。
編集部提案 対象は、日本語の一般業務の問い合わせ。役割ごとに成果物と評価指標を決めると、モデルの変更を業務改善につなげやすい。
CUSTOMER SUPPORT
SALES OPERATIONS
AI / OPERATIONS ENGINEER
編集部提案 想定する現状は「全件を上位モデルで処理 → 人が確認」。変更後は、重要案件を先に除外し、残りの定型候補をHaiku 5.5で一次処理する。
ROUTE A / ROUTINE
必須項目がそろい、承認済み資料に答えがある。根拠位置を添えて回答案を作る。
ROUTE B / COMPLEX
複数資料の比較などが必要。元の根拠・未解決点を添えて渡し、再び検証する。
ROUTE C / HOLD
根拠がない、旧版と新版が食い違う、必要項目が欠ける。人に追加確認を戻す。
説明用の架空例。実在の問い合わせや個人情報は使用していません。
拒否・空出力・タイムアウトを正常完了に含めない。AIの自己評価だけで「安全」「正しい」と決めない。
公式仕様 Anthropicは2026年10月7日にClaude Haiku 5.5を公開。モデルIDはclaude-haiku-5-5。テキスト・画像入力、テキスト出力、ツール利用に対応する。[1][2]
最大文脈長は、長文のすべてを正しく読む保証ではない。不要な履歴・資料を毎回渡すと費用と待ち時間が増える。[2]
開発元評価 Anthropicの比較は各モデルの通常速度が対象で、OpusのFast Modeは例外。ベンチマークや掲載事例は、この問い合わせフローの実測ではない。[1]
複雑なエージェント型コーディングでは、同社もSonnet/Opusを有力な選択肢としている。仕事の難しさに応じて分ける。
公式仕様 既定値はmedium。lowでは、長い指示に含まれる検索や確認を省く場合がある。effortは厳密なtoken上限ではなく、思考tokenも出力課金と出力上限の対象になる。[3][4]
編集部提案 mediumで品質を確認し、短い定型処理だけlowと比較する。設定を下げて省略された確認を、人の修正時間まで含めて評価する。
公式仕様 以下はClaude API標準料金。USD/100万token、キャッシュ・Batch割引なし。Haiku 5.5はプロンプトが100,000 tokenを超えると、入力・出力の両単価が変わる。[5]
| モデル/プロンプト長 | 入力/100万token | 出力/100万token |
|---|---|---|
| Haiku 5.5 · 10万token以下 | $0.10 | $0.50 |
| Haiku 5.5 · 10万token超 | $0.50 | $2.50 |
| Sonnet 5.5 · 比較用 | $2.00 | $10.00 |
各呼び出しの入力2,000token、出力500tokenと仮定。出力には思考分を含める。すべてのプロンプトは10万token以下。Sonnetへ渡す案件も、同じ入出力token数と置く。
$90 $22.50
全件Sonnet → Haiku全件+Sonnet 20%。この仮定ではtoken料金が$67.50、75%減る。品質と処理時間は未測定。
全件Sonnet:10,000 × (2,000 × $2 + 500 × $10) ÷ 1,000,000 = $90 Haiku一次処理:10,000 × (2,000 × $0.10 + 500 × $0.50) ÷ 1,000,000 = $4.50 Sonnet再処理:2,000 × (2,000 × $2 + 500 × $10) ÷ 1,000,000 = $18 分業の合計:$4.50 + $18 = $22.50
この試算に含めないもの:追加の引き継ぎtoken、再試行、検索などのツール料、地域加算、税、人件費、キャッシュ・Batch割引。実際の採用判断は、これらと人の修正時間を加えた完了1件の総費用で行う。Bedrock・Google Cloud等の料金は利用先で別確認する。
この75%は本号の仮定による対Sonnet試算。発表にある「平均約75%低コスト」は対Haiku 4.5の開発元説明で、比較対象も計算条件も異なる。[1]
待ち時間は別に測る。Haiku→Sonnetの二段処理や検索が増えると、単価が下がっても完了が遅くなる。モデル単体の出力速度から、業務全体の短縮率は推定しない。
編集部提案 モデルを入れ替えるだけでは、資料へのアクセス権や承認は実装されない。入力から保存・送信までの境界を定める。
編集部提案 まず対象業務を狭くする。多くの仕事を一度に移すより、正解と根拠を定義できる1種類で比較する。
比較対象には、一律Sonnetの構成だけでなく、現行手順やルールベースの振り分けも含める。簡単な固定ルールで十分な部分までAIに置き換える必要はない。
編集部提案 未検証 以下の件数と合格基準は、採用判断のたたき台。実績値・保証・全業務共通の基準ではない。
集計は2つに分ける:安全側の例外テストと、本番の案件比率で重み付けした費用・時間。上の200件の配分は、費用試算の再処理率20%を実証するものではない。人の待ち時間・修正時間も含む完了時間を別に報告する。
例外50件で見逃しゼロでも、安全の証明にはならない。重大失敗が出たら採用を止めて原因を確認する。小さな評価を通過した後も、限定運用・監視・復旧経路を用意する。モデル自体の精度、日本語品質、実際の料金・レイテンシは本号では測っていない。
まず「正解と根拠を付けられる受付」を選ぶ。担当者・データの利用条件・保留先・比較基準がそろったら、下の依頼文を自分の現場に合わせて使う。
コピーだけでデータは送信されません。実在の問い合わせや機密情報を渡す前に、利用条件を確認してください。
単価だけで決めず、保留・再処理・人の確認まで含めて測る。Haiku 5.5は、その比較を始めるための候補です。
確認日:2026-10-09 JST。発表日は記事本文と分けて記載。更新型ドキュメントは、個別の更新日を確認できないため確認日を示す。運用フロー、評価基準、費用例は本号の提案・試算。
未検証:本号の分業フローにおける日本語精度、実際の再処理率、p95待ち時間、修正工数、総費用、利用環境での機能差。本号には自社実測の成果を掲載していません。