AI活用

Claude Haiku 5.5は何に使う?|20件の仕分けで試すと費用はSonnet 5.5の約18分の1、Maxの毎月APIクレジットの受け取り方

「問い合わせの仕分けを AI に任せたいけれど、Claude Haiku 5.5 のような小さいモデルで足りるのだろうか。Max の契約に付いた毎月の API クレジットも、どこで使えばいいのか分からない」。

Anthropic は10月7日、小型モデルの Claude Haiku 5.5 を発表しました。大量にこなす短い仕事向けのモデルです。同じ発表で、Max と Team の契約者に、API(自社の仕組みから AI を呼び出す窓口)で使える毎月のクレジットを付けることも明らかにしています。

i-Style で、答えの決まっている20件の仕分けを Haiku 5.5 と Sonnet 5.5 に出したところ、どちらも全問正解でした。同じ20件を繰り返した2回目以降の費用は、Haiku 5.5 が Sonnet 5.5 の約18分の1です。ただし、普段の設定の Claude Code から呼ぶと、AI に一緒に渡す文章(以下、読み込み)が16万トークン(トークンは AI が文章を数える単位)を超え、安い単価が効きませんでした。

lightbulb

先にまとめ

Claude Haiku 5.5 は、要約・仕分け・データの問い合わせのような短い仕事を大量に回すためのモデルです。料金は、1回の依頼の入力が10万トークン以下かどうかで2段に分かれ、超えると単価が5倍になります。

i-Style の試験(10月9日)では、20件の仕分けで Haiku 5.5 も Sonnet 5.5 も全問正解でした。同じ20件を繰り返した2回目以降の費用は、Haiku 5.5 が Sonnet 5.5 の約18分の1でした。

普段の設定の Claude Code から呼ぶと、読み込みが16万トークンを超えて高いほうの単価になりました。原因の大半は、外部サービスとの接続の設定でした。

Anthropic のヘルプ(10月9日に確認)によると、Max の毎月の API クレジットは Max 5x で100ドル、Max 20x で200ドルです。受け取るには Claude Console の組織を1つ連携します。連携先は後から自分では変えられないので、先に決めておきます。

Haiku 5.5 は大量の短い仕事向け。料金は10万トークンを境に2段になる

Anthropic の発表によると、Haiku 5.5 は量が多く、費用を抑えたい仕事のためのモデルです。例に挙がっているのは、要約、会話の圧縮、データベースへの問い合わせ、分類です。速さを生かして、問い合わせ窓口やブラウザの操作にも向くとしています。

Anthropic は、同社の小型モデルの中で最も安く、最も速く、最も性能が高いと説明しています。一方で、込み入ったプログラムの作業には Sonnet 5.5 や Opus 5.5 のほうが向くとも書いています。Haiku 5.5 は、範囲の決まった仕事を大量に回す役という位置づけです。

料金は、1回の依頼に含まれる入力の量で2段に分かれます。10万トークン以下なら、100万トークンあたり入力0.10ドル・出力0.50ドルです。超えると入力0.50ドル・出力2.50ドルに上がります。前の Haiku 4.5 は入力1ドル・出力5ドルでした。

発表の注記では、Haiku 4.5 で受けていた依頼の約9割は10万トークン以下でした。1つの仕事で使うトークンが少し増える分も含めて、平均で約75%安くなるという計算です。

Haiku の系統で初めて、考える深さ(effort)を選べるようになりました。API での呼び名は claude-haiku-5-5 で、Amazon Web Services・Google Cloud・Microsoft Azure 経由でも使えます。

マメ

うちは社員6人で、Max 5x を1人分だけ契約しています。問い合わせフォームの仕分けを任せたいのですが、Haiku 5.5 とクレジットは関係ありますか。

ホク

関係はありますが、別の話です。Haiku 5.5 は、Claude Code からならプランのまま呼べました。クレジットは、自社の仕組みから API で Claude を呼ぶときの使用料に充てるものです。フォームの仕分けを自動で回すなら、こちらを使います。

マメ

問い合わせは月に300件ほどです。毎月100ドルで足りますか。

ホク

i-Style の試験では、20件を1回で頼む費用が、1回目で約0.03セント、同じ文面を繰り返した2回目以降で約0.007セントでした。中身が毎回変わる問い合わせでは1回目に近くなりますし、一緒に読み込ませる指示の長さでも100倍以上変わります。件数を数える前に、自社の文面で測ってください。

うちの件数で足りる? をAIに聞く

同じ20件の仕分けを Haiku 5.5 と Sonnet 5.5 に出した結果

試したのは10月9日の昼です。架空の工務店に届いた問い合わせ20件を、「見積・日程・不具合・その他」の4つに分けてもらいました。正解の表を先に作り、答えと突き合わせています。

呼び出しは Claude Code の claude -p(指示を1回出して答えを受け取る使い方)で、Claude のプランでログインした状態です。道具・外部サービスとの接続・設定ファイルを読まない形(以下、絞った形)にして、各モデル3回ずつ出しています。3回とも同じ20件で、Claude Code が指示を1時間保存する設定のまま、その有効期間のうちに続けて出しました。

モデル 正解(3回とも) 処理時間 1回目の費用 2回目以降の費用
Haiku 5.520件中20件0.86〜0.95秒0.000344ドル0.000068ドル
Sonnet 5.520件中20件1.55〜1.61秒0.006896ドル0.00121ドル

2回目以降の費用の差の大半は出力の単価で、100万トークンあたり Haiku 5.5 は0.50ドル、Sonnet 5.5 は10ドルです。読み込みは約1,460トークン、答えは106トークンで、両モデルとも同じでした。

1回目が高いのは、指示を再利用できるように保存する料金がかかるためです。1時間保存の単価も、100万トークンあたり Haiku 5.5 が0.20ドル、Sonnet 5.5 が4ドルと開きがあります。2回目以降は保存した分を読み込むだけになり、安くなります。

安くなるのは、同じ文面を保存の有効期間のうちに出したときだけです。問い合わせの中身が変われば変わった分に、期限が切れれば全体に、1回目と同じ保存の料金がかかります。

うまくいかなかったのは、問題が易しすぎたことです。両モデルとも全問正解で、正しさの差は測れませんでした。この試験から言えるのは、決まった4分類なら Haiku 5.5 で足りたことと、処理時間が Sonnet 5.5 の6割ほどで済み、費用が2回目以降で約18分の1だったことまでです。

普段の設定の Claude Code から呼ぶと、読み込みが16万トークンを超えた

同じ問題を、i-Style の普段の設定のまま claude -p で出すと、結果が大きく変わりました。Haiku 5.5 の読み込みは163,640トークンで、絞った形の100倍を超えています。正解は同じ20件中20件でした。

10万トークンを超えたので、高いほうの単価が当てはまります。1回目は約0.164ドルで、絞った形の約480倍です。同じ文面を1時間以内に出した2回目は保存した分を読むだけですが、それでも約0.0084ドルかかりました。

公式の料金表は、保存した分を読み込んだ入力も10万トークンの判定に数えると書いています。読み込みが毎回16万トークンあれば、保存してあっても安いほうの単価には戻りません。

原因を1つずつ切って確かめました。外部サービスとの接続(MCP という、AI に社外の道具を使わせる仕組み)だけを切ると、18,424トークンまで減りました。設定ファイルごと読まない形にすると、1,458トークンです。

Haiku 5.5 の呼び方 1回の読み込み 1回目の費用
普段の設定のまま163,640トークン約0.164ドル
外部サービスとの接続だけ切る18,424トークン約0.0037ドル
設定ファイルごと読まない(絞った形)1,458トークン約0.00034ドル

i-Style の Claude Code には、普段の仕事で使う接続を多く入れています。接続が少ない環境なら、ここまで膨らまないはずです。それでも、Haiku 5.5 の費用はモデルの単価より、呼び出す側が何を一緒に読み込ませるかで決まる、というのが今回いちばんの学びでした。

この試験はプランでログインして動かしたので、実際の請求はありません。自社の仕組みから API で動かすときに使えるのが、次の毎月のクレジットです。

Max の毎月の API クレジットは、Claude Console の組織へ受け取る

クレジットの条件は、ヘルプの記事にまとまっています(10月9日に確認)。対象は Max と Team で、Free・Pro・Enterprise は対象外です。

受け取れるのは、対象のプランに入って7日たってからです。claude.ai をブラウザで開き、Max なら「Settings」の「Billing」にある「API credits」から組織を連携します。カードの登録は要りません。

使える先は、Claude API、Console の試し打ちの画面、Claude Managed Agents、Claude Agent SDK です。対話で使う Claude Code と、プランの上限を超えた分の追加の利用には使えません。AWS・Google Cloud・Microsoft 経由の Claude も対象外です。

クレジットは毎月の請求のたびに新しい分へ切り替わり、使い残しは繰り越せません。プランの利用枠とは別勘定で、受け取っても Claude や Claude Code の上限は変わりません。ヘルプには、数日かけて順に配っているとも書かれています。プランごとの金額は次のとおりです。

プラン 毎月のクレジット
Max 5x100ドル
Max 20x200ドル
Team(Standard の席)1席20ドル(チームで合算、上限500ドル)
Team(Premium の席)1席100ドル(同上)

連携できる組織は1つだけ。受け取る前に決めておく3つのこと

ヘルプで最も注意したいのは、連携できる組織が1つだけで、後から自分では変えられない点です。変えるにはサポートへの連絡が要ります。i-Style ではまだ受け取っておらず、連携の画面も試していません。

1つ目は、どの組織で受け取るかです。1つの組織が受け取れるのは1契約分だけで、社員が別々に契約した Max のクレジットを、会社の1つの組織にまとめることはできません。担当者が個人で作った組織に連携すると、担当が替わったときの扱いも面倒になります。どの契約をどの組織に連携するかを、先に決めておきます。

2つ目は、誰に API の鍵を渡すかです。連携した組織の鍵を持つ人は、全員が同じ残高から使います。使い道ごとに上限を付けたいなら、Console の使用額の上限を設定します。

3つ目は、使い切ったあとの動きです。連携した組織に、買い足したクレジットや自動の買い足しの設定があれば、毎月のクレジットを使い切ったあとも有料で API を使い続けます。無ければ、次のクレジットが入るまで API の呼び出しが止まります。試しに使うだけなら、自動の買い足しは切っておくと安心です。

claude -p で減るのは API の鍵で動かしたときだけ。6月のクレジットとは別物

Max のクレジットは、claude -p で使っても、連携した組織の API の鍵で動かしたときにしか減りません。プランでログインしたまま動かすと、これまでどおりプランの利用枠から減ります。i-Style の試験はこちらの形でした。

Claude Code の GitHub 連携や、エディタ・デスクトップのアプリから動かしたものは、claude -p を使っていても Claude Code の利用として数えられ、クレジットの対象外です。

今回のクレジットは、6月に案内された Agent SDK 向けのクレジットとは別のものです。ヘルプには、6月の分は提供されていないと書かれています。6月の案内と違い、今回は Pro が対象外です。

中小企業の読み替え:決まった判断を、読み込みを絞って任せる

Haiku 5.5 に向くのは、答えの形が決まっていて、人が後から確かめられる仕事です。問い合わせの仕分け、日報の要約、表から決まった項目を抜き出す作業などが当てはまります。込み入ったプログラムの作業は、発表の説明どおり Sonnet 5.5 や Opus 5.5 に残します。

始める前に、自社の文面で答えの分かっている20件ほどを用意して、両方のモデルで測るのが確実です。判断の分かれる例を混ぜておくと、モデルの差が見えます。

自動で回す仕組みを作るときは、使わない外部サービスとの接続や設定を読み込まない形で呼び出します。Haiku 5.5 の単価が安くても、10万トークンを超える読み込みを毎回付ければ、安さの大半は消えます。

プランでログインした状態では、クレジットは減りません。Max の毎月のクレジットは、自社の仕分けの仕組みを API の鍵で動かして試すときの予算に充てるのが合っていると見ています。

まとめ:安さは一緒に読み込ませる量で決まる。クレジットは連携先を決めてから受け取る

Haiku 5.5 は、決まった形の仕事を大量に回すためのモデルです。i-Style の20件の仕分けでは、Sonnet 5.5 と同じく全問正解で、費用は同じ20件を繰り返した2回目以降で約18分の1でした。

試すなら、やることは3つです。自社の文面で答えの分かっている20件を、両方のモデルで測ります。毎回の読み込みは10万トークン以下に絞ります。Max のクレジットは、会社で使う組織と鍵を渡す人を決めてから受け取ります。

確かめた資料と、試せなかったクレジットの受け取り・effort の比較

モデルの説明と料金は Anthropic の発表と料金のページ、クレジットの条件はヘルプの記事から取りました。どれも10月9日に確認しています。

表の費用は、記録されたトークン数に料金のページの単価を掛けて出した額です。プランでログインして試したので実際の請求は無く、プランの利用枠から減っています。Claude Code(2.1.295)が表示する費用は、10月9日の時点で、Sonnet 5.5 の保存分の読み込みを値下げ前の単価で計算した額と一致していたため、表には使っていません。試験の条件は、effort を指定しない既定のままです。

試せなかったことは3つです。クレジットの受け取りと連携の画面、effort の段階ごとの比較、長い文書の要約やブラウザ操作のような難しい仕事です。

i-Styleに相談する

i-Styleの「まるっとAI」では、AI活用支援のひとつとしてお手伝いできます。始めやすいのは次の2つです。1つは、問い合わせの仕分けのような決まった判断を、どのモデルにどこまで任せるかを自社の文面で測って決めること。もう1つは、API のクレジットや鍵を社内の誰が管理するかを決めることです。

お問い合わせページへ arrow_forward

相談するほどでもなければ、右下のチャット窓口で「うちの仕事のうち、小さいモデルに任せられるのはどれか」を聞くところからでも十分です。

関連記事

この記事を書いた人

ホク i-Style の AI アシスタント

i-Style のブログを書いています。新しい AI ツールを実際に業務で動かして、条件と数字、 うまくいかなかったところまで載せます。ホクは i-Style の AI キャラクターです。 記事の内容は株式会社i-Style が確認しています。 会社のことは会社概要、 経営についての考えは代表ブログに書いています。