フロンティア級のAIを、重い仕事にこそ回したい
賢いAIほど従量課金の単価は高い。だから中小の現場では「本当に難しい仕事」ほどAIに任せづらい、という逆転が起きます。数万字のリサーチ、他人が書いた既存コードの読み解き、LPや管理画面の試作——時間はかかるが失敗しても致命傷にならない下ごしらえこそAIに寄せたいのに、最上位モデルの単価を見て手が止まる。ククルデザインが中小の伴走で何度も見てきた場面です。
2026年8月12日、xAIがフラッグシップの更新版Grok 4.6を公開しました。要点はひとつ。トップ級の賢さを、入力100万トークンあたり2ドル・出力6ドルという低い単価で出してきたことです。中小のAIコスト設計に直結する話なので、公式発表を一次で確かめたうえで、群馬の現場で何に使えるかまで落とします。
何が公開されたか——賢さは最上位級、単価は低い

xAIの公式発表(x.ai/news/grok-4-6)と開発者ドキュメント(docs.x.ai)で確認できた事実は次のとおりです。
- コンテキスト長は50万トークン。テキストと画像を入力し、テキストで返す(image → text)。
- APIの単価は入力100万トークンあたり2ドル、出力6ドル(キャッシュ入力は0.50ドル)。高速版はこの2倍。
- 推論の強度はlow・medium・high(既定)・xhighから選べる。じっくり考えさせたいときはxhigh、速さ重視なら弱める、と手元で調整できます。
- 賢さの指標として、9つのベンチマークを合成したArtificial Analysis Intelligence Indexで61点。これはOpenAIのGPT-5.6 Sol Max(61点)と同点で、xAIは「最上位と並んだ」と説明しています。
- 公開当日から、Cursor・Grok Build・xAI API・OpenRouter・Vercel・Cloudflareで使えます。
判断材料にすべきは、入力2ドル・出力6ドルという単価そのものです。他社モデルとの「何割安い」という比較は、対象モデルや呼び出し条件(入力量・キャッシュ利用・推論強度)で数字が変わるため、キャッチコピーを鵜呑みにせず、自社が実際に流す量で見積もるのが安全です。
中小の使いどころ——「重い下ごしらえ」に寄せる

単価が低くて効くのは、まさに冒頭で挙げた「難しいが失敗しても痛くない下ごしらえ」です。出力の量が多く、これまで単価を気にして遠慮していた作業を、遠慮なく回せるようになります。中小の実務なら、たとえば次のような使い方です。
- 大きめのリサーチ:競合サイト十数社ぶんのテキストや資料をまとめて読ませ、論点を洗い出す下書きを作らせる。
- 既存コードの読み解き:引き継いだWordPressテーマや古い業務システムを50万トークンの枠に流し込み、どこで何をしているかの見取り図を書かせる。
- 試作の一発目:LPや管理画面のたたき台を作らせ、人がそこから直す。ゼロから起こすより速い。
いずれも「AIの一発目を人が直す」前提の使い方です。仕上げの正確さより、下ごしらえの物量を安く回せることが効きます。ここに賢さ最上位級で単価の低いモデルがはまります。
コストを読むなら「200Kの壁」を先に知る

安いからと入力を無制限に太らせると、単価設計が崩れる箇所があります。Grok 4.6はプロンプトが20万トークンに達すると、そのリクエスト全体の単価が倍になります(入力4ドル・出力12ドル・キャッシュ入力1ドル/100万トークン)。超えた分だけでなく、リクエストまるごとが高い方の単価で課金される点に注意が要ります。50万トークンの枠は「入れられる」であって「入れても同じ単価」ではありません。
概算の感覚として、出力6ドル/100万トークン(1ドル150円換算)なら、数千字の要約1本の出力は数円の範囲に収まります。一方で、既存コード一式を20万トークン超で丸ごと読ませる使い方は単価が跳ねます。20万トークンを一つの壁として、長い入力は分割するか要点に絞ってから渡す——この設計を先に決めておくと、単価の見積もりが立ちます。単価改定はありうるので、本番で回す前に最新の料金を確認する前提は変えないでください。
使う前にそろえる2つの前提
安く強力になったぶん、任せる範囲の線引きは今までどおり必要です。
- 預ける情報を決める:顧客の個人情報・未公開の見積根拠・認証情報は、下ごしらえの入力にそのまま混ぜない。読ませる資料は事前に伏せる。
- 出力は人が最終確認する:リサーチの結論もコードの見取り図も試作も、AIの一発目です。事実とロジックは人が検める工程を必ず残す。
まとめ
- Grok 4.6は2026年8月12日公開。賢さは最上位級(AA Intelligence Index 61でGPT-5.6 Sol Maxと同点)で、単価は入力2ドル・出力6ドル/100万トークンと低い。推論強度はlow〜xhighで調整できる。
- 効くのは「難しいが失敗しても痛くない下ごしらえ」——大きめのリサーチ、既存コードの読み解き、試作の一発目に寄せる。
- 20万トークンを超えると単価が倍になる。長い入力は分割する。機密は入れない・人が最終確認する、の2前提は据え置き。
「うちのどの作業をこの低単価のフロンティアに寄せられるか」を、実際の業務1つで一緒に切り分けます。既存コードの読み解きでも、リサーチの下ごしらえでも、まず1本試して単価と使い勝手を測るところからご相談ください。ククルデザインが群馬の現場で伴走します。



