本文へ移動
YOBITSUGI AIメディア
AI の紹介AI により執筆

Grok(xAI)とは: できることと使い方

公開 5 分で読めます

共有XFacebookLINEはてブ

基本の情報

提供元
xAI
種類
文章(言語モデル)・画像生成・動画生成
YOBITSUGI AI で使えるモデル
Grok 4.7・Grok 4.3・Grok Imagine・Grok Imagine Video
YOBITSUGI AI での主な用途
文章・画像・動画
料金
YOBITSUGI AI では使った分だけ(yobitsugi.ai/pricing)
公式のドキュメント
docs.x.ai/overview

Grok は、xAI が開発している AI です。文章を扱う言語モデルの Grok 4.7・Grok 4.3 と、画像や動画を作る Grok Imagine があり、API で提供されています。YOBITSUGI AI では、文章・画像・動画の作業に使えます。なお、xAI の API のドキュメントでは、提供元を「SpaceXAI」と表記しています。

できること

文章(Grok 4.7・Grok 4.3)

モデル xAI の説明
Grok 4.7 コーディング、エージェント型の作業、知的作業に向けたフロンティアモデル。一度に読める量は 50 万トークン
Grok 4.3 ツールの呼び出しと指示への追従に強い、速く安定したモデル。一度に読める量は 100 万トークン
  • どちらも文章と画像を読み、文章で答えます(2026 年 10 月時点)。
  • 関数の呼び出し、決まった形式での出力(構造化出力)、推論(Reasoning)に対応しています。推論の深さは、Grok 4.7 が low〜xhigh、Grok 4.3 が none〜xhigh から選べます。

画像(Grok Imagine)

  • 文章から画像を作る生成と、参考の画像(5 枚まで)を使った編集ができます。
  • 1 回の依頼で 1〜10 枚を作れます。縦横比(1:1・16:9・9:16 など)と、解像度(1k・2k)を指定できます。

動画(Grok Imagine Video)

  • 文章から動画を、静止画から動画を作れます。音声も一緒に作ります。grok-imagine-video-1.5 は、口の動きに合わせた話し声(リップシンク)も作れます。
  • 長さは 1〜15 秒です。解像度は 480p・720p・1080p(grok-imagine-video は 720p まで)、縦横比は 1:1・16:9・9:16・4:3・3:4・3:2・2:3・21:9・5:2 です。
  • grok-imagine-video は、すでにある動画の編集や延長にも対応しています。
  • xAI のドキュメントによると、作った画像や動画はコンテンツポリシーの審査の対象で、学習には使われません。

得意なこと・向いている使い方

  • Grok 4.7: xAI は、コード、エージェントとしてのツールの呼び出し、推論の深さの調整などを挙げ、コードをはじめ幅広い用途に向けた主力のモデルとしています。
  • Grok 4.3: ツールの呼び出しと指示への追従に強いとされ、一度に 100 万トークンまで読めます。
  • Grok Imagine Video: grok-imagine-video-1.5 は、参考の画像を 14 枚まで使え、用意された声を 3 人まで割り当てて、口の動きに合わせて話す人物の動画を作れます。縦長(9:16)の動画も作れます。
  • 既存の動画の手直し: grok-imagine-video で、動画の一部を変えたり、続きを作ったりできます。

YOBITSUGI AI での使い方

YOBITSUGI AI では、xAI の Grok 4.7・Grok 4.3・Grok Imagine・Grok Imagine Video を、文章・画像・動画の作業に使えます。日本語で頼むと、メインの Claude エージェントが作業を分けて Grok を呼び出します。使う AI を指定して頼むこともできます。Grok Imagine と Grok Imagine Video で選べるモデルは、アプリのモデルの選択欄で確認できます。

Grok のアプリの機能は、YOBITSUGI AI からは使えません。YOBITSUGI AI は API を通して xAI のモデルを使います。

頼み方の例:

Grok 4.7 で、この Python のコードの不具合を探して直して

Grok Imagine で、新メニューの告知に使う正方形の画像を 4 案作って

Grok Imagine Video で、この商品の写真をもとに 10 秒の縦長の動画を作って

料金

YOBITSUGI AI には月額の費用はなく、使った分だけクレジットが消費されます。料金は提供元の定価をもとに計算されます。計算のしかたと単価は、YOBITSUGI AI の料金ページで確認できます。

xAI の API の料金は次のとおりです(2026 年 10 月時点・米ドル)。

文章(100 万トークンあたり。プロンプトが 20 万トークン未満のとき):

モデル 料金
Grok 4.7 入力 $2.00・出力 $6.00
Grok 4.3 入力 $1.25・出力 $2.50
  • プロンプトが 20 万トークン以上になると、Grok 4.7 は入力 $4.00・出力 $12.00、Grok 4.3 は入力 $2.50・出力 $5.00 です。
  • キャッシュ済みの入力は、Grok 4.7 が $0.50、Grok 4.3 が $0.20 です(20 万トークン未満のとき)。

画像と動画(API のモデル名ごと):

  • grok-imagine-image-2.0: 1 枚 $0.04(1K・Low)〜$0.08(2K・Medium)
  • grok-imagine-image: 1 枚 $0.02(1K・2K)
  • grok-imagine-video-1.5: 1 秒 $0.08(480p)・$0.14(720p)・$0.25(1080p)
  • grok-imagine-video-1.5-lite: 1 秒 $0.02(480p)・$0.03(720p)・$0.14(1080p)
  • grok-imagine-video: 1 秒 $0.05(480p)・$0.07(720p)

画像を入力して編集するときは、入力の画像にも料金がかかります(grok-imagine-image-2.0 は 1 枚 $0.01)。

出典

共有XFacebookLINEはてブ

YOBITSUGI AI を使ってみる

日本語で頼むと、Claude エージェントが得意な AI と組んで実際に作り、ファイルで届けます。料金は使った分だけです。

YOBITSUGI AI

日本語で頼むだけで、
画像・動画・資料まで。

中心の Claude エージェントが、得意な AI と組んで実際に作り、ファイルで届けます。料金は使った分だけで、月額費用はかかりません。