Skip to content

非公式本サイトは非公式の日本語ドキュメントであり、Cloudflare 公式サイトではありません。最新情報はdevelopers.cloudflare.comをご確認ください。

Qwen のロゴ

qwen3-30b-a3b-fp8

テキスト生成 • Qwen

Markdown で表示Agent セットアップ
  • Cloudflare ホスト
  • バッチ
  • 関数呼び出し
  • 推論

Qwen3 は Qwen シリーズの最新世代の大規模言語モデルで、Dense モデルと Mixture-of-Experts(MoE)モデルを幅広く揃えています。大規模な学習に基づき、推論、指示追従、エージェント能力、多言語対応で大きな進歩を実現しています。

モデル情報
コンテキストウィンドウ32,768 トークン
関数呼び出し はい
推論はい
バッチはい
単価$0.051 per M input tokens, $0.34 per M output tokens

プレイグラウンド

Workers AI LLM Playground でこのモデルを試せます。セットアップや認証は不要で、ブラウザからすぐにプレビューとテストができます。

LLM Playground を開く

使い方


export interface Env {
  AI: Ai;
}

export default {
  async fetch(request, env): Promise<Response> {

    const messages = [
      { role: "system", content: "You are a friendly assistant" },
      {
        role: "user",
        content: "What is the origin of the phrase Hello, World",
      },
    ];

    const stream = await env.AI.run("@cf/qwen/qwen3-30b-a3b-fp8", {
      messages,
      stream: true,
    });

    return new Response(stream, {
      headers: { "content-type": "text/event-stream" },
    });
  },
} satisfies ExportedHandler<Env>;

export interface Env {
  AI: Ai;
}

export default {
  async fetch(request, env): Promise<Response> {

    const messages = [
      { role: "system", content: "You are a friendly assistant" },
      {
        role: "user",
        content: "What is the origin of the phrase Hello, World",
      },
    ];
    const response = await env.AI.run("@cf/qwen/qwen3-30b-a3b-fp8", { messages });

    return Response.json(response);
  },
} satisfies ExportedHandler<Env>;

import os
import requests

ACCOUNT_ID = "your-account-id"
AUTH_TOKEN = os.environ.get("CLOUDFLARE_AUTH_TOKEN")

prompt = "Tell me all about PEP-8"
response = requests.post(
  f"https://api.cloudflare.com/client/v4/accounts/{ACCOUNT_ID}/ai/run/@cf/qwen/qwen3-30b-a3b-fp8",
    headers={"Authorization": f"Bearer {AUTH_TOKEN}"},
    json={
      "messages": [
        {"role": "system", "content": "You are a friendly assistant"},
        {"role": "user", "content": prompt}
      ]
    }
)
result = response.json()
print(result)

curl https://api.cloudflare.com/client/v4/accounts/$CLOUDFLARE_ACCOUNT_ID/ai/run/@cf/qwen/qwen3-30b-a3b-fp8 \
  -X POST \
  -H "Authorization: Bearer $CLOUDFLARE_AUTH_TOKEN" \
  -d '{ "messages": [{ "role": "system", "content": "You are a friendly assistant" }, { "role": "user", "content": "Why is pizza so good" }]}'

パラメーター

同期 — リクエストを送り、完了した応答を受け取ります
prompt
string必須minLength: 1モデルが応答を生成するための入力テキストプロンプトです。
lora
stringベースモデルを微調整する LoRA(Low-Rank Adaptation)モデルの名前です。
raw
booleanデフォルト: false`true` の場合、チャットテンプレートは適用されません。そのモデルが想定する形式に合わせてください。
stream
booleanデフォルト: false`true` の場合、応答は SSE(Server-Sent Events)で順次ストリーミングされます。
max_tokens
integerデフォルト: 2000応答で生成するトークンの最大数です。
temperature
numberデフォルト: 0.6minimum: 0maximum: 5出力のランダムさを制御します。値が高いほど結果がランダムになります。
top_p
numberminimum: 0.001maximum: 1検討する語の数を制御して、応答の創造性を調整します。値が低いほど予測しやすく、高いほど多様で創造的になります。
top_k
integerminimum: 1maximum: 50上位 k 個の候補語からのみ選ばせます。値が低いほど焦点が絞られ、高いほど多様になります。
seed
integerminimum: 1maximum: 9999999999生成結果を再現するための乱数シードです。
repetition_penalty
numberminimum: 0maximum: 2繰り返しトークンへのペナルティです。値が高いほど繰り返しを抑えます。
frequency_penalty
numberminimum: -2maximum: 2同じ行をそのまま繰り返す可能性を下げます。
presence_penalty
numberminimum: -2maximum: 2新しい話題を出す可能性を上げます。
id
string補完の一意の識別子です
object
stringenum: chat.completionオブジェクト種別の識別子です
created
number補完が作成された Unix タイムスタンプです
model
string補完に使ったモデルです
prompt_logprobs{}
objectプロンプトの対数確率です(リクエストした場合)
ストリーミング — `stream: true` でリクエストを送り、server-sent events を受け取ります
prompt
string必須minLength: 1モデルが応答を生成するための入力テキストプロンプトです。
lora
stringベースモデルを微調整する LoRA(Low-Rank Adaptation)モデルの名前です。
raw
booleanデフォルト: false`true` の場合、チャットテンプレートは適用されません。そのモデルが想定する形式に合わせてください。
stream
booleanデフォルト: false`true` の場合、応答は SSE(Server-Sent Events)で順次ストリーミングされます。
max_tokens
integerデフォルト: 2000応答で生成するトークンの最大数です。
temperature
numberデフォルト: 0.6minimum: 0maximum: 5出力のランダムさを制御します。値が高いほど結果がランダムになります。
top_p
numberminimum: 0.001maximum: 1検討する語の数を制御して、応答の創造性を調整します。値が低いほど予測しやすく、高いほど多様で創造的になります。
top_k
integerminimum: 1maximum: 50上位 k 個の候補語からのみ選ばせます。値が低いほど焦点が絞られ、高いほど多様になります。
seed
integerminimum: 1maximum: 9999999999生成結果を再現するための乱数シードです。
repetition_penalty
numberminimum: 0maximum: 2繰り返しトークンへのペナルティです。値が高いほど繰り返しを抑えます。
frequency_penalty
numberminimum: -2maximum: 2同じ行をそのまま繰り返す可能性を下げます。
presence_penalty
numberminimum: -2maximum: 2新しい話題を出す可能性を上げます。
type
string
contentType
text/event-stream
format
binary
バッチ — 1 回の API 呼び出しで複数のリクエストを送ります
id
string補完の一意の識別子です
object
stringenum: chat.completionオブジェクト種別の識別子です
created
number補完が作成された Unix タイムスタンプです
model
string補完に使ったモデルです
prompt_logprobs{}
objectプロンプトの対数確率です(リクエストした場合)

API スキーマ(Raw)

同期Input
同期Output
ストリーミングInput
ストリーミングOutput
バッチInput
バッチOutput

役に立ちましたか?