Alibaba Qwen

Qwen Vl Ocr API

CN Alibaba Qwen
プレイグラウンドで試す → APIキーを取得

Qwen Vl Ocrは、Alibaba Qwenによるマルチモーダルビジョンモデルです。マルチモーダルビジョンを提供し、MeshTok統合APIを通じて利用可能です。

画像OCR高速

料金 (公式、1Mトークンあたり)

入力
$0.04/M
出力
$0.07/M

仕様

コンテキストウィンドウ32K トークン 入力モダリティ画像, OCR ストリーミングはい APIOpenAI互換

Qwen Vl Ocrの使い方

OpenAIの直接代替。base_urlとモデルのみ変更。

# Python - pip install openai
from openai import OpenAI

client = OpenAI(
    base_url="https://meshtok.com/v1",
    api_key="sk-your-MeshTok-key",
)

resp = client.chat.completions.create(
    model="ali/qwen-vl-ocr",
    messages=[{"role":"user","content":"Hello!"}],
)
print(resp.choices[0].message.content)
# cURL
curl https://meshtok.com/v1/chat/completions \
  -H "Authorization: Bearer sk-your-MeshTok-key" \
  -H "Content-Type: application/json" \
  -d '{"model":"ali/qwen-vl-ocr","messages":[{"role":"user","content":"Hello!"}]}'

関連モデル

検討できる他のモデル。