GLM Embedding 3 est le modèle d'embedding de Zhipu AI, produisant des vecteurs à 2048 dimensions optimisés pour la recherche bilingue chinois-anglais. Il est largement utilisé dans les pipelines RAG chinois et rivalise avec les modèles d'embedding anglais de pointe sur C-MTEB pour une fraction du coût.
Remplacement direct d'OpenAI. Changez base_url et modèle.
# Python - pip install openai from openai import OpenAI client = OpenAI( base_url="https://meshtok.com/v1", api_key="sk-your-MeshTok-key", ) resp = client.chat.completions.create( model="bigmodel/embedding-3", messages=[{"role":"user","content":"Hello!"}], ) print(resp.choices[0].message.content)
# cURL curl https://meshtok.com/v1/chat/completions \ -H "Authorization: Bearer sk-your-MeshTok-key" \ -H "Content-Type: application/json" \ -d '{"model":"bigmodel/embedding-3","messages":[{"role":"user","content":"Hello!"}]}'
D'autres modèles à considérer.
Zhipu’s flagship with a 1M context window.
Balanced daily-driver from Zhipu.
Fast GLM variant for low-latency apps.
General-purpose chat model.