GLM-5 Turbo est la version optimisée pour la latence de la famille GLM-5. Elle conserve les solides capacités d'utilisation d'outils et le bilinguisme de la famille tout en réduisant le temps jusqu'au premier token, ce qui la rend particulièrement adaptée aux assistants en temps réel et aux fonctionnalités interactives.
Remplacement direct d'OpenAI. Changez base_url et modèle.
# Python - pip install openai from openai import OpenAI client = OpenAI( base_url="https://meshtok.com/v1", api_key="sk-your-MeshTok-key", ) resp = client.chat.completions.create( model="bigmodel/glm-5-turbo", messages=[{"role":"user","content":"Hello!"}], ) print(resp.choices[0].message.content)
# cURL curl https://meshtok.com/v1/chat/completions \ -H "Authorization: Bearer sk-your-MeshTok-key" \ -H "Content-Type: application/json" \ -d '{"model":"bigmodel/glm-5-turbo","messages":[{"role":"user","content":"Hello!"}]}'
D'autres modèles à considérer.
Bilingual CN/EN embeddings from Zhipu AI.
Zhipu’s flagship with a 1M context window.
Balanced daily-driver from Zhipu.
General-purpose chat model.