GLM-5 Turbo ist die latenzoptimierte Version der GLM-5-Familie. Sie bewahrt die starke Tool-Nutzung und die zweisprachige Fähigkeit der Familie, während sie die Time-to-First-Token verkürzt, was sie ideal für Echtzeit-Assistenten und interaktive Funktionen macht.
Direkter OpenAI-Ersatz. Ändern Sie nur base_url und Modell.
# Python - pip install openai from openai import OpenAI client = OpenAI( base_url="https://meshtok.com/v1", api_key="sk-your-MeshTok-key", ) resp = client.chat.completions.create( model="bigmodel/glm-5-turbo", messages=[{"role":"user","content":"Hello!"}], ) print(resp.choices[0].message.content)
# cURL curl https://meshtok.com/v1/chat/completions \ -H "Authorization: Bearer sk-your-MeshTok-key" \ -H "Content-Type: application/json" \ -d '{"model":"bigmodel/glm-5-turbo","messages":[{"role":"user","content":"Hello!"}]}'
Andere Modelle zum Überlegen.
Bilingual CN/EN embeddings from Zhipu AI.
Zhipu’s flagship with a 1M context window.
Balanced daily-driver from Zhipu.
General-purpose chat model.