GLM-5 Turbo es la versión optimizada para latencia de la familia GLM-5. Mantiene la sólida capacidad de uso de herramientas y el bilingüismo de la familia, a la vez que reduce el tiempo hasta el primer token, lo que la hace ideal para asistentes en tiempo real y funciones interactivas.
Reemplazo directo de OpenAI. Cambia solo base_url y modelo.
# Python - pip install openai from openai import OpenAI client = OpenAI( base_url="https://meshtok.com/v1", api_key="sk-your-MeshTok-key", ) resp = client.chat.completions.create( model="bigmodel/glm-5-turbo", messages=[{"role":"user","content":"Hello!"}], ) print(resp.choices[0].message.content)
# cURL curl https://meshtok.com/v1/chat/completions \ -H "Authorization: Bearer sk-your-MeshTok-key" \ -H "Content-Type: application/json" \ -d '{"model":"bigmodel/glm-5-turbo","messages":[{"role":"user","content":"Hello!"}]}'
Otros modelos que podrías considerar.
Bilingual CN/EN embeddings from Zhipu AI.
Zhipu’s flagship with a 1M context window.
Balanced daily-driver from Zhipu.
General-purpose chat model.