GLM-5 Turbo é a versão otimizada para latência da família GLM-5. Ela mantém a forte capacidade de uso de ferramentas e habilidade bilíngue da família, ao mesmo tempo que reduz o tempo até o primeiro token, tornando-a ideal para assistentes em tempo real e funcionalidades interativas.
Substituição direta do OpenAI. Mude apenas base_url e modelo.
# Python - pip install openai from openai import OpenAI client = OpenAI( base_url="https://meshtok.com/v1", api_key="sk-your-MeshTok-key", ) resp = client.chat.completions.create( model="bigmodel/glm-5-turbo", messages=[{"role":"user","content":"Hello!"}], ) print(resp.choices[0].message.content)
# cURL curl https://meshtok.com/v1/chat/completions \ -H "Authorization: Bearer sk-your-MeshTok-key" \ -H "Content-Type: application/json" \ -d '{"model":"bigmodel/glm-5-turbo","messages":[{"role":"user","content":"Hello!"}]}'
Outros modelos que você pode considerar.
Bilingual CN/EN embeddings from Zhipu AI.
Zhipu’s flagship with a 1M context window.
Balanced daily-driver from Zhipu.
General-purpose chat model.