GLM-5.2 é o modelo principal da Zhipu AI, projetado especificamente para a era de tarefas longas. Ele suporta uma janela de contexto massiva de 1M tokens com saída máxima de 128K, uso nativo de ferramentas e raciocínio multilíngue robusto. Uma excelente escolha para análise de documentos longos, agentes de múltiplas etapas e tarefas de codificação que abrangem muitos arquivos.
Substituição direta do OpenAI. Mude apenas base_url e modelo.
# Python - pip install openai from openai import OpenAI client = OpenAI( base_url="https://meshtok.com/v1", api_key="sk-your-MeshTok-key", ) resp = client.chat.completions.create( model="bigmodel/glm-5.2", messages=[{"role":"user","content":"Hello!"}], ) print(resp.choices[0].message.content)
# cURL curl https://meshtok.com/v1/chat/completions \ -H "Authorization: Bearer sk-your-MeshTok-key" \ -H "Content-Type: application/json" \ -d '{"model":"bigmodel/glm-5.2","messages":[{"role":"user","content":"Hello!"}]}'
Outros modelos que você pode considerar.
Bilingual CN/EN embeddings from Zhipu AI.
Balanced daily-driver from Zhipu.
Fast GLM variant for low-latency apps.
General-purpose chat model.