von 0G Foundation
Zhipu AI GLM-5.3-Flash, a fast, cost-effective model for coding and agentic tasks; served via Tencent Cloud MaaS (TokenHub), which exposes both OpenAI and Anthropic faces. Text in / text out, 1M context, up to 128K output. Deep thinking is always on, controllable via reasoning_effort ("none" disables it); function calling (tool_choice limited to auto/none in thinking mode), JSON mode (response_format: json_object), and implicit prompt caching supported.
1M
1.000.000 Token
131K
131.072 Token
$0.1111
pro 1M Token
$0.389
pro 1M Token
curl "https://router-api.0g.ai/v1/chat/completions" \
-H "Content-Type: application/json" \
-H "Authorization: Bearer <YOUR_API_KEY>" \
-d '{
"model": "glm-5.3-flash",
"messages": [
{"role": "user", "content": "Hello!"}
],
"stream": true
}'TEE-Verifizierung
Fordere eine On-Chain-Signaturverifizierung mit verify_tee an. Die Antwort enthält ein tee_verified-Feld im Trace.
{
"model": "glm-5.3-flash",
"messages": [{"role": "user", "content": "Hello!"}],
"verify_tee": true
}Anbieter-Routing
Steuern Sie, welcher Anbieter Ihre Anfrage bearbeitet, mit den X-0G-Provider-*-Anfrage-Headern.
X-0G-Provider-Address legt einen Anbieter fest; X-0G-Provider-Identity legt fest, welcher seiner vorgelagerten Dienste für das Routing verwendet wird – beide Werte stammen aus den Feldern address und provider_identity von GET /v1/providers. Zusammen adressieren sie einen bestimmten vorgelagerten Dienst eines Anbieters. Werden beide nicht gesendet, wählt der Router genau wie zuvor anhand von Preis und Zustand aus.
curl "https://router-api.0g.ai/v1/chat/completions" \
-H "Authorization: Bearer <YOUR_API_KEY>" \
-H "Content-Type: application/json" \
-H "X-0G-Provider-Address: <PROVIDER_ADDRESS>" \
-H "X-0G-Provider-Identity: <UPSTREAM>" \
-H "X-0G-Provider-Sort: latency" \
-H "X-0G-Provider-Allow-Fallbacks: true" \
-d '{
"model": "glm-5.3-flash",
"messages": [{"role": "user", "content": "Hello!"}]
}'