Back to models
Model · Z.ai
Z.ai

GLM 5.3 Fast

zai/glm-5.3-fast
Try in Agents

Speed-optimised GLM 5.3 for responsive, real-time agentic coding

reasoningcaching
Specs
Context
1.0M
Max output
16K
Provider
Z.ai
Input
$2.10/ 1M tokens
Output
$6.60/ 1M tokens
Cache read
$0.210/ 1M tokens
Try it
Chat with GLM 5.3 FastTerramind API
⌘+Enter to run
Code
import { streamText } from "ai";
import { createOpenAICompatible } from "@ai-sdk/openai-compatible";

const terramind = createOpenAICompatible({
  name: "terramind",
  baseURL: "https://terramind.com/api/v1",
  apiKey: process.env.TERRAMIND_API_KEY!,
});

const result = streamText({
  model: terramind("glm-5.3-fast"),
  prompt: "Why is the sky blue?",
});

for await (const chunk of result.textStream) {
  process.stdout.write(chunk);
}

Want to run this in your app? Grab an API key · Full chat reference

More by Z.ai
ModelContextInOutCapabilities
Z.aizai/glm-5.1203K$1.40$4.40
reasoningcaching
Z.aizai/glm-5.21M$0.800$2.55
reasoningcaching
Z.aizai/glm-5.31M$1.40$4.40
reasoningcaching
Z.aizai/glm-5.3-flash1M$0.150$0.500
reasoningvisioncaching
Z.aizai/glm-5.3-flashx1M$0.370$1.25
reasoningvisioncaching
Z.aizai/glm-5.2-fast1M$2.80$8.80
reasoningcaching
Z.aizai/glm-5v-turbo200K$1.20$4.00
reasoningvisionvideo
Z.aizai/glm-5197K$1.00$3.20