glm-5.2-fp8GLM 5.2 FP8
对话、推理与编程,适合文本助手及开发工作流。
根据输入、预期输出与成本选择模型。目录与实时服务状态分别展示。
glm-5.2-fp8对话、推理与编程,适合文本助手及开发工作流。
qwen3-vl-30b图片、图表与文档理解,可用于 OCR 与视觉问答。
flux-schnell快速文生图,适合创意探索与营销素材初稿。
chroma1-hd高分辨率图像生成,适合需要丰富细节的视觉内容。
whisper-large-v3将音频转为文本,用于转录、字幕与可搜索记录。
indextts2搭配有权使用的参考音频,生成文本转语音内容。
bge-m3建立多语言嵌入向量,支持语义搜索与检索增强生成。
bge-reranker-v2-m3根据查询重新排列文档,改善检索结果的相关性。
以下为公布的规格与价格;可用性以服务状态及实际 API 响应为准。
查看服务状态完整模型规格与代码示例提供英语及繁体中文。
让模型成为产品流程的一部分,选择真正需要的能力。
使用 GLM 5.2 FP8 构建对话流程、整理信息或辅助编程,根据任务评估上下文与输出长度。
GLM 5.2 FP8使用 Qwen3-VL 30B 理解扫描文档、图片与图表,将视觉信息带入内部工具。
Qwen3-VL 30B结合 Flux、Chroma、Whisper 与 IndexTTS2,规划素材生成、音频转录与语音输出的不同阶段。
Flux / Chroma / Whisper / IndexTTS2使用 BGE-M3 建立向量、搭配 BGE Reranker 重排,为知识库与 RAG 流程准备相关资料。
BGE-M3 / BGE Reranker访问权限与充值按当前服务流程确认,技术工具帮助你完成接入。
浏览模型目录,向团队确认 API 密钥申请方式及适用服务。
确认充值方案与付款方式;取得兑换码后,按指引加入 API 余额。
选择模型与开发语言,使用接入工具生成请求配置,再在自己的应用中加入密钥。
通过测试台查看实际响应,检查剩余余额与服务状态,再逐步调整用量。
模型平台、接入工具与模型详情提供英语及繁体中文。
先探索模型与公布价格,或带着工作负载需求,与我们讨论专属算力。