GLM-5.3-Flash此前以“Ox Alpha(ALP)”之名与全球开发者见面,获得海内外开发者的广泛认可,调用量持续攀升。面对快速增长的需求,我们在10万张国产芯片提供的推理算力基础上,进一步加大对Infra侧的投入与推理优化。
今日起,我们正式推出GLM-5.3-FlashX(最高200tokens/s),为企业与开发者带来更快、更流畅的模型体验。GLM-5.3-Flash长期保持同尺寸最强智能水平,并具备极高性价比,本次提速进一步形成智能、价格、速度的全面竞争力。
GLM-5.3-FlashX API现已上线,Model Key:GLM-5.3-FlashX。
使用方式:
API调用:https://docs.bigmodel.cn/api-reference/模型-api/对话补全
体验中心:https://www.bigmodel.cn/trialcenter/modeltrial/visual?modelCode=glm-5.3-flashx
