模型发布 / 更新普通
智谱上线 GLM-5.3-FlashX,推理速度最高 200 tokens/s
原始标题:GLM-5.3-FlashX上线:大大方方、好好用用、嗖嗖嗖嗖
内容摘要
智谱正式推出 GLM-5.3-FlashX,在 GLM-5.3-Flash 基础上加大对 Infra 侧投入与推理优化,速度最高 200 tokens/s,算力基于 10 万张国产芯片。该模型此前曾以 Ox Alpha 之名面向开发者,官方称其长期保持同尺寸最强智能水平并具备高性价比,API 已上线,Model Key:GLM-5.3-FlashX。