智谱 GLM-5.3-FlashX:基于 10 万国产芯片的推理突破
智谱发布 GLM-5.3-FlashX,基于 10 万张国产芯片集群训练,最高推理速度达 200 tokens/s,验证国产算力的可用性。
国产算力验证
GLM-5.3-FlashX 完全基于国产芯片集群训练与推理验证了国产算力可用性。
推理速度
最高推理速度 200 tokens/s 在国产芯片上达到可商用水平。
与海外差距
质量与海外头部有差距但在中文场景合规性和成本上具备独特优势。
DISCUSSION
文章讨论
0 条评论
