科技
智谱上线GLM-5.3-FlashX,最高推理速度达200 tokens/s
PANews 9月18日消息,据智谱公众号,公司推出GLM-5.3-FlashX,API与体验中心已开放,官方称最高推理速度达200 tokens/s,此次提速建立在10万张国产芯片提供的推理算力之上,并追加了Infra与推理优化投入。其基础模型GLM-5.3-Flash于8月26日开源,总参数3200亿、激活参数180亿,上下文100万tokens,此前曾以"Ox Alpha"匿名测试。
阅读全文本文仅展示来源提供的标题与摘要,完整内容及版权归原发布方所有。
前往 PANews 原文 FireView 对公开资讯进行聚合和分类,不代表对来源内容的背书,也不构成投资建议。新闻可能存在延迟、修订或错误,请以原发布方为准。
