智譜推新模型 提升推理速度
彭博報道,智譜(2513)推出升級版模型GLM-5.3-FlashX,聲稱推理速度最高可達每秒200個Tokens。該模型此前以代號「Ox Alpha」運行。公告稱,為支撐持續增長的調用量,公司已在已有10萬張國產晶片的推理算力基礎之上,進一步優化了底層架構(Infra)並提升推理效率。
Last Update:
18 9 月, 2026
