明報 · 即時經濟18/9 14:08 (HKT)
智譜推新模型 提升推理速度

彭博報道,智譜(2513)推出升級版模型GLM-5.3-FlashX,聲稱推理速度最高可達每秒200個Tokens。該模型此前以代號「Ox Alpha」運行。公告稱,為支撐持續增長的調用量,公司已在已有10萬張國產晶片的推理算力基礎之上,進一步優化了底層架構(Infra)並提升推理效率。
HK24H 僅展示標題與短摘要,全文版權歸 明報 · 即時經濟 所有。

彭博報道,智譜(2513)推出升級版模型GLM-5.3-FlashX,聲稱推理速度最高可達每秒200個Tokens。該模型此前以代號「Ox Alpha」運行。公告稱,為支撐持續增長的調用量,公司已在已有10萬張國產晶片的推理算力基礎之上,進一步優化了底層架構(Infra)並提升推理效率。
HK24H 僅展示標題與短摘要,全文版權歸 明報 · 即時經濟 所有。