PANews 9月18日消息,據智譜公眾號,公司推出GLM-5.3-FlashX,API與體驗中心已開放,官方稱最高推理速度達200 tokens/s,此次提速建立在10萬張國產芯片提供的推理算力之上,並追加了Infra與推理優化投入。其基礎模型GLM-5.3-Flash於8月26日開源,總參數3200億、激活參數180億,上下文100萬tokens,此前曾以"Ox Alpha"匿名測試。
智譜上線GLM-5.3-FlashX,最高推理速度達200 tokens/s
分享至:
作者:PA一线
本內容只為提供市場資訊,不構成投資建議。
關注PANews官方賬號,一起穿越牛熊
推薦閱讀



