Z.ai新模型GLM-5.3-Flash登陆LM Studio,成本比上一代低10倍
LM Studio今天为Z.ai的GLM-5.3-Flash推出云支持,模型加入Bionic。Bionic是面向Mac和Windows的AI代理平台,用于编码、研究、文档处理。公告发出时,距离GLM-5.3-Flash正式亮相只有几个小时。
正式发布前,它以"Ox Alpha"为代号匿名测试,平台是OpenCode和OpenRouter。当时已经引起不少关注。它是一个3200亿参数的混合专家模型,只激活180亿参数。支持图像和文本输入,上下文窗口有100万token。整本书或长文档可以一次性丢给AI处理,不用手动拆分。
在Z.ai拿出的基准测试里,GLM-5.3-Flash领先GLM-5.2。整体和Anthropic、OpenAI、Google、DeepSeek的前沿模型落在同一范围。LM Studio说它的运行成本比GLM-5.2便宜9到10倍。
对用Bionic做编码、研究、文档处理的人来说,同样的预算能干明显更多的活。个人开发者也能用低得多的成本,够到和前沿模型同一档的水平。
Bionic自7月中旬发布以来一直在扩充模型。推出后不久,LM Studio接入了Moonshot AI的Kimi K3。今天加进来的是GLM-5.3-Flash。平台可以用本地模型,也可以用托管在美国服务器上的云模型。GLM-5.3-Flash从美国服务器提供服务,默认启用零数据保留。输入数据不会被存储。
具体定价没有出现在公告里。多模态、长上下文、成本砍掉九成,这几件事叠在一起。Bionic上的代理任务比几个月前便宜得多,也能处理更复杂的输入。