数码硬件
morning
不用NVIDIA显卡也能降低80% AI成本 智谱已实现10万国产AI芯片推理
摘要
快科技8月31日消息,前不久Ox-Alpha牛来大模型引发网络热议,它最终揭开身份就是智谱的GLM-5.3 Flash,这是一个不靠NVIDIA显卡而是10万张国产AI芯片支撑的大模型。 智谱今天也发布了上市后的首份半年报,就提到了这批国产AI芯片的信息, 称公司目前已经实现10万级国产芯片的规模化低成本推理,单位Token推理成本较年初下降80%。 智谱提到,这批国产算力此前已经经过真实流量压测...
快科技8月31日消息
前不久Ox
Alpha牛来大模型引发网络热议
它最终揭开身份就是智谱的GLM
Flash
这是一个不靠NVIDIA显卡而是10万张国产AI芯片支撑的大模型
智谱今天也发布了上市后的首份半年报
就提到了这批国产AI芯片的信息
称公司目前已经实现10万级国产芯片的规模化低成本推理
单位Token推理成本较年初下降80
2026-08-31
1 阅读
约1分钟阅读
宪瑞
字号:
快科技8月31日消息,前不久Ox-Alpha牛来大模型引发网络热议,它最终揭开身份就是智谱的GLM-5.3 Flash,这是一个不靠NVIDIA显卡而是10万张国产AI芯片支撑的大模型。 智谱今天也发布了上市后的首份半年报,就提到了这批国产AI芯片的信息, 称公司目前已经实现10万级国产芯片的规模化低成本推理,单位Token推理成本较年初下降80%。 智谱提到,这批国产算力此前已经经过真实流量压测。GLM-5.3-Flash发布前以Ox-Alpha 匿名上线OpenRouter和OpenCode等平台,Token调用量达到62万亿。 在这款大模型正式发布后,全部线上流量也继续由10万张国产芯片承载——只不过智谱依然没有透露这个10万张国产显卡的推理系统到底是来自于哪家公司。 业绩方面,智谱公司上半年收入达到9.54亿元人民币,同比增长399.7%,接近去年同期的 5倍。 增长主要来自开放平台和 API,收入从2910万元增至8.25亿元,同比增长2735.7%,已经占总收入的86.5%。 智谱的API业务毛利率也从去年同期的-0.4%升至24.6%,主要靠调用规模扩大、定价上调和推理成本下降。 不过智谱的亏损依然很高,同时研发也在大规模投入, 上半年研发支出21.31亿元,同比增长33.6%;经调整净亏损19.64亿元,比去年同期的17.52亿元扩大12.1%。
这篇文章对您有帮助吗?
订阅66必读
每日精选科技资讯,直达你的邮箱