智谱上线并开源“牛来”模型GLM-5.3-Flash
AI 摘要
一句话摘要: 智谱开源GLM-5.3-Flash原生多模态模型,性能接近Claude Opus 4.8,价格仅为前代十分之一。 关键事实: GLM-5.3-Flash首次采用稀疏注意力和线性注意力混合架构,用30T Token多模态数据预训练,编程和Agent评测接近Claude Opus 4.8,价格仅为GLM-5.2的十分之一,匿名测试时创下OpenCode和OpenRouter双平台调用量新高,全部由国产芯片提供算力支持。 涉及主体: 智谱, GLM-5.3-Flash, Ox-Alpha, Claude Opus 4.8, OpenCode, OpenRouter, vLLM, SGLang, KTransformers 可能影响: 该模型以极低价格提供接近顶级闭源模型的性能,可能加速AI应用在Crypto/Web3领域的落地,同时国产芯片算力支持验证了自主算力在AI推理中的可行性,降低对海外算力的依赖。 是否值得继续跟踪: 是,该模型开源且性能价格比突出,后续开发者生态和实际应用案例值得关注,尤其其在Agent和编程场景的表现可能影响Web3自动化工具发展。 噪音/炒作风险: 中,早期DeepSWE测试80%成绩被夸大,扩大样本后回落至63%,虽仍属第一梯队但需警惕社区过度解读,实际性能需更多独立基准验证。