智谱发布GLM-5V-Turbo视觉编程模型,原生支持多模态输入

智谱 GLM·20 天前

智谱AI近日发布了新一代视觉编程模型GLM-5V-Turbo。该模型具备原生多模态编码能力,可直接理解图像、视频、设计稿及文档布局等多种视觉输入形式。在技术特性上,GLM-5V-Turbo在视觉与编程能力之间实现了良好平衡,在多项核心基准测试中展现出领先的多模态编码、工具调用及GUI智能体性能。

值得注意的是,该模型针对Claude Code和Claw等应用场景进行了深度适配,能够与相关智能体实现深度协同工作。目前智谱已开放API接口和编程方案试用申请,开发者可通过官方渠道体验该模型的多模态编程能力。此次发布标志着国产大模型在多模态编程领域迈出重要一步,为AI辅助编程和自动化工作流提供了新的技术选择。

智谱GLM多模态模型视觉编程AI编程大模型

原文来源:https://x.com/Zai_org/status/2039371126984360085

相关阅读

智谱GLM-5-Turbo模型全面开放,面向所有编程计划用户
GLM-5.1 模型全面开放,所有编程计划用户均可使用
智谱发布AutoClaw:本地运行OpenClaw的新方案
智谱 GLM 发布官方开发环境 ZCode,支持 GLM-5.2
开发者基于GLM-5.1构建OSAP工具,实现跨应用工作流自动化

← 返回