智谱发布GLM-5V-Turbo视觉编程模型,原生支持多模态输入
智谱AI近日发布了新一代视觉编程模型GLM-5V-Turbo。该模型具备原生多模态编码能力,可直接理解图像、视频、设计稿及文档布局等多种视觉输入形式。在技术特性上,GLM-5V-Turbo在视觉与编程能力之间实现了良好平衡,在多项核心基准测试中展现出领先的多模态编码、工具调用及GUI智能体性能。
值得注意的是,该模型针对Claude Code和Claw等应用场景进行了深度适配,能够与相关智能体实现深度协同工作。目前智谱已开放API接口和编程方案试用申请,开发者可通过官方渠道体验该模型的多模态编程能力。此次发布标志着国产大模型在多模态编程领域迈出重要一步,为AI辅助编程和自动化工作流提供了新的技术选择。