2026年智谱视觉推理模型 GLM-4.5V 上线并开源,号称“全球 100B 级效果**”

智谱视觉推理模型 GLM-4.5V 上线并开源,号称“全球 100B 级效果**”p data vmark bdfe 8 月 11 日消息 智谱 AI 今日推出全球 100B 级效果**的开源视觉推理模型 GLM 4 5V 总参数 106B 激活参数 12B 并同步在魔搭社区与 Hugging Face 开源 此外 API 调用价格低至输入 2 元 M tokens 输出 6 元 M tokens p

大家好,我是讯享网,很高兴认识大家。这里提供最前沿的Ai技术和互联网信息。



 

8 月 11 日消息,智谱 AI 今日推出全球 100B 级效果**的开源视觉推理模型 GLM-4.5V(总参数 106B,激活参数 12B),并同步在魔搭社区与 Hugging Face 开源。此外,API 调用价格低至输入 2 元 / M tokens,输出 6 元 / M tokens。

智谱宣布开源视觉推理模型GLM-4.5V正式上线并开源

IT之家从官方介绍获悉,GLM-4.5V 基于智谱新一代旗舰文本基座模型 GLM-4.5-Air,延续 GLM-4.1V-Thinking 技术路线,在 41 个公开视觉多模态榜单中综合效果达到同级别开源模型 SOTA 性能,涵盖图像、视频、文档理解以及 GUI Agent 等常见任务。

智谱宣布开源视觉推理模型GLM-4.5V正式上线并开源

在多模态榜单之外,其更重视模型在真实场景下的表现与可用性。GLM-4.5V 通过高效混合训练,具备覆盖不同种视觉内容的处理能力,实现全场景视觉推理,包括:

智谱宣布开源视觉推理模型GLM-4.5V正式上线并开源

同时,模型新增“思考模式”开关,用户可灵活选择快速响应或深度推理,平衡效率与效果。为帮助开发者直观体验 GLM-4.5V 的模型能力,打造专属于自己的多模态应用,智谱 AI 同步开源了一款桌面助手应用。

该桌面应用可实时截屏、录屏获取屏幕信息,并依托 GLM-4.5V 处理多种视觉推理任务,日常处理如代码辅助、视频内容分析、游戏解答、文档解读等多类视觉任务,成为一个能看着屏幕和你一起工作娱乐的伙伴。我们也希望通过模型开源和 API 服务,赋能更多有想法的开发者,基于多模态基座模型发挥创意和想象,把过去科幻电影中的场景变为现实。

小讯
上一篇 2026-04-06 08:56
下一篇 2026-04-06 08:54

相关推荐

版权声明:本文内容由互联网用户自发贡献,该文观点仅代表作者本人。本站仅提供信息存储空间服务,不拥有所有权,不承担相关法律责任。如发现本站有涉嫌侵权/违法违规的内容,请联系我们,一经查实,本站将立刻删除。
如需转载请保留出处:https://51itzy.com/kjqy/220981.html