智谱 GLM · 2026-02-03 00:00
GLM-OCR 采用自研 CogViT 与 GLM-0.5B 的编码器-解码器设计,连接层实现高效跨模态对齐 基于数十亿图文对的 CLIP 预训练,具备强大的视觉语义与关键 Token 提取能力 模型小、速度快,在手写体、表格、印章、竖排等复杂场景中表现稳定
原文:智谱 GLM | 返回 AI 资讯列表