跳到正文
原文
Ollama Blog·· 2024-02-02AI 评分50

LLaVA 1.6 视觉模型更新:支持更高分辨率与文本识别

Vision models

AI 导读

LLaVA 1.6 支持最高 4 倍像素分辨率,并在文档、图表数据上训练以提升文本识别与推理能力。模型提供 7B、13B、34B 三种参数规模,采用 Apache 2.0 或 LLaMA 2 Community License 发布,可通过 ollama run llava:7b/13b/34b 调用。

来源:Ollama Blog · ollama.com