qwen35

科技人工智能

Apple发布LensVLM-9B视觉语言模型

Apple推出了LensVLM-9B,这是一个基于Qwen3.5-9B-Base的90亿参数视觉语言模型。该模型通过扫描压缩图像并选择性地扩展相关部分,使视觉语言模型能够在处理压缩文本图像时保持高精度。在4.3倍有效压缩率下,LensVLM的精度与完整文本基准相当,相比基线最高提升10.1倍有效压缩。该模型支持5x、…