小红书的人文智能实验室(Humane Intelligence Lab,简称hi lab)近日低调开源了其首个多模态大模型dots.vlm1,为视觉语言模型(VLM)领域带来了新气象。这款模型基于小红书自研…
近日,该实验室宣布开源其最新的视觉语言模型dots.vlm1,这一举措不仅展示了其在技术自研方面的决心,也为多模态AI的发展带来了新的活力。dots.vlm1是小红书hi lab首个开源的多模态大模型,它基…
dots.vlm1作为hi lab首个开源的多模态大模型,其构建基础是全自研的12亿参数NaViT视觉编码器和DeepSeek V3大语言模型。这一严谨的训练流程确保了dots.vlm1在视觉和文本两个领域…
最新开源的首个多模态大模型dots.vlm1,基于自研视觉编码器构建,实测看穿色盲图,破解数独,解高考数学题,一句话写李白诗风,视觉理解和推理能力都逼近Gemini2.5 Pro闭源模型。 一个理由是,hi…
06/25 00:17
06/25 00:16
06/25 00:15