apple/LensVLM-9B · Hugging Face
요약
LensVLM-9B는 텍스트의 압축된 이미지를 스캔하고, 학습된 도구를 이용해 관련 페이지를 선택적으로 비압축 형태로 확장하는 Vision Language Model(VLM)입니다. 이 모델은 Apple Machine Learning Research Model License 하에 제공되며, 관련된 소스 코드는 별도로 배포됩니다.
핵심 포인트
- LensVLM-9B는 텍스트의 압축 이미지를 처리하는 VLM이다.
- 학습된 도구를 통해 관련 페이지를 선택적으로 확장한다.
- Apple Machine Learning Research Model License가 적용된다.
https://huggingface.co/bartowski/LensVLM-9B-GGUF LensVLM-9B LensVLM은 텍스트의 압축된 이미지를 스캔한 다음, 학습된 도구를 통해 관련 페이지만 선택적으로 비압축 형태로 확장하는 9B Vision Language Model (VLM)입니다. 논문: LensVLM: Selective Context Expansion for Compressed Visual Representation of Text Code: https://github.com/apple-aiml-research/ml-lensvlm 라이선스 이 저장소의 모든 ML 모델 파일(Apple이 Qwen 모델에 수정한 내용 포함)은 Apple Machine Learning Research Model License 조건 하에 제공됩니다. 이 모델과 함께 제공되는 소스 코드는 별도로 배포되며, Apple Sample Code License 조건 하에 제공됩니다. /u/jacek2023가 r/LocalLLaMA에 제출함 [링크] [댓글들]
AI 자동 생성 콘텐츠
본 콘텐츠는 r/OpenAI Codex (search)의 원문을 AI가 자동으로 요약·번역·분석한 것입니다. 원 저작권은 원저작자에게 있으며, 정확한 내용은 반드시 원문을 확인해 주세요.
원문 바로가기