비전 & 입력
modlens
텍스트 전용 DeepSeek 모델에 플러그인 비전을 답니다. 스크린샷을 붙여 넣으면 구조화된 근거가 나옵니다.
무엇인가
텍스트 전용 코딩 에이전트를 위한 비전 브리지. 채팅에 이미지를 붙여 넣으면 modlens가 모델의 짐작 대신 구조화된 JSON 근거로 바꿔 줍니다. 전체 전사, 읽기 순서대로 정리된 레이아웃 영역, 엔티티와 관계까지.
The first vision plugin for DeepSeek Harness, and the vision bridge for every text-only coding agent. Paste an image, get structured JSON evidence (OCR, layout, semantics).
디자인에 왜 중요한가
- UI 스크린샷이 에이전트가 곧바로 다룰 수 있는 요소별 워크스루가 됩니다.
- 빽빽한 차트와 데이터 시각화도 빠짐없이 읽어 냅니다. 축, 스케일, 팔레트, 강조 영역까지.
- 레퍼런스 여러 장을 한 번에 붙여 넣으면 각각을 설명하기 전에 공통된 시각적 계열부터 짚어 냅니다.
다루는 내용
- Highlights
- Installation
- Usage
- See it work
- Documentation
설치 방법
modlens
-
터미널에서 실행하세요.
npx -y @deepseek-ai/dsh plugin --profile web add @liustack/modlens@latest -
플러그인을 인식하도록 dsh web을 다시 시작하세요.
-
그다음 원하는 디자인을 설명하세요. 하네스가 플러그인의 도구를 알아서 집어 듭니다.
DeepSeek Harness로 실행하는 법
-
플러그인을 설치하면 모델 선택기에 modlens 비전이 붙은 DeepSeek-V4 변형이 추가됩니다.
-
스크린샷, 목업, 차트를 대화에 바로 붙여 넣으세요.
-
이미지를 다시 설명하는 대신 구조화된 근거를 상대로 디자인 질문을 던지세요.
여기 모인 플러그인은 모두 무료로 설치할 수 있으며, 실제 업스트림 출처로 연결됩니다.
DeepSeek Harness 저장소에서 더 보기 ↗다음 단계
세팅 없이, OpenDesign으로 디자인하기
이 플러그인을 직접 설치해도 되고, OpenDesign으로 DeepSeek Harness 주위에 잘 정돈된 디자인 레이어를 통째로 두를 수도 있습니다. 키는 직접 가져오고, 산출물도 직접 소유하세요.