Command Palette
Search for a command to run...
온라인 튜토리얼 | 비전 에이전트가 등장했다! DeepSeek-V4 신모델 벤치마크 점수 급상승, ApexBench에서 36.5 기록

DeepSeek-V4 시리즈가 공식적으로 다중 모달리티로 진격합니다! 첫 번째 실험용 시각 모델인 DeepSeek-V4-Flash-Vision-Exp가 정식 출시되었습니다.
DeepSeek-V4-Flash 아키텍처의 다중 모달리티 확장 버전인 DeepSeek-V4-Flash-Vision-Exp는 시각 모듈을 도입하고 지속적인 훈련을 통해 기존 텍스트 에이전트 능력을 유지하면서도 시각 이해 능력을 추가로 해금했습니다. 이 모델은 이미지, 차트 등의 시각 정보를 결합하여 복잡한 작업을 수행할 수 있으며, 특히 다중 모달리티 에이전트의 환경 인식 및 작업 처리 능력을 강화하는 데 중점을 둡니다.
성능 측면에서 본 모델은 텍스트와 다중 모달리티 에이전트 능력 간의 균형을 더욱 개선했습니다. 텍스트 에이전트 작업 성능이 기본적으로 안정된 상태를 유지한 가운데 ApexBench(Pass@1) 점수는 26.2에서 36.5로 상승했으며, Agents' Last Exam에서는 27.3점, Chartography 및 ZeroBench 등 다중 모달리티 평가 항목에서는 각각 64.3과 35.0의 성적을 거두었습니다. 또한 DeepSWE, NL2Repo, Toolathlon-Verified 등 텍스트 에이전트 테스트에서도 새로운 모델은 경쟁력 있는 모습을 보였습니다.
텍스트 이해에서 시각 지각까지, DeepSeek-V4-Flash-Vision-Exp는 DeepSeek-V4 시리즈에 다중 모달리티 에이전트의 새로운 방향성을 열었습니다. 시각 이해, 추론 및 도구 호출 능력이 지속적으로 융합됨에 따라 에이전트는 향후 복잡한 작업 수행, 차트 분석, 인터페이스 조작 등 실제 응용 시나리오에서 더 강력한 자율성을 발휘할 것으로 기대됩니다.
현재 HyperAI 튜토리얼 섹션에는 「DeepSeek-V4-Flash-Vision-Exp 다중 모달리티 추론 및 Open WebUI 배포」 가이드가 업로드되었으며, 원클릭으로 모델을 쉽게 배포하고 시각 이해, 다중 모달리티 에이전트 및 복잡한 작업 수행 능력을 빠르게 체험해 볼 수 있습니다.
온라인 실행하기:
더 많은 온라인 튜토리얼 보기:
데모 실행 방법
- hyper.ai 홈페이지에 접속한 후 「튜토리얼(Tutorials)」 페이지를 선택하거나 「자세히 보기(See More Tutorials)」 버튼을 클릭하여 「DeepSeek-V4-Flash-Vision-Exp 다중 모달리티 추론 및 Open WebUI 배포」를 찾고 「이 튜토리얼 실행(Run this tutorial)」 버튼을 클릭하세요.
- 페이지 이동 후 오른쪽 상단의 「Clone」 버튼을 클릭하여 해당 튜토리를 자신의 컨테이너로 복제하세요.
참고: 페이지 오른쪽 상단에서 언어 전환이 가능하며, 현재 중국어와 영어 두 가지 언어를 지원합니다. 본 튜토리얼은 영문 기준 단계별 안내를 제공합니다.
- 리소스가 할당될 때까지 기다린 후 상태가 「실행 중(Running)」 으로 변경되면 「Workspace 열기(Open Workspace)」 를 클릭하여 Jupyter Workspace로 진입하세요.
결과 미리보기
- 페이지 이동 후 왼쪽의 README 파일을 클릭하고, 파일 내부 상단에 있는 Run(실행) 버튼을 누르세요.
- 시작 후 오른쪽의 API 주소를 클릭하면 브라우저에서 Open WebUI 인터페이스에 접근할 수 있으며, 로컬 모델과의 대화를 바로 시작할 수 있습니다.



