VLM 글 목록
코텍시스 기술 블로그에서 VLM 태그가 붙은 글 2편을 모았습니다. 기업 AI 도입과 AX 현장에서 확인한 내용을 정리합니다.
글 2편
AI
[논문] VLM은 영상을 보고 공간을 이해하지 못한다, GST-Bench
최신 VLM 22종을 영상 기반 전역 공간 인지로 평가했더니 최고 점수가 42.68점이었습니다. 사람은 79.08점입니다. 국소 공간 이해는 되지만 전체를 하나의 지도로 합치지 못한다는 것이 원인입니다.
Cortexys2026.08.10
![[논문] 영상 내용을 직접 이해하고 검색하는 멀티에이전트 V-Agent](https://cortexys-blog-images.s3.ap-northeast-2.amazonaws.com/blog/w640/20260114-v-agent-multi-agent-video-understanding-retrieval-m3-742a39.webp)
AI
[논문] 영상 내용을 직접 이해하고 검색하는 멀티에이전트 V-Agent
NC AI 연구팀이 ACM CIKM 2025에 발표한 V-Agent를 분석합니다. VLM을 검색 모델로 바꾸는 검색 벡터 기법과 세 에이전트의 협력 구조로 MultiVENT 2.0에서 기존 SOTA를 9.4%p 앞선 과정을 실험 데이터와 함께 살펴봅니다.
Cortexys2026.01.14

