Tren
dar
대시보드
논문
뉴스
GitHub
AI 소식
KO
EN
로그인
AI 소식
논문
대시보드
뉴스
GitHub
“vision language model”
이 키워드와 관련된 논문 · GitHub · 뉴스를 한곳에 모았습니다.
논문
11
전체 →
arXiv
생성모델
인용 0
텍스트 수준에서 구조화된 다양성을 유도하는 의미적 브라우징 방법
Semantic Browsing: Controllable Diversity for Image Generation
arXiv
컴퓨터비전
인용 0
VLM 기반 주간 시각 성능과 야간 반사도를 통합 평가하는 교통표지판 상태 종합 평가 프레임워크
A VLM-Enhanced Framework for Comprehensive Traffic Sign Condition Assessment Integrating Daytime Visual Performance and Nighttime Retroreflectivity Evaluation
arXiv
컴퓨터비전
인용 0
의료 비전-언어 모델의 수정 성능을 평가하는 임상 기반 벤치마크 제안
Evaluating and Understanding Model Editing for Medical Vision Language Models
arXiv
컴퓨터비전
인용 0
CLIP의 서체 공격 취약점을 학습 없이 해석하고 개선하는 메커니즘 해석 방법
Towards Robustness against Typographic Attack with Training-free Concept Localization
arXiv
컴퓨터비전
인용 0
희소 오토인코더의 개념 해석 가능성 평가 프레임워크 제안
Evaluating the Interpretability of Sparse Autoencoders with Concept Annotations
arXiv
멀티모달
인용 0
원격탐사 시각질의응답을 위한 경량 어댑터 기반 통합 프레임워크
A Unified Framework for Efficient Remote Sensing Visual Question Answering: Adapting Dual, Hybrid, and Encoder-Decoder Architectures
Semantic Scholar
인용 1
Uncertainty-aware large language models: a scoping review of conformal prediction methods.
arXiv
인용 0
Rollplex: Cross-Phase GPU Spatial Sharing for Vision Language Model Post-Training
arXiv
인용 0
A Picture is Worth a Thousand Tokens: How Vision Language Models Cut AI Energy Costs While Improving Accuracy
arXiv
인용 0
Evolution of Accuracy and Visual-Cognitive Errors in a Decade of Vision-Language AI Models
arXiv
인용 0
HIVE: Understanding Post-Hallucination Reasoning in Vision Language Models