ملف الباحث
Arkadiy Saakyan
ورقة واحدة في مجموعة PaperMetrix
المنشورات
أوراق هذا المؤلف
-
Understanding Figurative Meaning through Explainable Visual Entailment
2024 · arXiv (Cornell University)
Large Vision-Language Models (VLMs) have demonstrated strong capabilities in tasks requiring a fine-grained understanding of literal meaning in images and text, such as visual question-answering or visual entailment. However, there has been little exploration of …