All
Document-AI
Evaluation
Information-Retrieval
Multilingual
Multimodal
RAG
Reasoning
Responsible-AI
All years
2026
2025
2024
2021
All venues
AACL
ACL
ACM
ARXIV
CIKM
COLING
CVPR
DASFAA
EMNLP
ICCV
ICLR
ICML
IEEE
LJMU
NAACL
PAKDD
WACV
2026
Judging What We Cannot Solve: A Consequence-Based Approach for Oracle-Free Evaluation of Research-Level Math ICML 2026 Spotlight Paper
Guijin Son, Donghun Yang, Hitesh Laxmichand Patel, Hyunwoo Ko, Amit Agarwal , Sunghee Ahn, Kyong-Ha Lee, Youngjae Yu .
Do Image-Text Metrics Respect Semantic Invariances?
Amit Agarwal , Hitesh Laxmichand Patel, Meizhu Liu, Jyotika Singh, Karan Dua, Hansa Meghwani, Matthew Rowe, Michael Avendi, Yassi Abbasi, Tao Sheng, Sujith Ravi, Dan Roth .
Pushing on Multilingual Reasoning Models With Language-Mixed Chain-of-Thought
Guijin Son, Donghun Yang, Hitesh Laxmichand Patel, Amit Agarwal , Hyunwoo Ko, Chanuk Lim, Srikant Panda, Minhyuk Kim, Nikunj Drolia, Dasol Choi, Kyong-Ha Lee, Youngjae Yu .
World in a Frame: Understanding Culture Mixing as a New Challenge for Vision-Language Models
Eunsu Kim, Junyeong Park, Na Min An, Junseong Kim, Hitesh Laxmichand Patel, Jiho Jin, Julia Kruk, Amit Agarwal , Srikant Panda, Fenal Ashokbhai Ilasariya, Hyunjung Shim, Alice Oh .
Learning from Unknown for Open-Set Test-Time Adaptation
Taki Hasan Rafi, Amit Agarwal , Hitesh Laxmichand Patel, Dong-Kyu Chae .
LLM for Barcodes: Generating Diverse Synthetic Data for Identity Documents
Hitesh Laxmichand Patel, Amit Agarwal , Bhargava Kumar, Karan Gupta, Priyaranjan Pattnayak .
RECOR: Reasoning-Focused Multi-Turn Conversational Retrieval Benchmark
Mohammed Ali, Abdelrahman Abdallah, Amit Agarwal , Hitesh Laxmichand Patel, Adam Jatowt .
Instance-Aware Test-Time Adaptation for Domain Generalization
Taki Hasan Rafi, Serbeter Karlo, Amit Agarwal , Hitesh Laxmichand Patel, Bhargava Kumar, Dong-Kyu Chae .
Think Twice Before You Write -- an Entropy-based Decoding Strategy to Enhance LLM Reasoning
Jiashu He, Meizhu Liu, Olaitan P Olaleye, Amit Agarwal , M. Avendi, Yassi Abbasi, Matthew Rowe, Hitesh Laxmichand Patel, Paul Li, Tao Sheng, Sujith Ravi, Dan Roth .
GSM-SEM: Benchmark and Framework for Generating Semantically Variant Augmentations
Jyotika Singh, Fang Tu, Aziza Mirzadova, Amit Agarwal , Hitesh Laxmichand Patel, Sandip Ghoshal, Miguel Ballesteros, Yassine Benajiba, Weiyi Sun, Graham Horwood, Sujith Ravi, Dan Roth .
CommonLID: Re-evaluating State-of-the-Art Language Identification Performance on Web Data
Pedro Ortiz Suarez, Laurie Burchell, Catherine Arnett, ... Amit Agarwal , et al .
A Review of Human-Centric Evaluation of Cultural Biases in Indic Languages in LLMs: Rethinking Research Directions
Azmine Toushik Wasi, Omid Reza Heidari, MD Mohaymen Ul Anam, Abdur Rahman, Amit Agarwal , Hitesh Laxmichand Patel, Bhargava Kumar, Taki Hasan Rafi, Dong-Kyu Chae .
Survey of Large Multimodal Model Datasets, Application Categories and Taxonomy
Priyaranjan Pattnayak, Hitesh Laxmichand Patel, Bhargava Kumar, Amit Agarwal , Ishan Banerjee, Srikant Panda, Tejaswini Kumar .
2025
AccessEval: Benchmarking Disability Bias in Large Language Models EMNLP 2025 Best Social Impact Paper Award
Srikant Panda, Amit Agarwal , Hitesh Laxmichand Patel .
RCI: A Score for Evaluating Global and Local Reasoning in Multimodal Benchmarks
Amit Agarwal , Hitesh Laxmichand Patel, Srikant Panda, Hansa Meghwani, Jyotika Singh, Karan Dua, Paul Li, Tao Sheng, Sujith Ravi, Dan Roth .
FS-DAG: Few Shot Domain Adapting Graph Networks for Visually Rich Document Understanding
Amit Agarwal , Srikant Panda, Kulbhushan Pachauri .
Aligning LLMs for Multilingual Consistency in Enterprise Applications
Amit Agarwal , Hansa Meghwani, Hitesh Laxmichand Patel, Tao Sheng, Sujith Ravi, Dan Roth .
MVTamperBench: Evaluating Robustness of Vision-Language Models
Amit Agarwal , Srikant Panda, Angeline Charles, Bhargava Kumar, Hitesh Laxmichand Patel, Priyaranjan Pattnayak, Taki Hasan Rafi, Tejaswini Kumar, Hansa Meghwani, Karan Gupta, Dong-Kyu Chae .
Towards Robust Continual Test-Time Adaptation via Neighbor Filtration
Taki Hasan Rafi, Amit Agarwal , Hitesh Laxmichand Patel, Dong-Kyu Chae .
PCRI: Measuring Context Robustness in Multimodal Models for Enterprise Applications
Hitesh Laxmichand Patel, Amit Agarwal , Srikant Panda, Hansa Meghwani, Karan Dua, Paul Li, Tao Sheng, Sujith Ravi, Dan Roth .
Hybrid AI for Responsive Multi-Turn Online Conversations With Novel Dynamic Routing and Feedback Adaptation
Priyaranjan Pattnayak, Amit Agarwal , Hansa Meghwani, Hitesh Laxmichand Patel, Srikant Panda .
Hard Negative Mining for Domain-Specific Retrieval in Enterprise Systems
Hansa Meghwani, Amit Agarwal , Priyaranjan Pattnayak, Hitesh Laxmichand Patel, Srikant Panda .
SweEval: Do LLMs Really Swear? A Safety Benchmark for Testing Limits for Enterprise Use
Hitesh Laxmichand Patel, Amit Agarwal , Arion Das, Bhargava Kumar, Srikant Panda, Priyaranjan Pattnayak, Taki Hasan Rafi, Tejaswini Kumar, Dong-Kyu Chae .
Review of Reference Generation Methods in Large Language Models
Priyaranjan Pattnayak, Amit Agarwal , Bhargava Kumar, Yeshil Bangera, Srikant Panda, Tejaswini Kumar, Hitesh Laxmichand Patel .
Tokenization Matters: Improving Zero-Shot NER for Indic Languages
Priyaranjan Pattnayak, Hitesh Laxmichand Patel, Amit Agarwal .
LLM-Guided Lifecycle-Aware Clustering of Multi-Turn Customer Support Conversations
Priyaranjan Pattnayak, Sanchari Chowdhuri, Amit Agarwal , Hitesh Laxmichand Patel .
Clinical QA 2.0: Multi-Task Learning for Answer Extraction and Categorization
Priyaranjan Pattnayak, Hitesh Laxmichand Patel, Amit Agarwal , Bhargava Kumar, Srikant Panda, Tejaswini Kumar .
Can LLMs Narrate Tabular Data? An Evaluation Framework for Natural Language Representations of Text-to-SQL System Outputs
Jyotika Singh, Weiyi Sun, Amit Agarwal , Viji Krishnamurthy, Yassine Benajiba, Sujith Ravi, Dan Roth .
A Diagnostic Framework for Auditing Reference-Free Vision-Language Metrics
Angeline Charles, Srikant Panda, Amit Agarwal , Hitesh Laxmichand Patel, Priyaranjan Pattnayak, Bhargava Kumar, Tejaswini Kumar .
Who's Asking? Investigating Bias Through the Lens of Disability-Framed Queries in LLMs
Vishnu Hari, Kalpana Panda, Srikant Panda, Amit Agarwal , Hitesh Laxmichand Patel .
LegalMind: An Intelligent Solution for Legal Document Analysis With User-Centric UI and AI-Driven Capabilities in Mobile Devices
Azmine Toushik Wasi, Mst Rafia Islam, Abdur Rahman, Tawfia Yeasmin, Amit Agarwal , Hitesh Laxmichand Patel, Taki Hasan Rafi, Dong-Kyu Chae .
FlexDoc: Parameterized Sampling for Diverse Multilingual Synthetic Documents for Training Document Understanding Models
Karan Dua, Hitesh Laxmichand Patel, Puneet Mittal, Ranjeet Gupta, Amit Agarwal , Praneet Pabolu, Srikant Panda, Hansa Meghwani, Graham Horwood, Fahad Shah .
DAIQ: Auditing Demographic Attribute Inference from Question in LLMs
Srikant Panda, Hitesh Laxmichand Patel, Shahad Al-Khalifa, Amit Agarwal , Hend Al-Khalifa, Sharefah Al-Ghamdi .
Crowdsource, Crawl, or Generate? Creating SEA-VL, a Multicultural Vision-Language Dataset for Southeast Asia
Samuel Cahyawijaya, Holy Lovenia, Joel Ruben Antony Moniz, ... Amit Agarwal , et al .
BenchHub: A Unified Benchmark Suite for Holistic and Customizable LLM Evaluation
Eunsu Kim, Haneul Yoo, Guijin Son, Hitesh Patel, Amit Agarwal , Alice Oh .