EMNLP 2025

•

November 05, 2025

•

Suzhou, China

Please log in to leave a comment

Downloads

SlidesPaperTranscript English (automatic)

Next from EMNLP 2025

Auto-SLURP: A Benchmark Dataset for Evaluating Multi-Agent Frameworks in Smart Personal Assistant
poster

Auto-SLURP: A Benchmark Dataset for Evaluating Multi-Agent Frameworks in Smart Personal Assistant

EMNLP 2025

Xiaoyu Shen
Lei Shen and 1 other author

05 November 2025

Similar lecture

Flaw or Artifact? Rethinking Prompt Sensitivity in Evaluating LLMs
poster

Flaw or Artifact? Rethinking Prompt Sensitivity in Evaluating LLMs

EMNLP 2025

+3
Jindong Gu and 5 other authors

05 November 2025