SWE Dialogue SWE-Bench: A Benchmark for Dialogue-Driven Coding Agents Paper • 2606.13995 • Published Jun 12
Dialogue SWE-Bench: A Benchmark for Dialogue-Driven Coding Agents Paper • 2606.13995 • Published Jun 12
Personas Beyond Borrowed Histories: Person-Aligned User Simulation for Interactive Role-Playing Evaluation Paper • 2607.27816 • Published 6 days ago • 33 Enjoy Your Talk: A Human-Centered Benchmark for Multi-Turn Dialogue with Decoupled User Simulation, Target Modeling, and Judging Paper • 2607.10428 • Published 12 days ago • 1 Toward Anthropomorphic Dialogue: A Closed-Loop Framework for Human-Like Chat Generation, Evaluation, and Preference Alignment Paper • 2607.17191 • Published 14 days ago • 1 EIBench: A Simulator-Based Benchmark and Turn-Credit RL for Emotion Management Paper • 2606.15532 • Published Jun 14
Beyond Borrowed Histories: Person-Aligned User Simulation for Interactive Role-Playing Evaluation Paper • 2607.27816 • Published 6 days ago • 33
Enjoy Your Talk: A Human-Centered Benchmark for Multi-Turn Dialogue with Decoupled User Simulation, Target Modeling, and Judging Paper • 2607.10428 • Published 12 days ago • 1
Toward Anthropomorphic Dialogue: A Closed-Loop Framework for Human-Like Chat Generation, Evaluation, and Preference Alignment Paper • 2607.17191 • Published 14 days ago • 1
EIBench: A Simulator-Based Benchmark and Turn-Credit RL for Emotion Management Paper • 2606.15532 • Published Jun 14
SWE Dialogue SWE-Bench: A Benchmark for Dialogue-Driven Coding Agents Paper • 2606.13995 • Published Jun 12
Dialogue SWE-Bench: A Benchmark for Dialogue-Driven Coding Agents Paper • 2606.13995 • Published Jun 12
Personas Beyond Borrowed Histories: Person-Aligned User Simulation for Interactive Role-Playing Evaluation Paper • 2607.27816 • Published 6 days ago • 33 Enjoy Your Talk: A Human-Centered Benchmark for Multi-Turn Dialogue with Decoupled User Simulation, Target Modeling, and Judging Paper • 2607.10428 • Published 12 days ago • 1 Toward Anthropomorphic Dialogue: A Closed-Loop Framework for Human-Like Chat Generation, Evaluation, and Preference Alignment Paper • 2607.17191 • Published 14 days ago • 1 EIBench: A Simulator-Based Benchmark and Turn-Credit RL for Emotion Management Paper • 2606.15532 • Published Jun 14
Beyond Borrowed Histories: Person-Aligned User Simulation for Interactive Role-Playing Evaluation Paper • 2607.27816 • Published 6 days ago • 33
Enjoy Your Talk: A Human-Centered Benchmark for Multi-Turn Dialogue with Decoupled User Simulation, Target Modeling, and Judging Paper • 2607.10428 • Published 12 days ago • 1
Toward Anthropomorphic Dialogue: A Closed-Loop Framework for Human-Like Chat Generation, Evaluation, and Preference Alignment Paper • 2607.17191 • Published 14 days ago • 1
EIBench: A Simulator-Based Benchmark and Turn-Credit RL for Emotion Management Paper • 2606.15532 • Published Jun 14
jeremygf/distilbert-base-uncased-finetuned-clinc Text Classification • 67.1M • Updated Jan 24, 2024 • 3
jeremygf/distilbert-base-uncased-finetuned-emotion Text Classification • 67M • Updated Jan 17, 2024 • 3