Skip to main content
Skip to footer

Responsible AI Research for Learning and Assessment

AIME ETS Sessions
Jiangang Hao: Semantic Variability of LLM-Generated Replies Across LLMS: Implications for Designing Conversation-Based Assessment Burcu Arslan, Ikkyu Choi, Jesse Sparks, Reggie Gooch, Candace Walkington & Matthew Bernacki: Automated Evaluation of Mathematical Equivalence Between Personalized and Standard Word Problems
Beata Beigman Klebanov, Jamie Mikeska, Mengxuan Zhao, Catherine Flynn, Devon Fetrow, Shreyashi Halder, Rutuja Ubale, Tricia Maxwell & Michael Suhan: Towards Evaluating Teacher Performance in GenAI Teaching Simulation of a Science Discussion Jiyun Zu, Ikkyu Choi, Jamie Mikeska, Beata Beigman Klebanov & Michael Suhan: Prompting Strategies for Generative AI Teaching Simulations
Michael Fauss & Ikkyu Choi: On Promoting Individual-Level Fairness in Automated Scoring Ikkyu Choi, Jiyun Zu, Jamie N. Mikeska, Beata Beigman Klebanov, & Michael Suhan: A Framework for Evaluating LLM-Based Simulated Students to Support Teacher Learning
Teresa Ober & Michael Flor: Using Natural Language Processing to Explore Alignment Between Skill Taxonomies Chen Li, Mo Zhang & Liu Xiang: Keystroke Dynamics in Writing: Subgroup Analysis of Processes and Scoring Features
Shreyashi Halder, Jamie Mikeska & Heather Jorgenson: Evaluating Educators’ Instructional Skills on Making Content Explicit in Instruction in a Generative AI Teaching Simulation Hongwen Guo, Matthew Johnson, Luis Saldivia, Michelle Worthington, Jeremy Lee & Kadriye Ercikan: An Agentic Framework to Scale Up Human-AI Collaboration for Personalized Feedback From Large-Scale Assessments
Zuowei Wang, Michael Flor, Jiyun Zu, Tenaha O’Reilly & Wangjing Anya Ma: Responsible Use of Generative AI When Creating Reading Comprehension Questions: Inference Matters Jiyun Zu & Akshay Badola: Fine-Tuning Large Language Models for Automated Scoring: Classification, Regression vs. Ordinal Regression
Zuowei Wang, Benjamin Pierce, Michael Suhan, Tenaha O’Reilly, John Sabatini, Joseph Magliano & Jonathan Cohen: How to Generate Scenario-Based Learning and Assessment for Post-secondary Courses with GenAI Akshay Badola & Mo Zhang: Image-Based Representation of Item Response Patters for Test Integrity