| Jiangang Hao: Semantic Variability of LLM-Generated Replies Across LLMS: Implications for Designing Conversation-Based Assessment |
Burcu Arslan, Ikkyu Choi, Jesse Sparks, Reggie Gooch, Candace Walkington & Matthew Bernacki: Automated Evaluation of Mathematical Equivalence Between Personalized and Standard Word Problems |
| Beata Beigman Klebanov, Jamie Mikeska, Mengxuan Zhao, Catherine Flynn, Devon Fetrow, Shreyashi Halder, Rutuja Ubale, Tricia Maxwell & Michael Suhan: Towards Evaluating Teacher Performance in GenAI Teaching Simulation of a Science Discussion |
Jiyun Zu, Ikkyu Choi, Jamie Mikeska, Beata Beigman Klebanov & Michael Suhan: Prompting Strategies for Generative AI Teaching Simulations |
| Michael Fauss & Ikkyu Choi: On Promoting Individual-Level Fairness in Automated Scoring |
Ikkyu Choi, Jiyun Zu, Jamie N. Mikeska, Beata Beigman Klebanov, & Michael Suhan: A Framework for Evaluating LLM-Based Simulated Students to Support Teacher Learning |
| Teresa Ober & Michael Flor: Using Natural Language Processing to Explore Alignment Between Skill Taxonomies |
Chen Li, Mo Zhang & Liu Xiang: Keystroke Dynamics in Writing: Subgroup Analysis of Processes and Scoring Features |
| Shreyashi Halder, Jamie Mikeska & Heather Jorgenson: Evaluating Educators’ Instructional Skills on Making Content Explicit in Instruction in a Generative AI Teaching Simulation |
Hongwen Guo, Matthew Johnson, Luis Saldivia, Michelle Worthington, Jeremy Lee & Kadriye Ercikan: An Agentic Framework to Scale Up Human-AI Collaboration for Personalized Feedback From Large-Scale Assessments |
| Zuowei Wang, Michael Flor, Jiyun Zu, Tenaha O’Reilly & Wangjing Anya Ma: Responsible Use of Generative AI When Creating Reading Comprehension Questions: Inference Matters |
Jiyun Zu & Akshay Badola: Fine-Tuning Large Language Models for Automated Scoring: Classification, Regression vs. Ordinal Regression |
| Zuowei Wang, Benjamin Pierce, Michael Suhan, Tenaha O’Reilly, John Sabatini, Joseph Magliano & Jonathan Cohen: How to Generate Scenario-Based Learning and Assessment for Post-secondary Courses with GenAI |
Akshay Badola & Mo Zhang: Image-Based Representation of Item Response Patters for Test Integrity |