Articles
Can LLMs Really Understand Item Difficulty Levels? Implications for Automated Item Generation Using LLMs⭐9
Can LLMs accurately predict item difficulty? This study tests GPT-4.1 and GPT-5.4 against supervised models, revealing semantic limits and risks for automated i...
