Ali, Dalia, Dora Zhao, Allison Koenecke, and Orestis Papakyriakopoulos. 2026. “Operationalizing Pluralistic Values in Large Language Model Alignment Reveals Trade-Offs in Safety, Inclusivity, and Model Behavior.” Proceedings of the AAAI Conference on Artificial Intelligence 40.
Li, Chihao, and Yue Qi. 2025.
“Toward Accurate Psychological Simulations: Investigating LLMs’ Responses to Personality and Cultural Variables.” Computers in Human Behavior 170: 108687.
https://doi.org/10.1016/j.chb.2025.108687.
Liu, Yunting, Shreya Bhandari, and Zachary A. Pardos. 2025.
“Leveraging LLM Respondents for Item Evaluation: A Psychometric Analysis.” British Journal of Educational Technology 56 (3): 1028–52.
https://doi.org/10.1111/bjet.13570.
Lukauskas, Mantas, and Viktorija Šarkauskait. 2026. “Plausible but Not Valid: A Psychometric Audit of LLMs as Synthetic Survey Respondents.” arXiv Preprint arXiv:2608.14606.
Mazzullo, Elisabetta, and Okan Bulut. 2026.
“Diversity and Carelessness in LLM-Generated Psychometric Data: Implications for Data Quality and Trust.” Computers 15 (9): 562.
https://doi.org/10.3390/computers15090562.
Russell-Lasalandra, Lara L., Alexander P. Christensen, and Hudson Golino. 2026.
“Generative Psychometrics via AI-GENIE: Automatic Item Generation and Validation with Network-Integrated Evaluation.” Behavior Research Methods 58: 217.
https://doi.org/10.3758/s13428-026-03082-1.
Shen, Qian, and Yu Han. 2026. “The Reliability Illusion in Synthetic Patients: Psychometric Misalignment of Open-Weight LLMs on PHQ-9 and GAD-7.” Proceedings of the 10th Workshop on Computational Linguistics and Clinical Psychology (CLPsych 2026), 83–95.