RESEARCH

Diagnostic Foundation for Evaluating LLMs' Research Integrity as Co-Scientists

ArXiv cs.AI · Fri, 14 Aug 2026 04:00:00 GMT

arXiv:2608.12345v1 Announce Type: new Abstract: Language models are increasingly deployed as co-scientists, yet their ability to uphold research integrity under institutional pressure remains unmeasured. We introduce IntegrityBench, a benchmark evaluating misconduct classificatio

Read original source Discuss with SiiMON