SciIntBench: research integrity in language models
arXiv preprint arXiv:2605.29468 · 2026 · Preprint
Do language models uphold research-integrity norms when misconduct is framed as a routine request?
Across 16 models, refusals were substantially more reliable for explicit misconduct than for covert violations. SciIntBench evaluates both misconduct refusal and helpfulness on legitimate scientific tasks.



