@misc{indiciae2f528a1505df, title = {Real Science Is Harder Than Benchmarks: Evaluating Advanced AI Frameworks on Published Studies. I. Uncertainty Quantification, ML on Therapeutic Data Commons, and Agent-Based Modeling}, author = {Ahmed, M. O. and Amale, S. A. and Bhavsar, R. D. and Chopra, P. and Jaimes, A. and Kachhwah, A. and Kalotra, C. D. and Li, P. and Li, X. and Liao, Y. and Roy, R. and Senthilselvan, N. and Shao, Y. and Sharma, A. D. and Shrivatsan, A. and Xue, R. and You, Y. and Badkul, A. and Xie, L. and Oet, M. and Lee, K. and Sinitskiy, A.}, year = {2026}, doi = {10.64898/2026.06.24.734302}, url = {https://www.biorxiv.org/content/10.64898/2026.06.24.734302v1}, note = {Source identifier: 10.64898/2026.06.24.734302} }