# Why benchmarking clinical LLMs from OpenEvidence, Doximity is complicated - STAT

*Источник: STAT*
*Дата: 2026-07-29*
*Язык: en*

<a href="https://news.google.com/rss/articles/CBMipAFBVV95cUxNOWNiT2R6ZDF4S2QyWmZGbEhvOFIwbllXR09qZzR0SEl3ZGJOb2xhT2EtdGo3TEpNVElRZXUzbElWYjlpZFpzUi1ja3FDZG53N2JPR2NrcFgxYy1MeGpfNXg2dzhjbDdOcTdIZERTUHlFRnpSQ0RkVFl1TEo0Z2Roa1otalBaNm5PRllRZ1dWc1hQRVh2N1pvUHRQUWs3LVg1eGdqVQ?oc=5" target="_blank">Why benchmarking clinical LLMs from OpenEvidence, Doximity is complicated</a>&nbsp;&nbsp;<font color="#6f6f6f">STAT</font>

[Оригинал](https://www.statnews.com/2026/07/29/benchmarking-clinical-chatbots-openevidence-doximity-ai-prognosis/)