{"id":48995,"topic":"ai","source":"PYMNTS.com","title":"NIST Launches AI Model Evaluation Program to Benchmark Performance on Blind Test Data - PYMNTS.com","url":"https://www.pymnts.com/news/artificial-intelligence/2026/nist-launches-ai-model-evaluation-program-benchmark-performance-blind-test-data/","url_hash":"6d190bd0b1406e7604be74109a2672de62004f63","author":"","summary":"<a href=\"https://news.google.com/rss/articles/CBMi0wFBVV95cUxPZ1lfQkRkMUlFZXU4aUphdmlReExfcHFVZE8tVUJnMzdtVU9BcG9uNGZQa2Z5Vlo3MXBMUzY1MElIM0xMS2tfU3lOWlZVTE9SQTluQWZjS3I4OVhPQW83NDNWMzVjUnF5NURGVVZxQ3puMGotNDlROWVaMlpWeUlabmk0ZnRUWEFlV1JYdERtejVMOHdjOHNtbDdoRGl0QXlzWlYxQXEzMHpzd2hSZWpPWkFjMDlIS1FBaDNIY090SlVRRGZQcnZKb2laQ28tdG4za0NN?oc=5\" target=\"_blank\">NIST Launches AI Model Evaluation Program to Benchmark Performance on Blind Test Data</a>&nbsp;&nbsp;<font color=\"#6f6f6f\">PYMNTS.com</font>","content":null,"image_url":null,"lang":"en","published_at":"2026-07-29T14:58:01+00:00","fetched_at":"2026-07-29T15:15:04+00:00","status":"read","starred":0,"extract_state":"failed","summary_auto":null,"cluster_id":null,"extract_retries":2,"extract_error":"trafilatura_none","contract_version":"news_item.v1","format_contract_version":"news_item_formats.v1","dedup_url":"https://www.pymnts.com/news/artificial-intelligence/2026/nist-launches-ai-model-evaluation-program-benchmark-performance-blind-test-data/","quality_profile":{"profile_version":"extraction_quality.v2","bucket":"low","confidence":0.2,"failure_kind":"extractor_empty","retryable":false,"retry_after_attempts":0,"reason":"Low confidence: extractor returned no usable article text.","operator_guidance":{"severity":"warning","recommended_action":"use_summary_with_caveat","next_step":"Use the available summary only with a visible quality caveat.","operator_label":"Use summary with caveat","can_retry":false,"can_use_summary":true,"diagnostics_required":true},"content_depth":{"contract_version":"content_depth.v1","category":"summary_only","label":"Summary only","has_full_text":false,"has_summary":true,"content_length":0,"summary_length":497,"usable_text_length":497,"source_field":"summary"},"legacy_collapsed":false,"signals":{"extract_state":"failed","extract_error":"trafilatura_none","extract_retries":2,"content_length":0,"summary_length":497}},"news_item":{"id":48995,"canonical_url":"https://www.pymnts.com/news/artificial-intelligence/2026/nist-launches-ai-model-evaluation-program-benchmark-performance-blind-test-data/","source_url":"https://www.pymnts.com/news/artificial-intelligence/2026/nist-launches-ai-model-evaluation-program-benchmark-performance-blind-test-data/","title":"NIST Launches AI Model Evaluation Program to Benchmark Performance on Blind Test Data - PYMNTS.com","source_name":"PYMNTS.com","author":null,"published_at":"2026-07-29T14:58:01+00:00","locale":"en","topic":"ai","tags":[],"rss_summary":"<a href=\"https://news.google.com/rss/articles/CBMi0wFBVV95cUxPZ1lfQkRkMUlFZXU4aUphdmlReExfcHFVZE8tVUJnMzdtVU9BcG9uNGZQa2Z5Vlo3MXBMUzY1MElIM0xMS2tfU3lOWlZVTE9SQTluQWZjS3I4OVhPQW83NDNWMzVjUnF5NURGVVZxQ3puMGotNDlROWVaMlpWeUlabmk0ZnRUWEFlV1JYdERtejVMOHdjOHNtbDdoRGl0QXlzWlYxQXEzMHpzd2hSZWpPWkFjMDlIS1FBaDNIY090SlVRRGZQcnZKb2laQ28tdG4za0NN?oc=5\" target=\"_blank\">NIST Launches AI Model Evaluation Program to Benchmark Performance on Blind Test Data</a>&nbsp;&nbsp;<font color=\"#6f6f6f\">PYMNTS.com</font>","full_text":null,"excerpt":"<a href=\"https://news.google.com/rss/articles/CBMi0wFBVV95cUxPZ1lfQkRkMUlFZXU4aUphdmlReExfcHFVZE8tVUJnMzdtVU9BcG9uNGZQa2Z5Vlo3MXBMUzY1MElIM0xMS2tfU3lOWlZVTE9SQTluQWZjS3I4OVhPQW83NDNWMzVjUnF5NURGVVZxQ3puMGotNDlROWVaMlpWeUlabmk0ZnRUWEFlV1JYdERtejVMOHdjOHNtbDdoRGl0QXlzWlYxQXEzMHpzd2hSZWpPWkFjMDlIS1FBaDNIY090SlVRRGZQcnZKb2laQ28tdG4za0NN?oc=5\" target=\"_blank\">NIST Launches AI Model Evaluation Program to Benchmark Performance on Blind Test Data</a>&nbsp;&nbsp;<font color=\"#6f6f6f\">PYMNTS.com</font>","extraction":{"state":"failed","confidence":0.2,"error":"trafilatura_none","explanation":"Low confidence: extractor returned no usable article text.","diagnostics_url":"/api/diagnose?url=https%3A//www.pymnts.com/news/artificial-intelligence/2026/nist-launches-ai-model-evaluation-program-benchmark-performance-blind-test-data/","quality_profile":{"profile_version":"extraction_quality.v2","bucket":"low","confidence":0.2,"failure_kind":"extractor_empty","retryable":false,"retry_after_attempts":0,"reason":"Low confidence: extractor returned no usable article text.","operator_guidance":{"severity":"warning","recommended_action":"use_summary_with_caveat","next_step":"Use the available summary only with a visible quality caveat.","operator_label":"Use summary with caveat","can_retry":false,"can_use_summary":true,"diagnostics_required":true},"content_depth":{"contract_version":"content_depth.v1","category":"summary_only","label":"Summary only","has_full_text":false,"has_summary":true,"content_length":0,"summary_length":497,"usable_text_length":497,"source_field":"summary"},"legacy_collapsed":false,"signals":{"extract_state":"failed","extract_error":"trafilatura_none","extract_retries":2,"content_length":0,"summary_length":497}}},"display_formats":["compact","card","full","digest_section","json"]},"daily_stack_record":{"title":"NIST Launches AI Model Evaluation Program to Benchmark Performance on Blind Test Data - PYMNTS.com","url":"https://www.pymnts.com/news/artificial-intelligence/2026/nist-launches-ai-model-evaluation-program-benchmark-performance-blind-test-data/","summary":"<a href=\"https://news.google.com/rss/articles/CBMi0wFBVV95cUxPZ1lfQkRkMUlFZXU4aUphdmlReExfcHFVZE8tVUJnMzdtVU9BcG9uNGZQa2Z5Vlo3MXBMUzY1MElIM0xMS2tfU3lOWlZVTE9SQTluQWZjS3I4OVhPQW83NDNWMzVjUnF5NURGVVZxQ3puMGotNDlROWVaMlpWeUlabmk0ZnRUWEFlV1JYdERtejVMOHdjOHNtbDdoRGl0QXlzWlYxQXEzMHpzd2hSZWpPWkFjMDlIS1FBaDNIY090SlVRRGZQcnZKb2laQ28tdG4za0NN?oc=5\" target=\"_blank\">NIST Launches AI Model Evaluation Program to Benchmark Performance on Blind Test Data</a>&nbsp;&nbsp;<font color=\"#6f6f6f\">PYMNTS.com</font>","source":"PYMNTS.com","date":"2026-07-29T14:58:01+00:00","content":"","confidence":0.2,"diagnostics_url":"/api/diagnose?url=https%3A//www.pymnts.com/news/artificial-intelligence/2026/nist-launches-ai-model-evaluation-program-benchmark-performance-blind-test-data/","quality_bucket":"low","failure_kind":"extractor_empty","retryable":false,"quality_reason":"Low confidence: extractor returned no usable article text.","quality_profile":{"profile_version":"extraction_quality.v2","bucket":"low","confidence":0.2,"failure_kind":"extractor_empty","retryable":false,"retry_after_attempts":0,"reason":"Low confidence: extractor returned no usable article text.","operator_guidance":{"severity":"warning","recommended_action":"use_summary_with_caveat","next_step":"Use the available summary only with a visible quality caveat.","operator_label":"Use summary with caveat","can_retry":false,"can_use_summary":true,"diagnostics_required":true},"content_depth":{"contract_version":"content_depth.v1","category":"summary_only","label":"Summary only","has_full_text":false,"has_summary":true,"content_length":0,"summary_length":497,"usable_text_length":497,"source_field":"summary"},"legacy_collapsed":false,"signals":{"extract_state":"failed","extract_error":"trafilatura_none","extract_retries":2,"content_length":0,"summary_length":497}},"tags":[]},"fallback_formats":["markdown","json","html"],"actions":{"read":"/item/48995","export_markdown":"/api/items/48995/export?format=markdown","export_json":"/api/items/48995/export?format=json","diagnose":"/api/diagnose?url=https%3A//www.pymnts.com/news/artificial-intelligence/2026/nist-launches-ai-model-evaluation-program-benchmark-performance-blind-test-data/"},"formats":{"full":{"id":48995,"title":"NIST Launches AI Model Evaluation Program to Benchmark Performance on Blind Test Data - PYMNTS.com","url":"https://www.pymnts.com/news/artificial-intelligence/2026/nist-launches-ai-model-evaluation-program-benchmark-performance-blind-test-data/","source":"PYMNTS.com","author":null,"published_at":"2026-07-29T14:58:01+00:00","locale":"en","topic":"ai","tags":[],"excerpt":"<a href=\"https://news.google.com/rss/articles/CBMi0wFBVV95cUxPZ1lfQkRkMUlFZXU4aUphdmlReExfcHFVZE8tVUJnMzdtVU9BcG9uNGZQa2Z5Vlo3MXBMUzY1MElIM0xMS2tfU3lOWlZVTE9SQTluQWZjS3I4OVhPQW83NDNWMzVjUnF5NURGVVZxQ3puMGotNDlROWVaMlpWeUlabmk0ZnRUWEFlV1JYdERtejVMOHdjOHNtbDdoRGl0QXlzWlYxQXEzMHpzd2hSZWpPWkFjMDlIS1FBaDNIY090SlVRRGZQcnZKb2laQ28tdG4za0NN?oc=5\" target=\"_blank\">NIST Launches AI Model Evaluation Program to Benchmark Performance on Blind Test Data</a>&nbsp;&nbsp;<font color=\"#6f6f6f\">PYMNTS.com</font>","full_text":null,"reading_time_min":1,"extraction":{"state":"failed","confidence":0.2,"error":"trafilatura_none","explanation":"Low confidence: extractor returned no usable article text.","diagnostics_url":"/api/diagnose?url=https%3A//www.pymnts.com/news/artificial-intelligence/2026/nist-launches-ai-model-evaluation-program-benchmark-performance-blind-test-data/","quality_profile":{"profile_version":"extraction_quality.v2","bucket":"low","confidence":0.2,"failure_kind":"extractor_empty","retryable":false,"retry_after_attempts":0,"reason":"Low confidence: extractor returned no usable article text.","operator_guidance":{"severity":"warning","recommended_action":"use_summary_with_caveat","next_step":"Use the available summary only with a visible quality caveat.","operator_label":"Use summary with caveat","can_retry":false,"can_use_summary":true,"diagnostics_required":true},"content_depth":{"contract_version":"content_depth.v1","category":"summary_only","label":"Summary only","has_full_text":false,"has_summary":true,"content_length":0,"summary_length":497,"usable_text_length":497,"source_field":"summary"},"legacy_collapsed":false,"signals":{"extract_state":"failed","extract_error":"trafilatura_none","extract_retries":2,"content_length":0,"summary_length":497}}},"quality_profile":{"profile_version":"extraction_quality.v2","bucket":"low","confidence":0.2,"failure_kind":"extractor_empty","retryable":false,"retry_after_attempts":0,"reason":"Low confidence: extractor returned no usable article text.","operator_guidance":{"severity":"warning","recommended_action":"use_summary_with_caveat","next_step":"Use the available summary only with a visible quality caveat.","operator_label":"Use summary with caveat","can_retry":false,"can_use_summary":true,"diagnostics_required":true},"content_depth":{"contract_version":"content_depth.v1","category":"summary_only","label":"Summary only","has_full_text":false,"has_summary":true,"content_length":0,"summary_length":497,"usable_text_length":497,"source_field":"summary"},"legacy_collapsed":false,"signals":{"extract_state":"failed","extract_error":"trafilatura_none","extract_retries":2,"content_length":0,"summary_length":497}},"actions":{"read":"/item/48995","export_markdown":"/api/items/48995/export?format=markdown","export_json":"/api/items/48995/export?format=json","diagnose":"/api/diagnose?url=https%3A//www.pymnts.com/news/artificial-intelligence/2026/nist-launches-ai-model-evaluation-program-benchmark-performance-blind-test-data/"}},"digest":{"id":48995,"title":"NIST Launches AI Model Evaluation Program to Benchmark Performance on Blind Test Data - PYMNTS.com","url":"https://www.pymnts.com/news/artificial-intelligence/2026/nist-launches-ai-model-evaluation-program-benchmark-performance-blind-test-data/","source":"PYMNTS.com","topic":"ai","published_at":"2026-07-29T14:58:01+00:00","excerpt":"<a…","quality_bucket":"low","quality_reason":"Low confidence: extractor returned no usable article text.","reading_time_min":1,"cluster_id":null},"card":{"display_title":"NIST Launches AI Model Evaluation Program to Benchmark Performance on Blind Test Data - PYMNTS.com","subtitle":"PYMNTS.com · 2026-07-29","summary":"<a…","badges":["quality:low","issue:extractor_empty"],"links":{"read":"/item/48995","original":"https://www.pymnts.com/news/artificial-intelligence/2026/nist-launches-ai-model-evaluation-program-benchmark-performance-blind-test-data/","diagnose":"/api/diagnose?url=https%3A//www.pymnts.com/news/artificial-intelligence/2026/nist-launches-ai-model-evaluation-program-benchmark-performance-blind-test-data/"},"quality_warning":"Low confidence: extractor returned no usable article text."},"export":{"title":"NIST Launches AI Model Evaluation Program to Benchmark Performance on Blind Test Data - PYMNTS.com","url":"https://www.pymnts.com/news/artificial-intelligence/2026/nist-launches-ai-model-evaluation-program-benchmark-performance-blind-test-data/","summary":"<a href=\"https://news.google.com/rss/articles/CBMi0wFBVV95cUxPZ1lfQkRkMUlFZXU4aUphdmlReExfcHFVZE8tVUJnMzdtVU9BcG9uNGZQa2Z5Vlo3MXBMUzY1MElIM0xMS2tfU3lOWlZVTE9SQTluQWZjS3I4OVhPQW83NDNWMzVjUnF5NURGVVZxQ3puMGotNDlROWVaMlpWeUlabmk0ZnRUWEFlV1JYdERtejVMOHdjOHNtbDdoRGl0QXlzWlYxQXEzMHpzd2hSZWpPWkFjMDlIS1FBaDNIY090SlVRRGZQcnZKb2laQ28tdG4za0NN?oc=5\" target=\"_blank\">NIST Launches AI Model Evaluation Program to Benchmark Performance on Blind Test Data</a>&nbsp;&nbsp;<font color=\"#6f6f6f\">PYMNTS.com</font>","source":"PYMNTS.com","date":"2026-07-29T14:58:01+00:00","content":"","confidence":0.2,"diagnostics_url":"/api/diagnose?url=https%3A//www.pymnts.com/news/artificial-intelligence/2026/nist-launches-ai-model-evaluation-program-benchmark-performance-blind-test-data/","quality_bucket":"low","failure_kind":"extractor_empty","retryable":false,"quality_reason":"Low confidence: extractor returned no usable article text.","quality_profile":{"profile_version":"extraction_quality.v2","bucket":"low","confidence":0.2,"failure_kind":"extractor_empty","retryable":false,"retry_after_attempts":0,"reason":"Low confidence: extractor returned no usable article text.","operator_guidance":{"severity":"warning","recommended_action":"use_summary_with_caveat","next_step":"Use the available summary only with a visible quality caveat.","operator_label":"Use summary with caveat","can_retry":false,"can_use_summary":true,"diagnostics_required":true},"content_depth":{"contract_version":"content_depth.v1","category":"summary_only","label":"Summary only","has_full_text":false,"has_summary":true,"content_length":0,"summary_length":497,"usable_text_length":497,"source_field":"summary"},"legacy_collapsed":false,"signals":{"extract_state":"failed","extract_error":"trafilatura_none","extract_retries":2,"content_length":0,"summary_length":497}},"tags":[],"format_contract_version":"news_item_formats.v1"}}}