{"id":247,"count":4,"description":"AI benchmark coverage: what MMLU, GPQA, SWE-bench, Terminal-Bench and ARC-AGI actually measure, who leads each one, and how to read a vendor's claim critically.","link":"https:\/\/convly.ai\/ar\/category\/ai-benchmarks\/","name":"\u0645\u0639\u0627\u064a\u0631 \u0623\u062f\u0627\u0621 \u0627\u0644\u0630\u0643\u0627\u0621 \u0627\u0644\u0627\u0635\u0637\u0646\u0627\u0639\u064a","slug":"ai-benchmarks","taxonomy":"category","parent":0,"meta":[],"_links":{"self":[{"href":"https:\/\/convly.ai\/ar\/wp-json\/wp\/v2\/categories\/247","targetHints":{"allow":["GET"]}}],"collection":[{"href":"https:\/\/convly.ai\/ar\/wp-json\/wp\/v2\/categories"}],"about":[{"href":"https:\/\/convly.ai\/ar\/wp-json\/wp\/v2\/taxonomies\/category"}],"wp:post_type":[{"href":"https:\/\/convly.ai\/ar\/wp-json\/wp\/v2\/posts?categories=247"}],"curies":[{"name":"wp","href":"https:\/\/api.w.org\/{rel}","templated":true}]}}