option
Home
Flash News
Content
AnthonyHernández
AnthonyHernández
July 24, 2026

A joint UK-US AI safety evaluation found Moonshot's Kimi K3 significantly lags behind leading US models in exploit development and simulated cyberattacks, scoring 32.2% vs 76.2% on ExploitBench and failing to achieve arbitrary code execution. It outperformed Chinese Zhipu GLM-5.2 but raised concerns about weak safety barriers and growing misuse risks from open-weight models.

A joint UK-US AI safety evaluation found Moonshot's Kimi K3 significantly lags behind leading US models in exploit development and simulated cyberattacks, scoring 32.2% vs 76.2% on ExploitBench and failing to achieve arbitrary code execution. It outperformed Chinese Zhipu GLM-5.2 but raised concerns about weak safety barriers and growing misuse risks from open-weight models.
Comments (0)
0/300
OR