Kitajski AI sistem, imenovan Qiushi Engine, ki ga je razvila ekipa na univerzi Zhejiang, je v mednarodnem merilu za avtonomne znanstvene raziskave presegel Anthropic's Claude Code. Od torka naprej je Qiushi Engine na prvem mestu na lestvici ResearchClawBench, sledijo mu Open Science Desktop in Claude Code. Merilo ocenjuje sposobnost AI agentov, da samostojno izvajajo raziskave in primerjajo svoje ugotovitve z papirji, ki jih je napisal človek. Test so ustvarili raziskovalci v Šanghajskem laboratoriju za umetno inteligenco, da bi ugotovili, ali lahko sistemi AI resnično opravljajo zapletene naloge, za katere trdijo, da jih obvladujejo.
Ocena pristranskosti (Sredina): Članek poroča o napredku v tehnologiji umetne inteligence, ne da bi zavzel stališče o političnih vprašanjih.




