ON
← Nazaj na pregled
Kineski AI agent presega antropico Claude Code v avtonomnih raziskavah
HK💻 Tehnologijapred 8 urami

Kineski AI agent presega antropico Claude Code v avtonomnih raziskavah

Kitajski AI sistem, imenovan Qiushi Engine, ki ga je razvila ekipa na univerzi Zhejiang, je v mednarodnem merilu za avtonomne znanstvene raziskave presegel Anthropic's Claude Code. Od torka naprej je Qiushi Engine na prvem mestu na lestvici ResearchClawBench, sledijo mu Open Science Desktop in Claude Code. Merilo ocenjuje sposobnost AI agentov, da samostojno izvajajo raziskave in primerjajo svoje ugotovitve z papirji, ki jih je napisal človek. Test so ustvarili raziskovalci v Šanghajskem laboratoriju za umetno inteligenco, da bi ugotovili, ali lahko sistemi AI resnično opravljajo zapletene naloge, za katere trdijo, da jih obvladujejo.

Kako je poročala vsaka stran

Isti dogodek, razvrščen po političnem nagibu medijev, ki so o njem poročali.

Kako je poročala vsaka stran

Podprite neodvisne novice z zavedanjem pristranskosti in odklenite družbeni utrip, glasovanje skupnosti in svoj prilagojen pregled Zame.

Postani podpornik

Poročanje po svetu

Isti dogodek, kot so ga poročali v drugih državah.

Poročanje po svetu

Podprite neodvisne novice z zavedanjem pristranskosti in odklenite družbeni utrip, glasovanje skupnosti in svoj prilagojen pregled Zame.

Postani podpornik

Preverjanje trditev

Ključne dejanske trditve in koliko virov jih potrjuje oz. zavrača.

Preverjanje trditev

Podprite neodvisne novice z zavedanjem pristranskosti in odklenite družbeni utrip, glasovanje skupnosti in svoj prilagojen pregled Zame.

Postani podpornik

1 poročil

South China Morning Post logoSouth China Morning PostNeodvisenSredinapred 8 urami
Kineski AI agent presega antropico Claude Code v avtonomnih raziskavah

Kitajski AI sistem, imenovan Qiushi Engine, ki ga je razvila ekipa na univerzi Zhejiang, je v mednarodnem merilu za avtonomne znanstvene raziskave presegel Anthropic's Claude Code. Od torka naprej je Qiushi Engine na prvem mestu na lestvici ResearchClawBench, sledijo mu Open Science Desktop in Claude Code. Merilo ocenjuje sposobnost AI agentov, da samostojno izvajajo raziskave in primerjajo svoje ugotovitve z papirji, ki jih je napisal človek. Test so ustvarili raziskovalci v Šanghajskem laboratoriju za umetno inteligenco, da bi ugotovili, ali lahko sistemi AI resnično opravljajo zapletene naloge, za katere trdijo, da jih obvladujejo.

Ocena pristranskosti (Sredina): Članek poroča o napredku v tehnologiji umetne inteligence, ne da bi zavzel stališče o političnih vprašanjih.

Ohranimo novice poštene.

ObjectiveNews financirajo bralci in je brez oglasov – pristranskost vam pokažemo, ne skrijemo. Podprite neodvisno novinarstvo za 5 €/mesec.

Postani podpornik

Povezane zgodbe