ON
← Natrag na feed
Kineski AI agent nadmašuje antropicki Claude Code u autonomnom istraživanju
HK💻 Tehnologijaprije 8 h

Kineski AI agent nadmašuje antropicki Claude Code u autonomnom istraživanju

Kineski AI sustav pod nazivom Qiushi Engine, koji je razvio tim na Sveučilištu Zhejiang, nadmašio je Anthropic's Claude Code u međunarodnom mjerilu za autonomna znanstvena istraživanja. Od utorka, Qiushi Engine je prvi na ResearchClawBench listi, a zatim Open Science Desktop i Claude Code. Mjerilo ocjenjuje sposobnost AI agenata da samostalno provode istraživanja i uspoređuju svoje nalaze s radovima koje su napisali ljudi. Test su stvorili istraživači iz laboratorije za umjetnu inteligenciju u Šangaju kako bi utvrdili mogu li AI sustavi zaista obavljati složene zadatke za koje tvrde da ih mogu nositi.

Kako je izvijestila svaka strana

Isti događaj, grupiran prema političkom nagibu medija koji su o njemu izvještavali.

Kako je izvijestila svaka strana

Podržite neovisne vijesti svjesne pristranosti i otključajte društveni puls, glasovanje zajednice i svoj personalizirani feed Za tebe.

Postani podupiratelj

Izvještavanje u svijetu

Isti događaj kako se o njemu izvještavalo u drugim zemljama.

Izvještavanje u svijetu

Podržite neovisne vijesti svjesne pristranosti i otključajte društveni puls, glasovanje zajednice i svoj personalizirani feed Za tebe.

Postani podupiratelj

Provjera tvrdnji

Ključne činjenične tvrdnje i koliko ih izvora potvrđuje odn. osporava.

Provjera tvrdnji

Podržite neovisne vijesti svjesne pristranosti i otključajte društveni puls, glasovanje zajednice i svoj personalizirani feed Za tebe.

Postani podupiratelj

1 izvještaja

South China Morning Post logoSouth China Morning PostNeovisanSredinaprije 8 h
Kineski AI agent nadmašuje antropicki Claude Code u autonomnom istraživanju

Kineski AI sustav pod nazivom Qiushi Engine, koji je razvio tim na Sveučilištu Zhejiang, nadmašio je Anthropic's Claude Code u međunarodnom mjerilu za autonomna znanstvena istraživanja. Od utorka, Qiushi Engine je prvi na ResearchClawBench listi, a zatim Open Science Desktop i Claude Code. Mjerilo ocjenjuje sposobnost AI agenata da samostalno provode istraživanja i uspoređuju svoje nalaze s radovima koje su napisali ljudi. Test su stvorili istraživači iz laboratorije za umjetnu inteligenciju u Šangaju kako bi utvrdili mogu li AI sustavi zaista obavljati složene zadatke za koje tvrde da ih mogu nositi.

Procjena pristranosti (Sredina): Članak izvješćuje o napretku u tehnologiji umjetne inteligencije bez zauzimanja stava o političkim pitanjima.

Neka vijesti ostanu poštene.

ObjectiveNews financiraju čitatelji i bez oglasa je – pristranost vam pokazujemo, ne skrivamo. Podržite neovisno novinarstvo za 5 €/mjesec.

Postani podupiratelj

Povezane priče