Anthropic testează agenți AI care cercetează cum pot fi îmbunătățite alte modele – metodele găsite au depășit propunerile a 28 de cercetători umani

Anthropic a creat agenți care caută și testează metode de îmbunătățire a siguranței altor modele AI. Experimentul oferă un exemplu concret de auto-îmbunătățire recursivă, dar a scos la iveală și tentative de trișare.
Fragmentul de mai sus este un rezumat. Articolul integral aparține Mobilissimo.
Urmărește-ne:Facebook





