METABYTE
Inapoi la articole

Claude învață „de ce”: Anthropic antrenează AI să raționeze, nu doar să ghicească

Anthropic l-a învățat pe Claude să își explice deciziile – acum AI nu doar răspunde, ci și povestește cum a ajuns la concluzie.

8 mai 20262 min de citit
Claude învață „de ce”: Anthropic antrenează AI să raționeze, nu doar să ghicească

Știți senzația aia când o rețea neurală vă dă un răspuns, iar voi vă uitați la el ca la o cutie neagră și vă întrebați „bine, dar de ce exact așa?” Anthropic se pare că a rezolvat problema – și a făcut-o cu eleganță.

Cercetătorii au antrenat modelul Claude nu doar să prezică următorul token, ci să construiască explicații interne ale raționamentului său. Acum AI poate arăta un lanț de „de ce” – de la întrebare la răspuns. E ca și cum colegul vostru nu doar că ar livra taskul, dar ar lăsa și comentarii în cod, și încă unele de care nu ți-e rușine să le arăți team-lead-ului.

Din punct de vedere tehnic, abordarea amintește de reinforcement learning cu feedback uman (RLHF), dar cu accent pe interpretabilitate. Modelul învață să genereze „gânduri cu voce tare” – o succesiune de pași care au dus la concluzia finală. Și, amuzant, aceste explicații nu sunt doar post-factum – ele influențează însuși procesul de inferență, îmbunătățind acuratețea. Adică AI nu inventează lucruri a posteriori, ca unii manageri la daily standup.

De ce e util pentru developeri? În primul rând, acum poți depana logica unui agent AI fără să te uiți în loguri 10 ore. În al doilea rând, e un pas spre AI de încredere – când modelul își poate justifica alegerea, e mai ușor de integrat în sisteme critice (medicină, finanțe, code review). Și, da, mai puține șanse ca AI să spună „2+2=5, pentru că așa am decis eu”.

Bineînțeles, până la transparența totală mai e cale lungă – explicațiile pot fi incomplete sau conține „zgomot”. Dar simplul fapt că AI învață să reflecteze amintește de un episod din „Westworld” – doar că fără răscoala roboților. Deocamdată.

Comentariul studioului METABYTE: Și nouă ne place când codul nu doar funcționează, ci e și documentat. Dacă proiectul vostru are nevoie de o logică clară – fie că e AI sau un simplu backend – vă ajutăm să puneți ordine. Și, bineînțeles, să explicăm de ce am ales exact acest stack.

URMATORUL PAS

Ti-a placut abordarea?

Aplicam aceleasi principii in proiectele clientilor: AI, automatizari, produse care nu se sting dupa lansare.