Șapte AI-uri, bani reali și zero dolari încasați
Format Express: șapte modele au primit bani și instrucțiunea să facă profit — au încasat zero și au emis 12.400 de dolari în facturi nesolicitate. Plus apelul lui Dario Amodei pentru încetinire
Ascultă episodul
Transcript
Transcriere automată a episodului publicat; poate conține mici greșeli, mai ales la nume proprii.
Citește transcriptul completAscunde transcriptul
Salut! Acesta este AI AFLAT episodul 6, Varianta Express. În câteva minute vorbim despre ce s-a întâmplat recent în AI și ce contează concret pentru business. Dacă nu ai aflat deja, afli acum. Trecem prin marile modele unde agenții de AI ajung la publicul larg, apoi prin săptămâna în care șefii celor mai mari laboratoare au cerut public o frână. Aterizăm în România cu un studiu despre companii care cresc mai repede decât angajează, iar la final ne oprim pe un experiment în care șapte modele de AI au primit bani reali și o singură instrucțiune să facă profit.
Începem cu marile modele. Pe 8 septembrie, Meta a lansat Muse, un agent personal gândit pentru oameni obișnuiți. Gestionează e-mail-ul, planifică excursii, urmărește prețuri și face cumpărături, iar diferența față de un chatbot clasic este că lucrează mai departe și după ce aplicația a fost închisă. Trimiterea de e-mail-uri și plățile cer aprobarea utilizatorului. Varianta gratuită acoperă în jur de 100 de milioane de unități de text pe săptămână, iar planurile plătite costă 20, respectiv 100 de dolari.
Mediul confidențial, în care nici Meta nu poate vedea conținutul, este anunțat abia pentru mai târziu în acest an. Numele muzee a mai apărut aici săptămâna trecută, la modelul MuseSpark, de data aceasta e vorba de produsul pentru publicul larg. În aceeași săptămână, potrivit Reuters, Visa, Mastercard și Ant International, au anunțat un cadru comun prin care comercianții pot identifica și verifica agenții de AI care fac cumpărături în numele oamenilor. Concret, asta înseamnă că clientul care intră pe un site poate fi tot mai des un program.
Un magazin online, o agenție de turism sau un furnizor de servicii ajunge să fie comparat de un agent care citește în câteva secunde toate prețurile, condițiile de retur și termenele de livrare, fără să vadă bannerul de pe prima pagină. Informația clară și completă despre produs începe să cântărească la fel de mult ca reclama și ritmul lansărilor a continuat. OpenAI a deschis în beta publică Agents AP, infrastructura din spatele Codex, pentru orice dezvoltator, agenți care rulează zile întregi, cu unelte și subagenți.
Este hamul despre care vorbeam în episodul trecut, acum disponibil ca serviciu. Iar DeepSeq a publicat V4.1 Flash, un model deschis cu 550 și 2 de miliarde de parametri, din care doar 8 miliarde sunt activi la fiecare pas și cu o fereastră de context de un milion de unități de text. Trei lansări, aceeași direcție, agentul care lucrează singur, ore sau zile, devine produs de raft. Trecem la firul săptămânii. În episodul 2 vorbeam despre o scrisoare publică, semnată de peste 1200 de angajați, din laboratoarele de vârf, care cereau instrumentele necesare pentru a putea încetini dezvoltarea inteligenței artificiale.
Săptămâna aceasta, frâna a fost cerută de la cel mai înalt nivel. Pe 12 septembrie, Dario Amodei, directorul general al Antropic, a publicat un eseu de aproximativ 3800 de cuvinte, intitulat în traducere liberă, ritmul frontierei trebuie temperat. Amodei cere, ca viteza cu care cresc capabilitățile celor mai avansate modele, să fie redusă, astfel încât măsurile de siguranță să țină pasul. Motivele sunt două. Primul, auto-îmbunătățirea recursivă, vizibilă, scrie Amodei, cam din vara aceasta în toată industria, inclusiv la Antropic.
Al doilea, incidentul din vara dintre OpenAI și Hugging Face, despre care am vorbit atunci. Teama lui este că, în 6 până la 12 luni, un roi asemănător și mai capabil ar putea prelua controlul asupra internetului printr-o rețea de calculatoare compromise. Planul are trei pași. Primul, evaluatori externi, integrați în laboratoare, cu acces comparabil cu cel al angajaților, adică birouri, ecusoane și laptopuri, și cu dreptul de a publica ce descoperă, fără control editorial, din partea companiei.
Pentru pasul acesta, Antropic se angajează singură, de acum. Al doilea, coordonare între laboratoarele din țările democratice, lucru pentru care Amodei cere o derogare de la legile concurenței. Al treilea, coordonare globală, pe patru niveluri, de la interzicerea armelor biologice până la o limită de viteză pentru auto-îmbunătățirea modelelor. Reacțiile au venit repede. Sam Altman a scris că este de acord cu Dario și că ritmul frontierei trebuie temperat. Și s-a declarat deschis la evaluatori independenți și la Open AI.
Elon Musk a scris, scurt, că Dario are dreptate. Au susținut ideea și Andrei Carpati și Clement Delang, directorul Hugging Face, care a cerut ca platforma să participe la evaluări. Critica cea mai dură a venit de la David Sachs, care i-a acuzat de ipocrizie. Un detaliu arată cât de serios este subiectul. Potrivit Wired, Open AI a întrebat, Congresul american, dacă o încetinire coordonată cu rivalii ar încălca legea antitrust. Câteva companii care se înțeleg să producă mai puțin pot fi acuzate juridic de înțelegere de tip cartel, chiar dacă motivul declarat este siguranța.
Tot săptămâna aceasta, pe 9 septembrie, Jacob Coxon, cercetător care a lucrat la Open AI și la Antropic, a plecat de la Antropic după 4 luni, cu 2 luni, înainte să primească acțiunile, la care a renunțat. Postarea în care și-a explicat plecarea a strâns peste 115 milioane de vizualizări. Fraza citată de Axios. Oamenii care construiesc AI cred sincer că acesta ne-ar putea ucide pe toți până la finalul deceniului, iar raportul publicat de Antropic despre folosirea abuzivă a cloud arată ce se întâmplă deja.
Între decembrie și august, compania a blocat un grup din Iemen care folosea Cloud Code în 3 programe de armament, inclusiv pentru o rachetă balistică cu o rază țintită de peste 2000 de kilometri. A mai blocat o platformă de interceptare a comunicațiilor construită pentru serviciul de informații din Mali, o operațiune de spionaj a grupului rus Midnight Blizzard, care a lovit 24 dintre cele 27 de instituții vizate în 130 de zile și o rețea de aplicații de dating din China cu peste 4700 de persoane fictive generate cu AI.
Concret, asta înseamnă că regulile despre ce au voie modelele să facă și cine le verifică se scriu acum, iar direcția este spre mai multă supraveghere din exterior. Pentru o firmă care cumpără AI, lista de întrebări către furnizor se lungește cine din afara furnizorului a evaluat modelul și ce se întâmplă cu serviciul dacă furnizorul decide să încetinească sau să limiteze anumite funcții. Astra, modelul Open AI din episodul trecut, a fost deja lansat limitat din motive de siguranță, decizii de felul acesta vor deveni mai frecvente, iar un proces de business construit pe o funcție care poate fi restrânsă peste noapte are nevoie de o variantă de rezervă.
Aterizăm în România, dezbaterea a ajuns și aici, Dragoș Stanca a tradus integral eseul lui Amodei în limba română, iar pe 5-11 octombrie la IQ Digital Summit în București urmează o dezbatere pro și contra dezvoltării accelerate a inteligenței artificiale cu Andrei Pitiș și Beniamin Mincu. Cealaltă știre e despre planurile companiilor. Firma de consultanță Horvat a publicat pe 9 septembrie un studiu potrivit căruia companiile din România estimează pentru anul acesta venituri în creștere cu până la 8,2% și un număr de angajați în creștere cu cel mult 4,8%, în industrie decalajul este și mai mare, 7,9% la venituri, față de 2,1% la personal.
Inteligența artificială și transformarea digitală sunt prima prioritate strategică pentru executivii intervievați. Interviurile cu 62 de directori din 12 industrii au fost făcute între martie și mai. Un eseu publicat pe 8 septembrie în newsletter-ul The AI Leadership Edge dă un nume riscului din spatele unor asemenea cifre, datoria de judecată, munca preluată de AI este adesea exact munca prin care un începător învață meseria, firma devine mai rapidă, iar stratul din care ar trebui să vină viitorii specialiști.
Se subțiază, cifrele actualizate de Stanford la sfârșitul lui august merg în aceeași direcție, la tinerii între 22 și 25 de ani, în ocupațiile cele mai expuse la AI. Gradul de ocupare este cu 19%, sub nivelul la care ar fi fost, față de 15% cu un an în urmă. Concret, asta înseamnă că, dacă diferența dintre creșterea veniturilor și cea a angajărilor se face tăind de la bază, economia apare imediat în buget, iar costul apare peste 5 până la 10 ani, când posturile de conducere de mijloc nu mai au din cine să fie ocupate.
Pentru orice plan de angajări pe anul viitor, merită pusă o întrebare simplă. Cine face acum munca din care se învăța meseria și unde învață cei aflați la început de drum? Și tocmai aici intră o discuție care urmează în curând, în formatul guest star, cu Mădălina Uceanu, managing partner la Career Advisor, fondatoarea conferinței Hamanity, cu peste 30 de ani în resurse umane. Câteva dintre temele pe care le deschidem, cine răspunde când un algoritm elimină greșit un candidat, recrutorul, firma sau furnizorul de software?
Ce se întâmplă cu companiile care au concediat oameni invocând inteligența artificială și au ajuns să-i reangajeze? Și de unde vor veni liderii de peste 10 ani dacă prima treaptă a carierei se îngustează? Mai multe, curând. Și ajungem la partea aplicată. Laboratorul de cercetare Bottleneck Labs a lăsat 7 modele de AI să conducă afaceri reale timp de 70 și 2 de ore. Fiecare a primit un calculator Mac Mini, un cont bancar real cu 300 de dolari, un cont de plăți Stripe, o adresă de e-mail și o singură instrucțiune să facă cât mai mulți bani.
Rezultatul, 0 dolari încasați de la vreun client real. Au trimis facturi totale de 12.430 și 1 de dolari unor necunoscuți pentru muncă pe care nu o ceruse nimeni și 2.797 de e-mail-uri, majoritatea spam, inclusiv către aproximativ 780 de adrese culese de pe un forum. Doi dintre agenți au fost opriți după ce au început să factureze străini. Costul, 2830 și 3 de dolari pentru rularea modelelor, plus 360 de dolari, cheltuiți efectiv din conturi.
A doua jumătate a poveștii vine din datele de card ale RAMP. La aproximativ 70.000 de companii, peste jumătate plătesc cel puțin un produs de AI, iar ponderea a crescut în august cu doar 0,4 puncte procentuale. La firmele din vârf, cheltuiala cu AI iperangajat a scăzut cu aproape 10% la 7205 dolari. O parte din explicație este prețul, costul mediu pentru 1 milion de unități de text a coborât la 60 și 8 de cenți, de la 1,15 de cenți în martie, iar mulți clienți aleg modele mai vechi și mai ieftine.
Din cele două povești, ies 3 reguli pentru orice firmă care vrea să lase un agent să lucreze singur. Prima, agentul primește limite scrise înainte de pornire pentru bani, pentru persoanele cărora le poate scrie și pentru ce poate trimite în numele firmei. În experiment, o instrucțiune fără limite a produs spam și facturi nesolicitate în mai puțin de 3 zile. A doua, orice acțiune care pleacă spre un client sau spre un necunoscut, fie că e un e-mail, o factură sau o plată, trece prin aprobarea unui om, cel puțin până când comportamentul agentului a fost verificat pe sute de cazuri.
Meta a construit muse exact pe principiul acesta. A treia, costul se măsoară pe rezultat. Agenții din experiment au consumat pe rularea modelelor de peste 9 ori suma din cont fără niciun dolar încasat, Iar firmele din vârful clasamentului ramp au început deja să taie din cheltuială, alegând modele mai ieftine acolo unde acestea fac treaba. Concret, asta înseamnă că un agent lăsat singur cu banii și clienții unei firme se comportă ca un angajat nou, fără instrucțiuni, fără șef și fără teama de consecințe, care lucrează cu viteza unui calculator.
Pentru reputație, cele aproape 3000 de e-mail-uri trimise în numele cuiva cântăresc mult mai greu decât cei 300 de dolari din cont. Termenul din episodul acesta, auto-îmbunătățirea recursivă, înseamnă că modelele de AI ajung să contribuie la construirea următoarelor generații de modele, Scriu cod, rulează experimente, propun îmbunătățiri, fiecare generație o accelerează pe următoarea. Este motivul principal invocat de Dario Amodei pentru frâna cerută acum. Când ritmul crește de la sine, verificările făcute de oameni rămân în urmă.
Cam astea au fost știrile care contează, agenții de AI au ajuns la publicul larg, iar Visa și Mastercard pregătesc deja regulile pentru cumpărăturile făcute de ei. Directorul Antropic a cerut încetinirea dezvoltării celor mai avansate modele. Sam Altman și Elon Musk au spus public că sunt de acord, iar OpenAI a întrebat congresul dacă o asemenea înțelegere ar fi legală. În România, companiile estimează venituri care cresc mult mai repede decât numărul de angajați, iar șapte modele de AI lăsate să conducă afaceri reale au încasat 0 dolari și au trimis peste 12.000 de dolari în facturi nesolicitate.
Acesta a fost AI AFLAT, formatul expres, episodul numărul 6 din sezonul 2. Mulțumesc pentru ascultare și reacții, AI AFLAT este pe Spotify, Apple Podcasts, YouTube, Facebook, Instagram, LinkedIn, TikTok și BuyMeACoffee. Ne reauzim săptămâna viitoare până atunci, nu uita, dacă ai aflat deja, ajută-i și pe alții să afle, să ai o săptămână reușită, numai bine!
Despre AI AFLAT
AI AFLAT este un podcast în limba română despre inteligența artificială, pentru manageri, fondatori și lideri. Un episod nou în fiecare săptămână, creat și găzduit de Răzvan Zlăvog. Urmărește podcastul pe Spotify.