Adathalászat állhat az AI-cégek tudományos sikerei mögött
Egyre gyakoribb, hogy a mesterséges intelligencia cégek olyan eredményekről számolnak be, amelyek forradalmasíthatnak egy tudományágat. Alapos a gyanú azonban, hogy a gépek valójában kisajátítják hús-vér kutatók munkáját.
Komoly tudományos és etikai vitát robbantott ki röviddel a tőzsdére lépés előtt a világ egyik legnagyobb mesterséges intelligencia (AI) óriása. A tét nem kicsi: az Anthropic piaci értéke elérheti a kétezer milliárd dollárt, és a sikereit részben biológiai áttörésekre alapozná. A cég múlt szerdán bejelentette, hogy az év első felében létrehozott egy molekuláris biológiai laboratóriumot, amelyben a Claude nevű modelljének „ügynökei” súlyos biológiai problémákat elemeznek, tudományos hipotéziseket fogalmaznak meg, a kutatók pedig elvégzik a gépek által javasolt kísérleteket. Állítólag meg is született az első felfedezés.

A vállalat közleménye szerint 950 AI-ügynöke „átlapozott” egy hatalmas, több millió DNS-szekvenciát tartalmazó könyvtárat, amelyet a világ tudósai évtizedek alatt állítottak össze. Ilyen adatbázisokból próbálnak kiszúrni különleges mintázatokat – például egy olyan DNS-szakaszt, amely valamilyen érdekes enzimet kódol. Ha találnak ilyet, utána meg kell érteni, milyen célt szolgál az illető enzim, és hogyan lehetne módosítani.
Az AI-ügynökök nem egy új DNS-szekvenciát találtak, hanem egy már ismert enzim körül ismétlődő mintázatot vettek észre, amelyet a cég szerint korábban senki sem katalogizált. Az Anthropic ezt ahhoz hasonlította, ami végül a CRISPR genomszerkesztési technológia felfedezéséhez vezetett. A CRISPR-t a genomszerkesztés „svájci bicskájának” tartják szakmabeliek, a kifejlesztéséért 2020-ban megosztva kapta a kémiai Nobel-díjat a francia Emmanuelle Charpentier és az amerikai Jennifer A. Doudna.
Az Anthropic tehát implicite azt állítja, hogy modellje olyan felfedezést tett, amely alapjaiban változtathatja meg a tudományt és az orvoslást. Azonban Lucas Harrington genomkutató, aki doktoranduszként a Nobel-díjas Doudna laboratóriumában végzett kutatásokat, óvatosságra intett az X-en virálissá vált posztjában. Érvelése szerint a Claude által használt módszerrel évtizedek óta fedeznek fel új biológiai rendszereket. Vannak tanulmányok, amelyek egyetlen cikkben több tucat új rendszert azonosítanak és igazolnak kísérletileg. A különös génekre rábukkanni a könnyebb feladat – a nehezebb kideríteni, mit csinálnak valójában, azt pedig az Anthropic egyelőre nem tudja. A kutató szerint nem segít, ha egy ilyen korai eredményt nagy áttörésként mutatnak be. Jobbnak látná, ha az AI-cégek magasra tennék a lécet, hogy egy valódi felfedezést majd mindenki a súlyának megfelelően értékeljen.
A helyzetet tovább bonyolítja, hogy a Koppenhágai Egyetem egyik biológusa a hétvégén tudományos adathalászattal vádolta meg az Anthropic-ot. Mario Rodríguez Mestre a New York Times-nak azt nyilatkozta: ő és kollégái már négy éve tanulmányozzák ugyanezeket az enzimeket, illetve korábban felfedezték ugyanazt a mintázatot, amelyet az Anthropic most az AI nagy áttöréseként mutatott be.
Mestre és csapata az elmúlt három évben rendszeresen használta a Claude-ot rendszerezésre, vázlatkészítésre, kódírásra. A különböző feladatok során megosztották a rendszerrel a kutatásuk kulcsfontosságú részleteit, köztük a még kiadatlan felfedezéseiket is. Maga a kutatásvezető a készülő disszertációját is feltöltötte a rendszerbe. Joggal merülhet fel a kérdés, hogy az AI-modellt vajon nem a dániai kutatók munkája vezette-e a nagy dobra vert felfedezéshez.
Mestre attól tart, hogy a Claude-modellek újabb verzióit az ő kutatási adataival tréningezték. Az Anthropic ezt tagadja. A Times átnézte Mestre és csapata üzenetváltásait, adatait és dokumentumait, amelyek az elmúlt évek kutatásait és a Claude‑dal folytatott beszélgetéseit dokumentálják, és arra a következtetésre jutott, hogy a mesterséges intelligenciát nagyon aktívan bevonták a kutatásba.
Seth Shipman, a Kaliforniai Egyetem biomérnöke megerősítette: szakmai körökben évek óta ismertek Mestre kutatásai a szóban forgó enzimekről. Shipman szerint az Anthropic múlt heti bejelentése sok kutató fejébe szeget ütött. Rengeteg kollégától hallja a szakmában, hogy „vajon az én promptjaimon tanítják be (az AI-modelleket)? Nem tudom ezt kiverni a fejemből.”

Mario Rodríguez Mestre alig egy hónapja kezdte el lelkesen használni az Anthropic legújabb, kifejezetten kutatóknak szánt programját, de most radikális lépésre szánta el magát. Leállítja a Claude-ban futó összes projektjét, és elhagyja a platformot.
Hasonló vita alakult ki nemrégiben a ChatGPT-t kifejlesztő mesterségesintelligencia-startup, az OpenAI körül. A cég azt állította, hogy legújabb modellje megoldotta az úgynevezett Millenniumi-problémák egyikét – a folyadékok mozgását leíró Navier–Stokes‑rejtélyt –, amiért a Clay Matematikai Intézet egymillió dolláros díjat tűzött ki. Nem sokkal később Tristan Buckmaster, a New York-i Egyetem matematikusa jelezte: egy kollégájával az OpenAI modelljeit használták a probléma megoldásához, és felmerül a gyanú, hogy a cég az ő eredményeikből puskázott. Buckmaster fel is tette a kérdést a közösségi médiában: „Etikus-e az ügyfelek adatait felhasználni arra, hogy beelőzzük magukat az ügyfeleket?” Az OpenAI tagadta, hogy modelljeit a kutatók promptjain tanították volna be.
James O'Donnell, a MIT Technology Review AI-szakírója abban látja a probléma gyökerét, hogy az AI‑cégek nem egyszerűen eszközként mutatják be a rendszereiket – amelyet a kutatók használhatnak, mint egy mikroszkópot vagy szuperszámítógépet –, hanem azt állítják, hogy maga az AI tesz tudományos felfedezéseket. Az ENSZ közgyűlése előtt mondott múlt heti beszédében Dario Amodei, az Anthropic vezérigazgatója azt fejtegette, hogy az ilyen technológiák segítségével éveken belül látványos haladást érhetnek el az emberiséget évezredek óta sújtó betegségek leküzdésében. Sokak szerint ez ellentmond annak, ahogyan a tudomány valójában működik: az új tudás általában közös munkából, sokféle eszköz és módszer együttes használatából születik, nem pedig egyetlen rendszer „önálló” felismeréseiből – mutatott rá James O'Donnell.
CSAK SAJÁT


