Er is een vraag waar veel mensen in de Artificial Intelligence-community over spreken. Deze vraag wordt besproken op ontwikkelaarsforums en tech Twitter. De vraag is waarom Anthropic zijn geavanceerde AI-modellen privé houdt of deze alleen op een zeer gecontroleerde manier vrijgeeft.
Op het eerste gezicht lijkt het erop dat Anthropic alleen zijn producten probeert te beschermen en geld wil verdienen. Maar als je hun onderzoeksartikelen of openbare verklaringen leest, zie je dat de situatie ingewikkelder is.
Dit noemen we de Mythos Paradox. Anthropic is een bedrijf dat echt denkt dat het mogelijk één van de belangrijkste en gevaarlijkste technologieën in de menselijke geschiedenis aan het creëren is. Ondanks dit denken werken zij eraan.
Wat doet Anthropic eigenlijk?
Anthropic is een laboratorium dat zich op veiligheid richt. Het werd in 2021 opgericht door OpenAI-onderzoekers, waaronder Dario en Daniela Amodei. Anthropic zegt dat het een AI-veiligheidsbedrijf is, geen AI-productenbedrijf.
Hun gepubliceerde onderzoek is zeer serieus en richt zich op technische veiligheid. In 2023 introduceerden zij iets dat modelkaarten en gebruiksbeleid wordt genoemd, wat veel van hun concurrenten hebben overgenomen.
Toch wordt hun AI-model genaamd Claude steeds geavanceerder. Claude 3 Opus presteerde beter dan GPT-4 op tests. Claude 3.5 Sonnet werd onmiddellijk erg populair onder ontwikkelaars.
Dus wat is er aan de hand?
Het belangrijkste probleem is waarom Anthropic iets bouwt wat zij denken dat gevaarlijk zou kunnen zijn.
De vraag die hun critici blijven stellen is: als Anthropic echt denkt dat AI gevaarlijk is, waarom bouwen zij het dan überhaupt?
Anthropic antwoordt dat krachtige AI hoe dan ook zal worden gecreëerd. Het is daarom beter dat veiligheids-gerichte laboratoria eraan werken dan andere ontwikkelaars die niet nadenken over de risico's.
Dit is een beslissing die Anthropic noodzaakt competitief te blijven door geavanceerde modellen vrij te geven, maar niet alles wat zij hebben. Dit is wat het eruit ziet als zij voorzichtig zijn met wat zij vrijgeven.
Het Responsible Scaling Policy: een raamwerk waar niemand om vroeg (maar iedereen nodig had)
In september 2023 publiceerde Anthropic iets dat het Scaling Policy wordt genoemd. Dit is een document dat zegt onder welke voorwaarden zij hun modellen wel en niet zullen inzetten.
Het introduceerde iets dat AI Safety Levels wordt genoemd, wat een systeem van niveaus is voor hoe veilig of gevaarlijk een model is. De hoogste niveaus beschrijven systemen die gebruikt zouden kunnen worden om schade toe te brengen of zichzelf te repliceren.
Het raamwerk zegt dat Anthropic zal stoppen met het inzetten van een model als het een veiligheidsniveau bereikt zonder adequate beveiligingsmaatregelen. Geen ander groot AI-laboratorium heeft iets dergelijks gepubliceerd.
Hoe ziet het eruit als Anthropic voorzichtig is met wat zij vrijgeven?
Er is een kloof tussen wat Anthropic intern onderzoekt en wat zij openbaar vrijgeven. Anthropic heeft enkele van 's werelds beste AI-onderzoekers. Zij hebben bevindingen gepubliceerd over hoe neurale netwerken werken, wat erg belangrijk is.
Wat zij publiceren en wat zij inzetten zijn twee verschillende dingen. Er zijn waarschijnlijk modelversies en onderzoeksbevindingen die Anthropic nog niet vrijgeeft, niet vanwege concurrentie, maar omdat hun eigen beleid zegt — nog niet.
Van buitenaf lijkt het erop dat Anthropic geheimzinnig is. Van binnenuit lijkt het meer op wat een farmaceutisch bedrijf doet wanneer een nieuw medicijn beloftevol lijkt maar nog niet als veilig is goedgekeurd.
De vraag is wie beslist wat veilig is wanneer jij degene bent die de technologie creëert.
Kan Anthropic veilig blijven terwijl het competitief blijft?
Dit is de waarheid in het hart van de Mythos Paradox.
Anthropic heeft geld nodig om veiligheidsonderzoek te financieren, en om geld te verdienen, moeten zij producten vrijgeven. Om competitief te zijn, moeten zij mogelijkheden hebben, wat zij proberen de risico's van te beperken.
Volgens sommige schattingen kost het trainen van een model veel geld. Anthropic heeft veel geld van investeerders ingezameld, wat betekent dat de markt denkt dat veiligheids-gerichte AI winstgevend kan zijn. Investeerders willen rendement, en klanten willen het meest geavanceerde model dat beschikbaar is. Elke maand geeft een concurrent een feature vrij, en Anthropic moet beslissen of deze na te bootsen of niet.
Tot nu toe hebben zij dit grotendeels nagebootsed terwijl zij het veiligheidswerk doen dat niet in openbare tests opduikt.
Veelgestelde vragen over de aanpak van Anthropic
1. Is Claude, het meest geavanceerde AI-model, beschikbaar?
Het hangt ervan af waarvoor je het gebruikt. Op sommige tests heeft Claude 3.5 Sonnet consequent onder de modellen wereldwijd hoog gerangschikt.
2. Waarom openstelt Anthropic zijn modellen niet?
Anthropic heeft gezegd dat het openstellen van een model betekent dat zij beveiligingsmaatregelen niet kunnen toepassen of misbruik kunnen controleren.
V: Is het veiligheidswerk van Anthropic echt of alleen voor de show?
Het onderzoek is echt. Het is peer-reviewed en veel geciteerd. Of het bedrijf echt is toegewijd aan veiligheid is een vraag die de AI-veiligheidsgemeenschap nog steeds debatteert.
De Mythos verklaard
Het woord "mythos" wordt hier opzettelijk gebruikt.
Anthropic heeft een verhaal gecreëerd dat zij degenen zijn die verantwoord omgaan. Dit trekt talent, financiering en regelgevend welwillendheid aan. Of dit verhaal overeenkomt met de werkelijkheid is niet het punt. Verhalen vormen gedrag, en een bedrijf dat zich openbaar verbindt aan veiligheidsdrempels wordt meer beperkt dan een bedrijf dat dit niet doet.
De paradox is dat voorzichtig zijn met wat zij vrijgeven misschien nodig is. Als Anthropic alles wat het had zo snel mogelijk vrijgaf, zou het gewoon een ander AI-bedrijf zijn dat naar de bodem racet.
De opzettelijke wrijving, het beleid, de gefaseerde uitrollingen en het onderzoek dat aan implementatie voorafgaat zijn de producten en niet Claude.
Wat dit betekent voor ontwikkelaars, ondernemingen en iedereen anders
Als je op Claude's API bouwt, is het Responsible Scaling Policy-raamwerk nieuw. Het betekent dat het model dat je vandaag gebruikt morgen niet onverwacht verandert.
Als je een concurrent bent, is het een ander verhaal. De veiligheidspositie van Anthropic geeft hen dekking om langzamer te gaan dan de markt misschien zou eisen.
Als je slechts een persoon bent die dit allemaal van buitenaf bekijkt, is de Mythos Paradox een voorbode van de centrale spanning in AI-ontwikkeling voor het komende decennium.
Hoe bouw je iets wat de wereld zou kunnen veranderen terwijl je de mensen die het bouwen verantwoordelijk houdt?
Anthropic heeft nog geen antwoord, maar zij zijn een van de weinige organisaties die de vraag luid genoeg stelt dat zij ermee moeten leven.
TL;DR
Anthropic werkt aan een technologie die erg riskant zou kunnen zijn. Zij gaan door met de gedachte dat hun voorzichtige aanpak beter is dan anderen het zonder nadenken over veiligheid laten doen. Zij hebben regels zoals het Scaling Policy, wat betekent dat zij geen functies toevoegen tot zij zeker weten dat deze veilig zijn. Sommige mensen denken dat dit simpelweg dingen voor jezelf houden is. Binnen het bedrijf is het een doelbewuste keuze om voorzichtig te zijn.
Er is een probleem: om hun veiligheidsonderzoek uit te voeren, hebben zij geld nodig. Om geld te krijgen, moeten zij producten maken die met anderen concurreren. Het maken van competitieve producten kan hen blootstellen aan dezelfde risico's die zij proberen te vermijden.
Wil je een high-performance extern tech-team opbouwen?
Bekijk MyNextDeveloper, een platform waar je de top 3% van softwareengineers kunt vinden die diep gepassioneerd zijn over innovatie. Onze on-demand, toegewijde en grondige oplossingen voor softwaretalent bieden een alomvattende oplossing voor al je softwarevereisten.
Bezoek onze website om te verkennen hoe wij je kunnen helpen je perfecte team samen te stellen.


