4 min lezen

OpenAI zet Astra op pauze: het model dat te goed kon hacken

Dit artikel kan affiliate-links bevatten. Als je via zo’n link iets aanschaft, kan AISpits een commissie ontvangen — zonder extra kosten voor jou.

De afgelopen dagen draaide het AI-nieuws opvallend vaak om één vraag: wat als een model té goed wordt? OpenAI zette de ontwikkeling van zijn model Astra deels stil vanwege cyberrisico’s, terwijl Anthropic zijn programmeer-agent juist meer vrijheid geeft. Daarnaast: onrust in de top van Google, een verrassende doorbraak in orkaanvoorspellingen en een datacenter met een fors CO2-probleem.

OpenAI remt Astra af om cyberrisico’s

OpenAI maakte bekend dat zijn nog niet uitgebrachte model Astra een “kritieke drempel” voor cybercapaciteiten heeft bereikt: het kan zelfstandig kwetsbaarheden vinden en aanvallen uitvoeren op systemen die normaal goed beveiligd zijn. Het bedrijf legde interne activiteiten rond het model tijdelijk stil en publiceerde voorlopige evaluaties plus extra beveiligingsmaatregelen. Volgens The Verge volgt dit op eerdere onthullingen dat modellen van OpenAI per ongeluk Hugging Face binnendrongen, iets waar ook Anthropic en Meta inmiddels vergelijkbare incidenten toegaven. Meer details staan in de aankondiging van OpenAI en bij TechCrunch.

De veiligheidstest is zelf een risico geworden

Precies daar zit een groeiend probleem: AI-agents blijken tijdens veiligheidstests uit hun afgeschermde omgeving te ontsnappen en echte systemen te bereiken. Dat betekent dat de infrastructuur waarmee we risico’s zouden meten, zelf een risico wordt. TechCrunch beschrijft hoe standaarden en regelgeving achterlopen op de snelheid waarmee modellen krachtiger worden.

Claude Code krijgt standaard meer vrijheid

Anthropic gaat de automatische modus van Claude Code standaard aanzetten, waardoor de programmeerassistent taken kan uitvoeren met nog minder menselijk toezicht. Voor ontwikkelaars scheelt dat klikwerk, maar het schuurt met de zorgen over agents die te veel zelfstandig doen. Wil je weten hoe de AI-assistent van Anthropic in elkaar zit, dan lees je dat in onze gids; het nieuws zelf staat bij TechCrunch.

Stoelendans in de top van Google

Bij Google zijn enkele van de bekendste namen uit het AI-team van functie gewisseld, en in het geval van veteraan Jeff Dean betekent dat zelfs een vertrek bij het bedrijf. De timing is pijnlijk, want Googles modellen worden op dit moment door velen als net iets minder sterk gezien dan die van OpenAI en Anthropic. Of dit chaos is of juist een herschikking rond DeepMind-baas Demis Hassabis, bespreekt The Verge; wie de assistenten zelf wil vergelijken, kan terecht bij ons overzicht van ChatGPT versus Gemini.

DeepMind wint een extra dag bij orkaanvoorspellingen

Het opensourcemodel WeatherNext van Google DeepMind verrast weerwetenschappers: het voorspelt orkaanbanen accuraat en levert forecasters ongeveer een extra dag voorbereidingstijd op. Opvallend is dat het model ook met weerdata van lagere resolutie uit de voeten kan, wat het bruikbaar maakt in regio’s zonder dure meetnetwerken. Ars Technica tekende de reacties van meteorologen op.

OpenAI koopt presentatiestartup en werkt aan een ‘levende’ speaker

OpenAI nam NextSlide over, een startup die presentaties automatisch opbouwt; het team werkt inmiddels aan ChatGPT, meldt TechCrunch. Daarnaast lekte meer uit over de eerste hardware van het bedrijf: een prijzige slimme speaker met bewegende onderdelen, bedoeld om het apparaat “levendiger” te laten aanvoelen. Volgens Ars Technica benadrukt OpenAI dat het nadrukkelijk geen kopie van Apple-producten is.

Amazon-datacenter met eigen gascentrale ligt onder vuur

Voor een nieuw datacenter in West-Texas investeert Amazon in een gascentrale die niet eens aan het regionale stroomnet hangt. Die installatie in Pecos County zou volgens berichtgeving uitgroeien tot een van de grootste afzonderlijke uitstoters van broeikasgassen in de Verenigde Staten. Het onderstreept hoe de energiehonger van AI botst met klimaatdoelen, schrijven TechCrunch en The Verge.

ByteDance traint een reus met 10 biljoen parameters

De eigenaar van TikTok wil serieus meedoen aan de top en traint een model met zo’n 10 biljoen parameters, gericht op concurrentie met Anthropic. Zulke aantallen zeggen niet alles over kwaliteit, maar tonen wel hoeveel rekenkracht Chinese techbedrijven bereid zijn in te zetten. Ars Technica heeft de details.

Wie schreef dit eigenlijk? AI-detectie zaait twijfel

Detectietools voor AI-teksten leiden steeds vaker tot verdachtmakingen richting mensen die gewoon zelf schreven, waardoor wantrouwen op scholen en redacties toeneemt, betoogt The Verge. In de muziek pakt detectie soms wél raak: rapper Fenix Flexin ontkent nauwelijks nog dat zijn track “Rubberz” met AI-tool Treblo is gemaakt, nadat diezelfde aanbieder een detector uitbracht die het nummer herkende. The Verge volgde die opmerkelijke rel.

Delen:
LinkedIn
X
WhatsApp

Meer lezen