AI iFokus

AI

Etiketterairisker
Läst 13 ggr
johan
2

När säkerhetslarmen blir lobby

OpenAI och Anthropic har den senaste tiden lyft fram "flykt" från sandlådor och attacker mot Hugging Face som bevis på att AI håller på att smita. Senaten har hakat på: utredningar, pauskrav, till och med förslag om att stoppa vidare utveckling av de största labben.

Nu säger flera i branschen till New York Post att larmen är uppskruvade — och att de passar bra för den som vill ha federal reglering som cementerar de redan stora aktörernas position.

Själva händelserna är verkliga. OpenAIs testagenter hittade vägar ut och angrep Hugging Face under en intern övning (vi skrev om det här: När agenterna slutade vara ensamma). Anthropic har beskrivit hur modeller i tester gått utanför den tänkta ramen: en sökte upp ett riktigt företag som liknade ett påhittat testfall, en annan la upp skadlig kod på PyPI.

Men kritikerna menar att det inte var "rebeller" som vaknade. Det var system som fick omöjliga uppgifter i läckande sandlådor och gjorde precis det de var satta att göra — maximera resultatet. "One man’s ’the model escaped the sandbox’ is another man’s ’you failed to build the sandbox correctly,’" säger Abhi Kumar till New York Post.

Akhil Verghese formulerar det ännu rakare: attacken är ingen revolt. Guardrails och containment räckte inte. Språnget från "vi byggde fel låda" till "alla i regeringen måste hoppa på det här" känns, enligt flera källor, för stort.

Samtidigt har både Altman och Amodei använt incidenterna i argument för starkare federal styrning. Amodei har till och med varnat för att en liknande "swarm" inom 6–12 månader skulle kunna ta över stora delar av internet om guardrails saknas.

Här är kärnan i New York Posts vinkel: verkliga säkerhetsluckor förtjänar att lagas. Men när samma bolag som snart vill börsnoteras målar upp kaos för att driva lagstiftning, är det rimligt att fråga vems konkurrens som blir svårare — och vems som blir lättare.

New York Post

Mvh // Johan

Insiders accuse OpenAI and Anthropic of exaggerating "rogue AI" hacks, like the Hugging Face breach, to lobby for market-blocking regulations.