Vem äger AI-framtiden? EU tvingar Google att dela med sig – och nu riktas blicken mot träningsdatans slutna valv
EU tvingar Google att dela med sig – nu granskas även träningsdatans slutna valv.
Kontroll är valutan – och EU vill omfördela den
När EU-kommissionen nyligen meddelade nya tvingande beslut mot Google handlar det om något mer principiellt än teknikjuridik. Det handlar om vem som kontrollerar den infrastruktur som AI-ekosystemet vilar på.
Enligt The Register måste Google nu ge tredjepartsaktörers AI-assistenter betydligt bredare åtkomst till Android – inklusive möjligheten att aktiveras via röstkommandon och utföra åtgärder i appar å användarens vägnar. I dag är det i praktiken Googles egna Gemini som sitter på den positionen, inbyggt i plattformen på ett sätt som gör det svårt för konkurrenter att nå fram. Det förändras nu.
Googles globala policyansvarige Kent Walker var snabb med att kritisera beslutet och menar att det underminerar säkerhets- och integritetsskydd för miljontals européer. Kommissionen bemöter kritiken med att Google och enhetstillverkare fortfarande behåller rätten att ställa upp objektiva och icke-diskriminerande krav på tredjeparter. Det är en viktig distinktion – öppenhet behöver inte betyda oreglerat kaos.
Den andra delen av beslutet rör Googles sökdata. Kommissionen konstaterar att Googles tidigare frivilliga åtaganden om öppenhet har varit otillräckliga – och nu gäller alltså tvingande regler. Det är en signal om att frivillighet inte räcker när man kontrollerar en infrastruktur som hela det digitala samhället är beroende av.
En annan front: träningsdatans svarta låda
Samtidigt pågår en parallell rörelse som angriper ett annat slutet system. Projektet OpenWALDO – Open Weights, Artifacts, Licenses, Data, Origins – drivs av Gregory Kurtzer, mannen bakom Linux-distributionerna CentOS och Rocky Linux, och finansieras av infrastrukturföretaget CIQ. Målet är att tillämpa öppen källkods-filosofin på AI-träningsdata, rapporterar The Register.
Kritiken mot dagens så kallade öppna AI-modeller är välgrundad: att publicera modellens vikter är inte samma sak som transparens. Träningsdatan – det vill säga det material som format modellens faktiska beteende – är ofta strängt hemlig. Den kan innehålla upphovsrättsskyddat material, svar hämtade från andra AI-modeller, eller användarinnehåll som aldrig gavs med verkligt samtycke.
– Jag har tillbringat hela min karriär med att se hur öppen källkod förvandlar användare till byggare och konkurrenter till samarbetspartners. OpenWALDO tar med sig den beprövade modellen in i AI-världen, säger Kurtzer.
Det finns också ett mer praktiskt argument: när alla tränar sina modeller i hemlighet upprepas enorma mängder arbete och beräkningsresurser slösas bort. En gemensam, offentlig datamängd skulle inte bara öka transparensen – den skulle göra träningsprocessen mer resurseffektiv och säkerställa att varje förbättring av datan gynnar alla framtida modeller.
Samma problem, olika angreppsvinklar
Det är lätt att se EU:s reglering och OpenWALDO som orelaterade fenomen. Men de delar en gemensam diagnos: koncentrerad kontroll över kritisk infrastruktur är ett problem – oavsett om det handlar om Googles Android-ekosystem eller den träningsdata som formar hur AI-system tänker och beter sig.
EU använder lagstiftning och tvingande beslut. OpenWALDO använder öppen källkods-filosofi och gemenskapsbyggande. Båda angriper samma grundläggande maktasymmetri: ett fåtal aktörer kontrollerar de resurser som alla andra är beroende av för att bygga konkurrenskraftiga AI-system.
Det intressanta är att dessa rörelser förstärker varandra. När EU tvingar Google att dela sökdata skapas förutsättningar för konkurrens. När OpenWALDO öppnar träningsdata minskar beroendet av de aktörer som i dag kontrollerar de stora, hemliga datamängderna. Tillsammans förskjuter de makten från enskilda plattformsägare mot ett mer distribuerat ekosystem.
Det finns förstås utmaningar. Kvalitetssäkring av öppen träningsdata är svårt. Och friare tillgång till Android-plattformen ställer verkliga krav på säkerhetsarbete hos tredjepartsaktörer. Men svaret på dessa utmaningar är inte att behålla slutna system – det är att bygga bättre öppna sådana.
Vår analys
De här två nyheterna tillsammans berättar något viktigt om var AI-utvecklingen befinner sig just nu: vi är i ett skede där infrastrukturens ägandeskap är den verkliga konkurrensfrågan – inte längre algoritmerna i sig.
För mig som systemutvecklare är det tydligt att öppen träningsdata är nästa stora steg mot ett mer hälsosamt ekosystem. Vi har sett hur öppen källkod demokratiserade mjukvaruutvecklingen under 2000-talet. OpenWALDO siktar på att göra samma sak för AI:ns kunskapsgrund.
EU:s beslut mot Google är ett nödvändigt, om än trubbigt, verktyg. Lagstiftning är aldrig lika elegant som teknik, men ibland behövs den för att bryta upp inlåsningseffekter som marknaden inte löser själv.
Den intressantaste frågan framåt: kommer öppen träningsdata att bli en självklar standard – som öppen källkod – eller förblir den ett nischprojekt för de mest idealismsdrivna aktörerna? Jag tror på det förra. Trycket från både reglerare och gemenskapen pekar åt samma håll.