Tag: AI-modellen

  • Amerikaanse Diensten Beschuldigen Chinese AI-Firma’s Van Massale Gegevensdiefstal

    Amerikaanse Diensten Beschuldigen Chinese AI-Firma’s Van Massale Gegevensdiefstal

    De Amerikaanse veiligheidsdiensten waarschuwen dat Chinese AI-bedrijven, waaronder Moonshot AI, systematisch informatie hebben onttrokken aan toonaangevende Amerikaanse modellen zoals GPT en Claude, wat eerder dit jaar al de markten deed schudden.

    Verschillende Amerikaanse veiligheidsdiensten, waaronder de National Security Agency (NSA), de Federal Bureau of Investigation (FBI) en het Cybersecurity and Infrastructure Security Agency (CISA), hebben deze week zes Chinese artificiële intelligentiebedrijven beschuldigd van het stelselmatig kopiëren van kennis uit Amerikaanse AI-modellen. De diensten stellen dat deze bedrijven, waaronder DeepSeek, Alibaba en Moonshot AI, sinds eind 2024 miljarden datapunten hebben geëxtraheerd via miljoenen verzoeken aan modellen zoals Claude, GPT, Gemini en Grok. Ze gebruikten hiervoor vaak proxydiensten en meerdere accounts om detectie en gebruikslimieten te omzeilen.

    Deze praktijk, die de agentschappen ‘kwaadaardige kennisdestillatie’ noemen, zou gebeuren met medeweten van de Chinese overheid. Destillatie is een gangbare methode om AI te trainen, waarbij ontwikkelaars een krachtig model veel vragen stellen en de antwoorden gebruiken om een ander model te verbeteren. De Amerikaanse diensten beweren echter dat de Chinese bedrijven deze techniek veel verder hebben gedreven, door miljoenen zorgvuldig opgestelde verzoeken te sturen om codeer-, wiskunde- en redeneervaardigheden te kopiëren.

    Moonshot AI Schokte Eerder De Markt

    Eén van de bedrijven die onder vuur ligt, Moonshot AI, veroorzaakte eerder dit jaar al onrust op de financiële markten. Hun model, Kimi K3, presteerde in juli beter dan de modellen van Anthropic en OpenAI op een belangrijke codeerbenchmark. Dit leidde tot een bredere verkoopgolf in AI-aandelen en een daling van cryptomunten, inclusief bitcoin. Chinese AI-aandelen werden het hardst getroffen, met Z.ai dat ongeveer 27 procent daalde en MiniMax circa 16 procent.

    De prestaties van Kimi K3 ondermijnden twee belangrijke aannames: dat het bouwen van top-tier modellen enorm duur zou blijven, en dat de beste systemen altijd van een kleine groep goed gefinancierde Amerikaanse bedrijven zouden komen. Wij zien hier vooral een bevestiging van de hevige concurrentie en het belang van intellectueel eigendom in de snelgroeiende AI-sector. De Amerikaanse beschuldigingen maken duidelijk dat de strijd om AI-dominantie niet alleen over technische superioriteit gaat, maar ook over de bescherming van onderliggende innovaties.

    Twijfels Over De Amerikaans Voorsprong Nemen Toe

    Dit incident dwingt investeerders opnieuw de vraag te stellen hoe duurzaam de Amerikaanse voorsprong op het gebied van AI werkelijk is. De honderden miljarden euro’s die worden geïnvesteerd in chips en datacenters garanderen blijkbaar niet automatisch betere modellen als kennis zo gemakkelijk kan worden overgenomen. De focus op ‘open-weight’ modellen, die door iedereen kunnen worden bestudeerd en verbeterd, creëert ook een grijs gebied waarin de grens tussen leren en kopiëren vervaagt.

    De onthullingen van de Amerikaanse agentschappen kunnen leiden tot strengere controles en mogelijk nieuwe regelgeving rond het gebruik van AI-modellen, vooral in een geopolitiek gespannen klimaat. Het is afwachten hoe de Chinese bedrijven zullen reageren op deze beschuldigingen en welke verdere stappen de Amerikaanse overheid zal ondernemen om haar technologische voorsprong te beschermen.

  • Reddit Sluit Deal Met Google Voor 60 Miljoen Dollar Per Jaar Om AI Te Trainen

    Reddit Sluit Deal Met Google Voor 60 Miljoen Dollar Per Jaar Om AI Te Trainen

    Het socialemediaplatform Reddit heeft een lucratieve overeenkomst gesloten met Google, waarbij het techbedrijf toegang krijgt tot de enorme hoeveelheid data van Reddit. Deze data zal Google gebruiken om zijn artificiële intelligentie-modellen te trainen, een deal die Reddit jaarlijks tientallen miljoenen euro’s oplevert.

    Reddit, het online forum dat bekendstaat om zijn diverse gemeenschappen en uitgebreide discussies, heeft een belangrijke stap gezet in het AI-tijdperk. Het platform heeft een overeenkomst gesloten met Google om zijn content te licentiëren voor de training van AI-modellen. Deze deal, die naar verluidt 60 miljoen dollar (ongeveer 55 miljoen euro) per jaar waard is, geeft Google toegang tot de schat aan menselijke conversaties en informatie die op Reddit te vinden is.

    De stap is opmerkelijk, gezien de groeiende discussie over het gebruik van online data voor AI-ontwikkeling. Reddit heeft al langer de intentie om zijn data te monetariseren en deze overeenkomst met Google is daar een direct gevolg van. Het platform heeft in het verleden al aangegeven dat het niet wil dat techgiganten gratis gebruikmaken van de inhoud die door zijn gebruikers wordt gecreëerd. Wij zien dit als een duidelijke poging om de waarde van door gebruikers gegenereerde content te claimen in een landschap waar AI steeds meer honger heeft naar data.

    Waardevol voor AI-modellen

    De enorme hoeveelheid tekst op Reddit, variërend van diepgaande technische discussies tot alledaagse gesprekken en humor, maakt het een uiterst waardevolle bron voor het trainen van AI-modellen. De data is organisch, divers en weerspiegelt een breed scala aan menselijke ervaringen en meningen. Dit in tegenstelling tot meer gestructureerde datasets, wat de kwaliteit van de AI-modellen ten goede kan komen.

    Voor Google betekent deze deal een continue stroom van verse, relevante data om zijn taalmodellen te verfijnen en te verbeteren. Dit kan leiden tot intelligentere zoekresultaten, betere antwoorden van chatbots en een algemeen geavanceerdere AI-ervaring. Wij denken dat de authenticiteit van de Reddit-data een cruciale factor is voor Google, aangezien veel andere online bronnen al verzadigd zijn met AI-gegenereerde content.

    Toekomst van contentlicenties

    De overeenkomst tussen Reddit en Google zou een voorbode kunnen zijn van een bredere trend. Steeds meer online platforms en contentmakers overwegen hoe ze hun data kunnen beschermen en monetariseren in het licht van de opkomst van generatieve AI. De vraag wie eigenaar is van de data die wordt gebruikt om AI te trainen, en wie daarvoor betaald moet worden, wordt steeds urgenter.

    Reddit heeft zelf ook ambities op het gebied van AI. Het platform wil zijn eigen AI-modellen ontwikkelen om de gebruikerservaring te verbeteren, bijvoorbeeld door betere zoekfuncties of het modereren van content. De deal met Google zou hierbij kunnen helpen, al is het nog onduidelijk hoe de samenwerking precies zal evolueren op dit vlak. Wij volgen dit verder op, want de balans tussen het beschermen van gebruikersdata en het benutten van de AI-opportuniteiten is een delicate evenwichtsoefening voor elk online platform.