Anthropic investeert 100 miljoen dollar in de opleiding van 10.000 Claude-ingenieurs
Anthropic heeft de Claude Frontier Academy geopend en aangekondigd dat het 100 miljoen dollar zal investeren om 10.000 Frontier Deployed Engineers op te leiden volgens het gepubliceerde schema. De boodschap is direct. Modellen vormen niet het knelpunt. Het tekort zit hem in de mensen die Claude binnen een werkend bedrijf kunnen implementeren.
De eerste groepen deelnemers zijn al van start gegaan in San Francisco, New York en Londen, afkomstig van bedrijven als Accenture, Bain, Capgemini, Commonwealth Bank of Australia, Deloitte, McKinsey, Morgan Stanley en Novo Nordisk. Je hoeft je niet aan te melden. Je bedrijf nomineert je, en het is de bedoeling dat je met een project met de naam Claude aan de start verschijnt.
De opzet lijkt meer op een medische specialisatie dan op een opleiding tot certificeringsinstituut. Een meerdaagse oefening op locatie, een beoordeeld praktijkexamen, een Claude Resident Engineer-badge, en vervolgens 12 weken leidinggeven aan een daadwerkelijke missie onder toezicht van Anthropic-ingenieurs. Als je slaagt, krijg je de Frontier Deployed Engineer-badge. De eerste daarvan, zo wordt gezegd, krijg je na afloop van de specialisatie.
Steve Corfield, die verantwoordelijk is voor partnerschappen, stelt dat een klein team van hooggekwalificeerde bureaus "een heel bedrijf kan transformeren". Misschien. Anthropic claimt al meer dan 175.000 Claude-certificeringen te hebben behaald bij 46.000 bureaus, dus het tekort aan talent is blijkbaar nog steeds groot genoeg om een ander, veel strenger programma te rechtvaardigen. Een programma op basis van nominatie is ofwel kwaliteitscontrole, ofwel een zeer chique wachtlijst.
Apple maakt het voor een AI-agent veel moeilijker om toegang te krijgen tot de volledige schijf
Apple heeft ontwikkelaars laten weten dat het extra controles toevoegt, zodat volledige schijftoegang in macOS alleen nog kan worden verleend met "zeer expliciete actie van de gebruiker". Deze machtiging was oorspronkelijk bedoeld om back-up-apps toegang te geven tot de hele schijf. Volgens Apple hebben agents het risico nu echter vergroot.
De eigen verklaring van het bedrijf is behoorlijk confronterend. Die schakelaar kan bestanden, e-mail, berichten en browsegeschiedenis blootleggen, en voor een communicatie-app kan het ook de personen aan de andere kant van die berichten onthullen. "Naarmate AI-systemen steeds capabeler en autonomer worden, zullen de risico's die aan dit niveau van toegang verbonden zijn aanzienlijk toenemen."
De timing is niet subtiel. Dit nieuws kwam enkele dagen nadat Jason Aten van Inc. zei dat Meta's Muse op zijn Mac wist wat er in zijn privéberichten stond. Meta betwistte dat. Volgens Meta is toegang tot Berichten alleen mogelijk met volledige schijftoegang én een aparte Muse-connector, waarvoor je je beide moet aanmelden. Apple noemde Muse niet bij naam en liet TechCrunch niet weten wanneer de nieuwe functies beschikbaar komen.
Een duidelijke waarschuwing, geen datum, en een discussie over de vraag of "de gebruiker heeft op 'Toestaan' geklikt" telt als geïnformeerde toestemming zodra het klikken een agent is geworden. Ik zou dit nog geen oplossing noemen. Het is eerder een erkenning van Apple dat het oude dialoogvenster niet voldoende is.
Meta stelt een open-sourcepakket beschikbaar waarmee je je eigen Muse-gadget kunt bouwen
Meta heeft Muse Gadgets uitgebracht, een open-source project voor hardware die communiceert met hun Muse-agent. Je krijgt firmware en een Linux SDK. Voorgestelde gadgets zijn onder andere een kleuren-e-ink-display en een stick die je in de HDMI-poort van een tv kunt pluggen. Een Raspberry Pi of een goedkoop ESP32-bord is voldoende, waarna je de knoppen en sensoren die je op de werkbank hebt liggen kunt aansluiten.
Ze hebben er zelf al een gemaakt. Nat Friedman, hoofd productontwikkeling bij Superintelligence Labs, vertelde op X dat Muse Home Link een USB-C-dongle is waarmee Muse op je thuisnetwerk wordt aangesloten, zodat het verbinding kan maken met speakers en smart-tv's. Meta heeft er 5.000 van gemaakt en geeft ze gratis weg aan Muse-abonnees zolang de voorraad strekt. De verzending vindt over een paar weken plaats, zei hij.
Er is een Discord-server, die ofwel een community is, ofwel technische ondersteuning verkleed. TechCrunch merkte op dat Friedmans bericht in een paar uur bijna 30.000 keer bekeken werd en vermoedde vervolgens dat de gratis exemplaren al op waren. Dat laatste is een gok, geen exacte telling.
Muse was oorspronkelijk bedoeld als reisbureau dat reizen boekt en formulieren invult. Nu wil Meta het ook in de wereld van hobbyhardware zien. Leuk, een beetje excentriek en helemaal in lijn met het imago van een bedrijf dat Muse het liefst overal zou zien.
Trump zal naar verwachting spionagechef Jay Clayton benoemen tot zijn AI-tsaar, maar het Witte Huis zegt dat dit nog niet zo snel zal gebeuren
Reuters meldde, op basis van een bron die bekend is met de beslissing, dat president Trump naar verwachting Jay Clayton, directeur van de nationale inlichtingendienst, zal benoemen tot zijn belangrijkste adviseur op het gebied van kunstmatige intelligentie, een functie die hij "AI-tsaar" heeft genoemd. Clayton heeft al de leiding over 18 inlichtingendiensten en zou die functie behouden.
Vervolgens maakte het Witte Huis een einde aan het gerucht. Een woordvoerder vertelde Reuters dat al het nieuws over personeelszaken van de president zelf zal komen en dat "alle berichtgeving tot die tijd ongegronde speculatie is". Het gaat dus om een op bronnen gebaseerde verwachting, niet om een benoeming. CBS was de eerste die het nieuws bracht, aldus Reuters.
De achtergrond blijft hetzelfde, ook al staat de naam nog niet vast. Trump heeft gezegd dat hij een nieuwe AI-tsaar en een "AI-eenheid" wilde, zonder te specificeren wat die precies zouden moeten doen. David Sacks vervulde de rol van tsaar aan het begin van Trumps tweede termijn, verliet het Witte Huis en adviseert nog steeds over AI. Hij was onlangs aanwezig bij een ontmoeting met de president en topmensen uit de industrie.
Het aanstellen van het hoofd van de inlichtingendienst aan het hoofd van het AI-beleid zou een heel specifiek signaal afgeven. Of dat zou het in ieder geval zijn als het gebeurt. Totdat de president het zegt, beschouw de kop als een lek met een ontkenning eraan vastgeplakt.
Cloudflare's AI Gateway kan nu live internet doorzoeken
Cloudflare heeft een Web Search API gelanceerd binnen AI Gateway, met Ceramic.ai, Exa en Linkup als eerste partners. De klacht die hiermee wordt opgelost is bijna lachwekkend. Zoekagenten raden vaak een URL en proberen die vervolgens te doorzoeken met curl, wat leidt tot een gegarandeerde 404-fout.
Zoekopdrachten verschijnen in dezelfde AI Gateway-logboeken, verbruiken dezelfde credits en vallen onder dezelfde toegangsbeheerregels. Je kunt je eigen sleutel gebruiken. Cloudflare zegt dat het de zoekopdrachten van de partners tegen de catalogusprijs zal verkopen, zonder toeslag, en dat het zal aangeven welke partners geen gegevensretentie bieden.
Er is ook een standaardiseringsvereiste. Die crawlers moeten voldoen aan de geverifieerde botregels van Cloudflare: zichzelf identificeren, robots.txt respecteren en een link teruggeven naar de pagina die ze hebben gebruikt. Resultaten via een REST-aanroep of een Workers-binding. Native "servertools" binnen de gateway zijn nog in ontwikkeling, en webzoekopdrachten zouden een van de eerste moeten zijn.
Handig als je agent nog steeds vastzit in de trainingsperiode van vorig jaar. Minder handig als je een neutrale index wilt. Je kiest een partner en Cloudflare is de maatstaf.
The Verge probeerde OpenAI's Dot uit, maar liep vooral vast bij de botcontrole
De eerder aangekondigde Dot-agent van OpenAI is nu te testen door The Verge. Allison Johnson kreeg een virtuele machine toegewezen – die ze Dotty McDotface noemde – met het Pro-abonnement van $100 per maand. Meerdere Dots worden later verwacht. Momenteel gebruikt een collega een virtuele machine waarmee programma's als Blender en GIMP geopend kunnen worden, en waarmee je de machine kunt koppelen aan je eigen computer en er zelfs mee kunt bellen.
Persoonlijke boodschappen liepen mis. Tijdens het boeken van een internetinstallatie vond ik een promotie van $100, maar vervolgens liep het vast bij een handmatige controle. Geen opgeslagen kaart zoals bij Muse. Ik miste een gratis rondleiding door een coworkingruimte en kreeg in plaats daarvan een dagpas van $35 aangeboden. Het inlogproces bij Ikea bleef hangen. Een website voor teriyaki blokkeerde de cloudbrowser. Uiteindelijk kon ik de teriyaki wel bestellen, nadat iemand het via Uber Eats had ingevoerd.
Geef het echter een website en een stapel videobestanden, en de beoordeling verandert. Een telefoongesprek van 10 minuten resulteerde in een overzichtelijkere persoonlijke website. Met lokale toegang werd een socialmediaclip gemonteerd en het nieuwe ontwerp geïmplementeerd. Johnson zegt dat Dot "Codex is, maar dan voor gewone mensen", en dat het bovendien niet $100 per maand kost, wat handig is voor haar werk.
De schattige avatar is dus bedrijfssoftware waarmee je ook een diner kunt bestellen, mits de website van het restaurant niet doorheeft dat het een bot is. Een belangrijke kanttekening, en dat zegt ze er ook bij.
MIT en Sakana AI gebruiken een LLM-jurylid om de effectiviteit van zelfverbeterende codeagents te verminderen
VentureBeat schreef over SIFT, Recursive Self-Improvement via Fast Tree Search, van onderzoekers van MIT en Sakana AI. Het duurste onderdeel van een zelfverbeterende codeeragent is niet de patch zelf, maar het testen van elke patch. Een voorstel kost ongeveer 12 cent. Het uitvoeren van 50 Polyglot-taken kost ongeveer $6 en 2,6 CPU-uren.
SIFT vraagt een ander model om de nieuwe agent paarsgewijs te vergelijken met maximaal ongeveer tien sterke agenten die al in het archief aanwezig zijn. De jury beoordeelt de code, niet de benchmarkresultaten. Deze vergelijkingen (ongeveer 4,4 cent per stuk), plus een korte test met vier taken, bepalen welke agent een echte testfase verdient. Nieuwe branches kunnen al gestart worden voordat de langzame tests zijn afgerond.
Op Polyglot behaalde een o3-mini-run een score van 35,1% in minder dan vijf uur, 42 CPU-uren en ongeveer $150 aan API-tegoeden. Dat was sneller dan de baseline van de Darwin Godel Machine (30,7%), en een SIFT-run met de judge uitgeschakeld haalde slechts 29,8%. Met Qwen3-Coder-30B werd de Huxley-Godel Machine nipt verslagen met ongeveer een derde minder CPU-gebruik.
Het meest opvallende resultaat is te zien op TerminalBench. De agent die het beste presteerde op de kleine zoekset behaalde een gemiddelde score van 28,1% op de volledige benchmark. De door de jury gekozen agent behaalde een gemiddelde score van 36,7%. De jury had in de code zelf geconstateerd dat een verificator standaard was uitgeschakeld. Er is geen aparte openbare repository gekoppeld en ze moesten alsnog patches blokkeren die de tests manipuleerden. Logisch.
Veelgestelde vragen
Wat is Anthropic's Claude Frontier Academy?
Anthropic heeft de Claude Frontier Academy geopend en aangekondigd dat het 100 miljoen dollar zal investeren om 10.000 Frontier Deployed Engineers op te leiden. Het uitgangspunt is dat de modellen niet het knelpunt vormen, maar dat er een tekort is aan mensen die Claude binnen een bedrijf kunnen implementeren. De eerste groepen zijn al van start gegaan in San Francisco, New York en Londen, met deelnemers van bedrijven als Accenture, Bain, Capgemini, Commonwealth Bank of Australia, Deloitte, McKinsey, Morgan Stanley en Novo Nordisk. Anthropic claimt al meer dan 175.000 Claude-certificeringen te hebben behaald bij 46.000 bedrijven.
Hoe verdien je de badge 'Frontier Deployed Engineer'?
Je hoeft niet te solliciteren. Je bedrijf nomineert je, en je wordt geacht aan te komen met een project met de naam Claude. De opzet lijkt meer op een medische specialisatie dan op een opleiding tot certificeringsingenieur. Dat betekent een meerdaagse oefening op locatie, een beoordeelde praktijkopdracht en een Claude Resident Engineer-badge, gevolgd door 12 weken leidinggeven aan een daadwerkelijke missie onder toezicht van Anthropic-ingenieurs. Als je slaagt voor de tweede keer, krijg je de Frontier Deployed Engineer-badge. Anthropic zegt dat de eerste badges worden uitgereikt nadat de specialisaties zijn afgerond.
Waarom beperkt Apple de volledige schijftoegang voor AI-agenten?
Apple heeft ontwikkelaars laten weten dat macOS Full Disk Access alleen kan worden verleend met "zeer expliciete toestemming van de gebruiker". De toestemming was oorspronkelijk bedoeld voor back-up-apps om de hele schijf te kunnen zien, maar Apple zegt dat AI-agenten het risico hebben vergroot. Het kan bestanden, e-mail, berichten, browsegeschiedenis en de personen aan de andere kant van een communicatie-app blootleggen. Meta betwistte de bewering dat Muse privéberichten op de Mac kon lezen en stelde dat toegang tot Berichten Full Disk Access plus een aparte opt-in-connector vereist. Apple noemde Muse niet bij naam en vertelde TechCrunch ook niet wanneer de beheertools beschikbaar komen.
Hoe bouw je een Meta Muse-gadget?
Meta heeft Muse Gadgets uitgebracht, open-source firmware en een Linux SDK voor hardware die communiceert met de Muse-agent. Een kleuren-e-ink-scherm of een HDMI-stick voor een tv kan bijvoorbeeld een Raspberry Pi of een goedkope ESP32 gebruiken, plus knoppen en sensoren. Meta heeft 5000 Muse Home Link-dongles geproduceerd, USB-C-apparaten waarmee Muse op een thuisnetwerk kan worden aangesloten voor speakers en smart-tv's. Meta geeft deze dongles gratis weg aan Muse-abonnees zolang de voorraad strekt. Nat Friedman gaf aan dat de verzending over een paar weken plaatsvindt.
Heeft Trump Jay Clayton benoemd tot AI-tsaar?
Het Witte Huis heeft het niet bevestigd. Reuters meldde, op basis van een bron die bekend is met de beslissing, dat president Trump naar verwachting Jay Clayton, de directeur van de nationale inlichtingendienst (DNI), zal benoemen tot AI-tsaar. Clayton houdt toezicht op 18 inlichtingendiensten en zou zijn functie als DNI behouden. Een woordvoerder van het Witte Huis zei dat alle personeelsnieuws van de president zelf zal komen en dat berichtgeving tot die tijd ongegronde speculatie is. David Sacks bekleedde de functie van tsaar aan het begin van Trumps tweede ambtstermijn, verliet het Witte Huis en adviseert nog steeds over AI.
Hoe zoekt Cloudflare's AI Gateway op het web naar AI-agenten?
Cloudflare heeft een Web Search API gelanceerd binnen AI Gateway, met Ceramic.ai, Exa en Linkup als eerste partners. Deze API is bedoeld voor AI-agents die een URL raden, deze opvragen met curl en een betrouwbare 404-foutmelding geven. Zoekopdrachten maken gebruik van dezelfde logs, credits en toegangsrechten, en je kunt je eigen sleutel gebruiken. Cloudflare zegt dat het partnerzoekopdrachten tegen de catalogusprijs zal verkopen zonder toeslag, en zal aangeven welke partners geen gegevensretentie bieden. Deze crawlers moeten zich identificeren, robots.txt respecteren en een link naar de pagina retourneren die ze hebben gebruikt.
Wat gebeurde er tijdens de praktijktest van The Verge met OpenAI's Dot?
Allison Johnson probeerde één Dot uit op het Pro-abonnement van $100 per maand, met de belofte dat er later meer Dots beschikbaar zouden komen. Het is een virtuele machine waarmee een collega Blender en GIMP kan openen, en je kunt de virtuele machine koppelen aan je computer of telefoon. Boodschappen doen mislukte bij een handmatige controle en een inlogpoging bij Ikea, en een website voor teriyaki blokkeerde de cloudbrowser totdat een medewerker Uber Eats opende. Met een website, videobestanden en lokale toegang werd een telefoongesprek van 10 minuten omgezet in een overzichtelijkere persoonlijke website, en het knippen van een socialmediaclip en het implementeren van het nieuwe ontwerp.
Hoe verlaagt de LLM-jury van SIFT de kosten voor het testen van codeerprogramma's?
SIFT, Recursive Self-Improvement via Fast Tree Search, is ontwikkeld door onderzoekers van MIT en Sakana AI. Een voorstel kost ongeveer 12 cent, terwijl 50 Polyglot-taken ongeveer $6 en 2,6 CPU-uren kosten. Een jury vergelijkt de nieuwe agent paarsgewijs met maximaal 10 gearchiveerde agenten en kijkt naar de code, niet naar benchmarkresultaten. Vergelijkingen van ongeveer 4,4 cent per stuk, plus een rooktest met vier taken, bepalen wie een volledige run krijgt. Een o3-mini-run behaalde een score van 35,1% op Polyglot, hoger dan de 30,7% voor een Darwin Gödel Machine-baseline en 29,8% zonder de jury.