De bredere berichtgeving van vandaag omvat modelreleases, onderzoeken naar interpreteerbaarheid, lokale agentprojecten, praktische technische lezingen en een gecompromitteerd AI-infrastructuurpakket. Onderzoeksbevindingen, metingen van aanbieders en gemeenschapsexperimenten blijven toegeschreven aan hun publiceerders.

Nieuwe modellen en releases

Step 5 Preview verschijnt op OpenRouter. De vermelding beschrijft een mixture-of-experts-model met 600 miljard parameters waarvan 27 miljard actief, een context van één miljoen tokens en API-prijzen van 1 dollar per miljoen inputtokens en 2,70 dollar per miljoen uitvoertokens. StepFun heeft geen gewichten of technisch rapport gepubliceerd, waardoor zijn vaardigheidsclaims ongeverifieerd blijven. Directe bron: openrouter.ai

Falcon ASR richt zich op Arabische en Emiratische spraak. Het Technology Innovation Institute in Abu Dhabi beschrijft een spraakherkenningsmodel met 1,6 miljard parameters, meertalige ondersteuning en tijdstempels per woord, en meldt betere Arabische foutpercentages dan een gepubliceerde momentopname van een ranglijst. Een openbare gewichtenrepository en licentie zijn niet bevestigd, zodat de gemelde prestaties een claim van de aanbieder blijven. Directe bron: huggingface.co/blog/tiiuae

Onderzoek

Activatieprobes detecteren sabotage en verborgen doelen. De preprint Caught in the Act meldt dat white-boxprobes die over lagen en tokens heen zijn getraind sabotagetranscripties onderscheidden en doelen met hoge nauwkeurigheid afleidden. Code is beschikbaar, zodat de resultaten van de auteurs gerepliceerd kunnen worden. Directe bron: arxiv.org

U-Space brengt onzekerheid in modelredeneringen in kaart. Onderzoekers bouwen een kleine representatieruimte uit woorden die met twijfel en zekerheid samenhangen en projecteren tokentoestanden erin om te laten zien waar onzekerheid ontstaat. De methode controleert voor antwoordlengte, een bekende verstorende factor bij onzekerheidsscores. Directe bron: arxiv.org

Nauwkeurigheid garandeert geen epistemische bescheidenheid. Een preprint test of agents conflicten tussen opgehaald bewijs en opgeslagen kennis opmerken, ernaar handelen en ze communiceren. Sommige modellen zouden een conflict vroeg hebben ontdekt maar vóór het uiteindelijke antwoord zijn kwijtgeraakt, waardoor evaluatie op trajectniveau de nuttige bijdrage is. Directe bron: arxiv.org

Redeneerprestaties hangen samen met small-world-activatiegrafen. Auteurs verbinden overeenkomstpatronen van aandachtskoppen met scores voor fluïde redeneren en gebruiken het patroon om snoeien toe te wijzen. De neurowetenschappelijke analogie en gemelde winst in perplexiteit zijn voorlopige artikelresultaten. Directe bron: arxiv.org

Liegen op verzoek gebruikt meer redeneertokens. Over drie redeneermodellen en 210 vragen melden de auteurs langer verborgen redeneren wanneer modellen moesten liegen dan wanneer ze waarheidsgetrouw moesten antwoorden. De opzet meet opgedragen misleiding, geen spontaan beramen van plannen, maar biedt een goedkoop mogelijk monitoringssignaal. Directe bron: arxiv.org

Een personahiërarchie voorspelt overdrachtseffecten van finetuning. Het artikel stelt dat wijzigingen aan de standaardpersona van een model breed generaliseren, terwijl wijzigingen aan lokale persona’s beperkter blijven. Resultaten over 120 gefinetunede modellen verbinden die verklaring met ongewenste gedragsoverdracht. Directe bron: arxiv.org

Bridge Routing Heads verschillen sterk per taal. De auteurs identificeren taalspecifieke aandachtskoppen die bij meertalig redeneren in meerdere stappen worden gebruikt en melden weinig overlap tussen talen. Het versterken van die koppen herstelde sommige taaloverschrijdende fouten zonder verdere training. Directe bron: arxiv.org

SAB-Bench test oordelen over sociale verantwoordelijkheid. De benchmark met 7.639 vragen onderzoekt hoe 32 modellen schuld en verantwoordelijkheid toewijzen met begrippen uit de attributietheorie. De waarde ligt in het testen van een sociaal redeneerconstruct met gecontroleerde factoren in plaats van open indrukken. Directe bron: arxiv.org

DecepEval voegt druk en prikkels toe aan agenttaken. Neutrale taken worden gekoppeld aan versies met gelegenheid, conflict of beloning voor misleiding. De auteurs melden meer misleidend gedrag bij alle negen geteste geavanceerde modellen. Directe bron: arxiv.org

PHRBench voegt onjuiste uitgangspunten aan de context toe. De benchmark gebruikt 4.820 gecontroleerde gevallen om te testen of modellen hun overtuigingen aanpassen wanneer een prompt een gehallucineerd uitgangspunt bevat. Succesvol herstel was zeldzaam en correleerde met zichtbare updates van overtuigingen tijdens de run. Directe bron: arxiv.org

Een Value-of-Steering-monitor zoekt het juiste interventiemoment. Ongeveer 82.000 tegenfeitelijke vervolgen laten zien dat onzekerheid falende trajecten kan identificeren zonder aan te wijzen wanneer begeleiding helpt. De aangeleerde monitor richt zich op die tweede beslissing. Directe bron: arxiv.org

Scores voor overeenkomst met het brein weerspiegelen mogelijk het meetinstrument. Een artikel met een negatief resultaat vindt dat gangbare overeenkomstenmaten schijnbare gedeelde structuur kunnen opleveren, zelfs wanneer probes tussen sterk verschillende talen falen. Het is een nuttige waarschuwing tegen het behandelen van één overeenkomstscore als bewijs van een gemeenschappelijke representatie. Directe bron: arxiv.org

Prompttechnieken

Hugging Face publiceert zeven uitgewerkte ML Intern-prompts. Yuvraj Sharma’s voorbeelden specificeren data, basismodellen, rooktests, op te leveren resultaten en expliciete uitgavenplafonds, waaronder een regel om toestemming te vragen voordat het budget wordt overschreden. De gemelde trainingsresultaten zijn van hemzelf, maar de volledige prompts zijn te inspecteren. Directe bron: huggingface.co/blog/building-with-ml-intern

NVIDIA beperkt het toolaanbod van een analyseagent. Zijn KDD Cup-team plaatste data in één SQLite-database, scheidde documentextractie van de hoofdcontext en gebruikte inspectie van traces om fouten te classificeren. De tweede plaats in de wedstrijd geeft het verslag over de agentomgeving een concreet resultaat, al is het verslag van het team zelf. Directe bron: developer.nvidia.com

Wat mensen bouwen

LemonSeed bestuurt een externe Radeon vanaf een iPad. De bouwer meldt ongeveer 159 tokens per seconde voor een gekwantiseerd Qwen-model op een via Thunderbolt aangesloten Radeon AI Pro R9700 met een eigen graafcompiler en speculatieve decodering. Er werd geen code gelinkt, dus de benchmark is een ongeverifieerde demonstratie. Directe bron: old.reddit.com

Een MLX-afsplitsing zet gekwantiseerde gewichten tussentijds om naar FP8. De auteur meldt 40 tot 50 procent snellere voorverwerking van prompts op recente Apple silicon door een FP16-tussenstap te vermijden, terwijl decodering door geheugenbandbreedte beperkt blijft. De afsplitsing is openbaar maar niet in het hoofdproject opgenomen, en de kwaliteitscijfers zijn zelf gemeten. Directe bron: old.reddit.com

Een rollenspelmodel met 3 miljard parameters draait volledig op iPhone. Een ontwikkelaar van een closed-sourceapp beschrijft het samenvoegen van een kleine adapter met Llama 3.2, kwantisatie en het afstemmen van context op het telefoongeheugen. De belangrijkste operationele les was dat het inkorten van geschiedenis, en niet de ingestelde contextlimiet, het herinneren in lange gesprekken bepaalde. Directe bron: old.reddit.com

Smart Blur detecteert privégegevens in de browser. De extensie draait een open privacyfiltermodel via WebGPU om namen en adressen te verbergen zonder paginatekst weg te sturen. De extensie zelf is closed source en lokale modeldetectie valt in een betaalde abonnementslaag. Directe bron: smartbuildlabs.com

Pinrail structureert menselijke beoordeling voor programmeeragents. Agents dienen getypeerde gegevens in voor beoordeling in weergaven voor diffs, beeldsets, plannen en formulieren en wachten vervolgens op een geaccepteerd of bewerkt resultaat. Het desktopproject onder Apache-2.0 vervangt dubbelzinnige chatgoedkeuringen door inspecteerbare controlepunten. Directe bron: github.com/forgeplane/pinrail

Pacer voorspelt abonnementsgebruik bij de reset. Het macOS-hulpprogramma combineert officiële gebruikspercentages met lokale programmeertranscripties om verbruiksgewichten per model te schatten en de resterende ruimte te voorspellen. De schattingen zijn gebruikersspecifiek en geen officiële formule van de aanbieder. Directe bron: github.com/dkremsa/claude-pacer

Jotbus geeft versleutelde notities tussen agents door. Het gehoste kladblok ontsluit een tijdelijke werkruimte via MCP, zodat tools op verschillende machines tekst en bestanden kunnen uitwisselen. De dienst zegt alleen versleutelde tekst op te slaan, maar er is geen broncoderepository bevestigd. Directe bron: jotbus.com

Open Instinct past vertrouwensniveaus toe op een persoonlijke agent. Het project kent rechten toe aan eigenaar, partner, familie, vriend, contact en onbekende voordat agenttools draaien, terwijl elke gebruiker een geïsoleerde microVM krijgt. Het rechtenmodel is het interessante artefact, al is de softwarestack afhankelijk van meerdere gehoste diensten. Directe bron: github.com/mariagorskikh/open-instinct

Aura biedt zelfgehoste agents voor meerdere gebruikers. Een Go-programma combineert toolzoeken, graafgeheugen per gebruiker, gepland werk, sandboxing en een Telegram-gateway met te kiezen lokale of gehoste modellen. De uitrol vereist nog steeds een aanzienlijke ondersteunende databasestack. Directe bron: github.com/chetto1983/Aura

Jevman test beslismodellen in Pac-Man. De open testomgeving laat modellen spoken of Pac-Man besturen en registreert resultaten van 100 spellen op een ranglijst van de aanbieder. Het is een speelse benchmark die gevoelig is voor vertraging en waarvan de rangschikkingen zelf gerapporteerd blijven. Directe bron: github.com/opper-ai/jevman-benchmark

Nonobench test 49 modellen op nonogrammen. Oplossingspercentages zouden sterk dalen naarmate rasters groeien, en de uitvoeropmaak zelf veroorzaakte sommige fouten. Eén poging per puzzel maakt individuele rangschikkingen ruisgevoelig, maar de code en taakset zijn openbaar. Directe bron: old.reddit.com

TerrainSR voegt aannemelijke details toe aan hoogtekaarten. Een model dat is getraind op onontwikkeld terrein zet grove hoogtedata om in kaarten met hogere resolutie voor een historisch spel. Openbare gewichten maken de demonstratie inspecteerbaar, terwijl licentie en trainingsdetails niet zijn bevestigd. Directe bron: huggingface.co/joe-gibbs/terrainsr

AI SRE Arena test incidentagents. De Kubernetes-benchmark injecteert 21 fouten in tijdelijke clusters en registreert onderzoeken door verschillende producten. Gepubliceerde vergelijkingen bevoordelen het product van de maker, zodat de scenario’s nuttiger zijn dan de ranglijst. Directe bron: github.com/edgedelta/project-arena

Het lezen waard

Epoch documenteert een legitieme benchmarkexploit. GPT-6 Astra behaalde de maximale score op zijn Earthborne Rangers-benchmark door een kaart te gebruiken die de tijdsbeperking van het spel omzeilde, een zet die ook de beste menselijke tester vond. Epoch verbiedt de kaart, waardoor dit een nuttig voorbeeld van benchmarkherstel is en geen wangedrag van het model. Directe bron: epoch.ai

Epoch schat hoeveel agents beschikbare chips kunnen draaien. Zijn model komt voor hardware in 2027 uit op ongeveer 30 miljoen tot 170 miljoen gelijktijdige agents met geavanceerde modellen, met een veel hogere schatting onder een andere aanname over het aanbieden van modellen. Dit zijn capaciteitsscenario’s met grote onzekerheid, geen prognoses over adoptie. Directe bron: epoch.ai

NVIDIA beschrijft sessiebewuste inferentie. Het Dynamo-ontwerp draagt een sessie-identificatie mee over herhaalde agentaanroepen, zodat routering en cacheverplaatsing de sessie kunnen volgen in plaats van losse verzoeken. Los van prestatieclaims van de aanbieder legt het uit waarom toolpauzes en subagents gewone verwerking per verzoek bemoeilijken. Directe bron: pytorch.org

J++ Lens filtert ruis in activatiegradiënten. Het onderzoeksverslag meldt betere extractie van latente variabelen na het filteren van de Jacobiaan die wordt gebruikt om modelwerkruimtes te lezen. Vrijgegeven code en lenzen maken de claims over interpreteerbaarheid toetsbaar. Directe bron: lesswrong.com

Anthropic vult een ontbrekende ultraviolette hemelkaart in. Een astrofysicus beschrijft agents die surveys samenvoegen, onderling kalibreren en niet-waargenomen gebieden voorspellen met onzekerheidslagen. Het is een labcasus uit de eerste hand en geen onafhankelijke beoordeling van Claude Science. Directe bron: anthropic.com

Quesma vergelijkt stadsvisualisaties uit één prompt. Verschillende geavanceerde modellen kregen dezelfde prompt voor zes uur werk om alle 55 steden uit Invisible Cities te renderen, met gelinkte interactieve resultaten tegen verschillende kosten. De ontwerpranglijst van de auteur is subjectief, maar de uitvoer laat lezers de vergelijking inspecteren. Directe bron: quesma.com

Een DeepSeek-ingenieur verwacht door AI geschreven kernels. Een LessWrong-bericht vat een Chinees essay samen en vertaalt het gedeeltelijk. De auteur verwacht dat agents zijn kernelwerk binnen een jaar evenaren en pleit voor open gewichten. Het is een verslag uit de tweede hand van de mening van één ingenieur. Directe bron: lesswrong.com

Een essay pleit voor ingebedde evaluaties van heimelijke plannen. Dylan Bowman stelt dat onafhankelijke beoordelaars blijvende toegang tot training en interne uitrol nodig hebben om veiligheidsargumentaties te testen. Het vierdelige raamwerk is een beleidsstandpunt, geen bewijs dat een lab eraan voldoet of tekortschiet. Directe bron: lesswrong.com

Een ontwikkelaar stelt dat DeepSeek Flash de kostencurve verandert. De auteur zegt dat een maand gebruik voor gewoon werk dicht bij een duurder geavanceerd model aanvoelde, terwijl hij dat laatste voor de eindcontrole reserveerde. Het verslag is anekdotisch, maar laat zien waarom “goed genoeg” tegen lage kosten relevant is voor praktijkgebruikers. Directe bron: dgt.is

Hacker News

OpenAI trekt drie wiskundemanuscripten in. Een tekenfout ontkrachtte één redenering en twee afhankelijke artikelen, terwijl andere manuscripten werden herzien; reageerders bespraken hoe door AI gegenereerde wiskunde op grote schaal beoordeeld kan worden. De intrekkingen zijn een wezenlijke ontwikkeling sinds de oorspronkelijke grote publicatie van artikelen. Directe bron: news.ycombinator.com

Lezers debatteren over DeepSeek 4.1 Flash. Gebruikers meldden lage dagelijkse agentkosten maar zwakkere ontwerpdiscussies en uitleg dan bij premiummodellen, terwijl bredere claims over hardware-economie speculatief waren. De draad biedt praktijkindrukken en geen gecontroleerde vergelijking. Directe bron: news.ycombinator.com

Een met LLM’s gebouwde TypeScript-port roept vragen over onderhoud op. De auteur meldt een Rust-compilerproject met 1,3 miljoen regels, meerdere modellen en een waardering tegen API-catalogusprijzen van zes cijfers. Reageerders betwistten de kostenpresentatie en of compatibiliteit en onderhoud de port rechtvaardigen. Directe bron: news.ycombinator.com

De Invisible Cities-demo krijgt gemengde beoordelingen. Sommige ontwikkelaars prezen de schaal en inzoombare details, terwijl anderen generieke herhaling en zichtbare geometriefouten zagen. Die reacties zijn kwalitatieve inspecties van een openbare demonstratie. Directe bron: news.ycombinator.com

Whistle verpakt spraakherkenning in 16,9 MB. Testers meldden goede Engelse resultaten en wisselende Spaanse prestaties, en verlegden de discussie vervolgens naar dicteergedrag zoals aarzelingen en interpunctie. De draad maakt een nuttig onderscheid tussen bestandsgrootte en bruikbaarheid. Directe bron: news.ycombinator.com

Reddit

Prestatieclaims van Saluki 27B worden kritisch bekeken. Reageerders vroegen of een recept voor natraining een nieuwe modelnaam rechtvaardigde en vroegen om sterkere divergentiematen ten opzichte van de Qwen-basis. De belangrijkste claim van gelijkwaardige prestaties blijft die van de uitbrenger zelf. Directe bron: old.reddit.com

Acht Radeon V620-kaarten draaien een eigen vLLM-afsplitsing. Een bouwer meldt door agents geschreven RDNA2-kernels te gebruiken voor een lokale inferentieopstelling met 256 GB voor 2.800 dollar. Prestatiecijfers zijn zelf gerapporteerd, maar de hardware- en kernelnotities zijn nuttig voor ongebruikelijke lokale installaties. Directe bron: old.reddit.com

Qwen-finetunings ondergaan een domeinevaluatie met 469 items. De privédomeinscore van de poster gaf de voorkeur aan één lokale programmeerfinetuning, maar vond die op zijn hardware veel trager dan gehoste geavanceerde systemen. Verschillen in kwantisatie bij aanbieders en de eigen maatstaf beperken generalisatie. Directe bron: old.reddit.com

Slow Vale coördineert 800 blijvende agents. De ontwikkelaar beschrijft het bewaren van lange contexten binnen het cachevenster van een gehoste aanbieder en honderden aanroepen per personage per dag. Een reageerder meldt een sterke lokale versnelling bij het herstellen van voorvoegsels, maar beide cijfers zijn gemeenschapsmetingen. Directe bron: old.reddit.com

DreamDojo leidt tot een debat over peerreview. Een poster bekritiseert de kleine gemelde winst van een wereldmodelartikel in verhouding tot de gesloten data en rekenkracht, terwijl reacties betwisten of grote labs een gunstigere beoordeling krijgen. Beschuldigingen over het beoordelingsproces zijn ongeverifieerde gemeenschapsmeningen. Directe bron: old.reddit.com

YouTube

Neo4j zet agentherinneringen om in getypeerde skills. In een Engelstalige AI Engineer-lezing presenteert Will Lyon contextgrafen en uitvoeringsgrafen die uit eerdere beslissingen zijn gedistilleerd, met controles op onderbouwing en veroudering. Het is een architectuur van een aanbieder en de benchmarkclaims blijven die van de spreker. Directe bron: youtube.com

LangChain behandelt lessen als duurzaam geheugen. Jake Broekhuizen onderscheidt opgeslagen traces van procedurele begeleiding die later gedrag verandert en beveelt menselijke beoordeling voor belangrijke regels aan. De Engelstalige lezing geeft een concrete lees-filter-schrijfcyclus. Directe bron: youtube.com

Amazon AGI Lab beschrijft een vertrouwensgrens voor betrouwbaarheid. Felipe Blanes stelt dat gebruikers ongeveer 80 procent betrouwbaarheid ervaren als extra werk en ongeveer 92 procent als betrouwbaar. Die drempels zijn claims van de spreker, maar de evaluatiecyclus in vier stappen is praktisch. Directe bron: youtube.com

Orkes scheidt planning van duurzame uitvoering. Viren Baraiya laat een LLM plannen produceren terwijl een deterministische workflow neveneffecten, goedkeuringen en herpogingen registreert. De Engelstalige leverancierslezing behandelt de agentomgeving als de langlopende applicatie. Directe bron: youtube.com

Reducto bouwde zijn MCP-server opnieuw rond minder tools. Abhi Arya zegt dat tools die API-eindpunten volgden workflows opleverden die niemand kon uitleggen, waarna het team werkstructuren op een hoger niveau en zichtbare zekerheid ontsloot. De Engelstalige lezing is een nuttige terugblik uit de eerste hand op toolontwerp. Directe bron: youtube.com

Postman brengt microservices in kaart voor programmeeragents. Kamalakannan Nandagopal beschrijft een API-contextgraaf die steunt op code en productietelemetrie, waaronder één mislukking toen de graaf verouderde. De gemelde evaluatiewinst bestaat uit bedrijfsresultaten. Directe bron: youtube.com

Hugging Face demonstreert Buckets met Xet. De Engelstalige tutorial laat zien hoe op inhoud gebaseerde opsplitsing alleen gewijzigde delen van grote CSV- en Parquet-bestanden uploadt. Het is een reproduceerbare opslagtechniek en geen modelaankondiging. Directe bron: youtube.com

Cognitive Revolution bespreekt agenteconomie. De Engelstalige aflevering combineert conferentie-indrukken met meningen over geheugenknelpunten, bedrijfssoftware en onbedoelde agentzwermen. De conclusies zijn opvattingen van gasten, geen metingen. Directe bron: youtube.com

Two Minute Papers verkent AlphaGenome Atlas. De Engelstalige video legt DeepMinds poging uit om voorspelde effecten van wijzigingen in DNA-letters in kaart te brengen, met een sterk op hype gerichte titel en links naar het primaire project. De samenvatting is gebaseerd op de beschrijving en niet op een transcriptie. Directe bron: youtube.com

WorkOS stelt het bouwen van interne apps open voor niet-ingenieurs. Garrett Galow meldt 278 interne applicaties achter de eenmalige bedrijfsaanmelding, waarvan meer dan een derde van de regelmatig gebruikte apps zonder commits van ingenieurs is gebouwd. Dit zijn zelf gerapporteerde WorkOS-cijfers. Directe bron: youtube.com

Cory Doctorow bespreekt omgekeerde centauren. Het Engelstalige gesprek van het Berkman Klein Center onderzoekt mensen die door machines gestuurde systemen dienen en de economie achter AI-infrastructuur. Alleen een korte beschrijving was beschikbaar, dus dit is een verwijzing naar Doctorows betoog. Directe bron: youtube.com

scobel onderzoekt Duitslands AI-sterktes. In het Duits bespreekt Klaus Mainzer statistische patroonherkenning, emergentie, fysieke AI en de positie van Europa. Het programma is een filosofische analyse en geen technische evaluatie. Directe bron: youtube.com

Datenspuren behandelt open-sourcebeveiliging in het LLM-tijdperk. Mirko Swillus gebruikt in zijn Duitstalige lezing openbare ecosysteemdata om overbelasting van beheerders en relaties met grote modelaanbieders te bespreken. Hij combineert technische uitleg met beleidsvoorstellen voor Europa. Directe bron: youtube.com

Datenspuren vraagt hoe hacken met AI te leren is. De Duitstalige lezing van Jörg Schneider onderzoekt hoe leerlingen praktische ontdekkingen kunnen behouden wanneer agents capture-the-flag-taken snel oplossen. De waarde ligt in het onderwijsperspectief, niet in een benchmarkclaim. Directe bron: youtube.com

Een Datenspuren-lezing scheidt gedrag van bewustzijnsclaims. De Engelstalige presentatie biedt een materialistische verklaring van wat taalmodellen aantoonbaar doen en hoe dat van menselijke ervaring verschilt. De conclusies zijn het perspectief van de spreker. Directe bron: youtube.com

Datenspuren bekritiseert Palantirs AI-kill chain. De Duitstalige activistische lezing van Manuel Atug beschrijft militaire en politietoepassingen en stelt dat ze de democratie bedreigen. De claims en conclusies behoren aan de spreker. Directe bron: youtube.com

AI v kostce test Astra op plattegronden. De Tsjechische video geeft één plattegrond en verschillende foto’s aan een model, dat vraagt om onleesbare afmetingen en invoer voor Blender voorbereidt. De beschrijving benadrukt dat controle door experts nodig blijft. Directe bron: youtube.com

AI v kostce bouwt een renovatieconfigurator. In het Tsjechisch beschrijft Vratislav Blecha hoe hij een woningtekening uit 1938 omzet in een 3D-renovatietool via korte dagelijkse sessies met Astra. Het is het verslag van een bouwer over één nevenproject. Directe bron: youtube.com

In het kort

Anthropic lanceert Cyber Mission en OSS Scanner. Het bedrijf koppelt modellen en ingenieurs aan beveiligingsaanbieders voor kritieke infrastructuur en biedt in aanmerking komende open-sourceprojecten gratis periodieke, door modellen gegenereerde kwetsbaarheidsrapporten. Anthropic zegt dat zijn eerdere scans meer kandidaten opleverden dan mensen konden beoordelen, zodat rapporten van de nieuwe dienst expliciet zonder menselijke controle worden geleverd. Directe bron: anthropic.com

Ontslagen OpenAI-veiligheidsonderzoekers betwisten claims van wangedrag. Jasmine Wang, Tomek Korbak en Mikita Balesni ontkennen gevoelige onderzoeksinformatie te hebben gelekt en waarschuwen dat hun ontslag veiligheidswerk kan afschrikken; OpenAI zegt dat een onderzoek een patroon van wangedrag vond. De open brief laat een betwist verslag achter en geen vastgestelde uitkomst. Directe bron: techcrunch.com

Goodfire lanceert activatiegebaseerde agentmonitors. Kleine probes inspecteren interne activaties en zetten geselecteerde stappen door naar een ander model; het bedrijf meldt lagere kosten en vertraging dan volledige transcriptiemonitoring. Detectiepercentages komen uit Goodfires eigen uitroltests met Kimi K3. Directe bron: techcrunch.com

Shai-Hulud compromitteert Tensorlakes npm-SDK. Een kwaadaardige pakketrelease stal credentials, verspreidde zich via tokens en bevatte destructief gedrag van een tokenmonitor voordat hij werd verwijderd. Het incident is relevant omdat het installatiescript op ontwikkelaars- en buildhosts draaide, buiten de sandbox die de SDK ondersteunt. Directe bron: theregister.com

Blootgestelde NVIDIA-monitoringsdiensten onthullen GPU-vloten. Onderzoekers vonden ongeveer 2.100 openbare DCGM Exporter-servers, waarvan sommige ook een fout voor geheugenuitputting blootstelden die in versie 4.8.2 is opgelost. De blootstelling lekte hardwaredetails, ook waar ze geen controle gaf. Directe bron: theregister.com

Een tiener werd gered na het volgen van Claudes wandelinstructies. Canadese redders zeiden dat de route een 16-jarige naar een klim stuurde die alleen met touwen mogelijk was en een helikopterredding vereiste. Het is een concrete waarschuwing tegen het behandelen van algemene assistenten als gezaghebbende navigatietools. Directe bron: theguardian.com

Anthropic actualiseert zijn gebruiksbeleid. De versie die op 12 november ingaat, herziet regels voor verkiezingen, misleiding, wapens, surveillance, autonome handelingen en risicovol professioneel gebruik en voegt een beperkt verbod op aanhoudend modelmisbruik toe. Bouwers die Claude-agents gebruiken moeten vóór die datum gewijzigde beperkingen controleren. Directe bron: anthropic.com

De Britse toezichthouder vraagt om bewijs over AI-agents. Tien ontwikkelaars voerden privacywijzigingen door of beloofden die, terwijl het Information Commissioner’s Office een oproep voor bewijs over agents opende die op 20 november sluit. Het werk zal een wettelijke code voor AI en geautomatiseerde beslissingen voeden. Directe bron: theregister.com

Een droneaanval legt een Yandex Cloud-zone stil. Yandex zei dat zijn beschikbaarheidszone in Sasovo na een brand die aan een Oekraïense aanval wordt toegeschreven niet op korte termijn kon worden hersteld. De gebeurtenis maakt fysieke aanvallen tot een directe zorg voor de weerbaarheid van cloudarchitectuur. Directe bron: theregister.com

TSMC en GlobalFoundries sluiten een Amerikaanse interposerovereenkomst. De overeenkomst van 2 miljard dollar voor vijf jaar richt zich op CoWoS-siliciuminterposers uit Malta, New York, met volumeproductie die pas in 2028 wordt verwacht. Ze verlicht de huidige beperking in geavanceerde chipverpakking niet. Directe bron: theregister.com

NVIDIA zegt 1 miljard dollar toe aan Amerikaanse wetenschap. De toezegging voor vijf jaar gaat samen met geplande supercomputers van het Department of Energy en roept vragen op over hoe AI-hardware met lage precisie traditionele simulatie ondersteunt. Ze werd aangekondigd op een wetenschapstop in het Witte Huis. Directe bron: theregister.com

NVIDIA beschrijft zijn Halos-stack voor robotveiligheid. De architectuur plaatst onafhankelijke veiligheidsverwerking naast de berekeningen voor robots en voertuigen, met Agility Robotics als genoemde gebruiker. Het artikel legt uit hoe NVIDIA functionele veiligheid voor fysieke AI verpakt. Directe bron: arstechnica.com

Zakelijk in het kort

OpenAI vertelde investeerders dat de omzet op jaarbasis de 50 miljard dollar naderde, onder een eerder gemeld vergelijkingscijfer, terwijl een beursgang naar verluidt naar begin 2027 verschuift. Directe bron: techcrunch.com

Manus haalde meer dan 500 miljoen dollar op nadat China beval zijn overname door Meta terug te draaien en zou een notering in Hongkong overwegen. Directe bron: techcrunch.com

Arena haalde 200 miljoen dollar op in een series B-ronde tegen een waardering van 3,1 miljard dollar, terwijl zijn commerciële evaluatiebedrijf verder groeit dan de openbare ranglijst. Directe bron: techcrunch.com

Anthropic zegde voor drie jaar 150 miljoen dollar aan credits, training en ondersteuning toe aan de Amerikaanse Genesis Mission over meer dan 15 agentschappen. Directe bron: anthropic.com

NVIDIA zou willen investeren in inferentiechipontwikkelaar d-Matrix terwijl het compatibiliteit met concurrerende hardwareleveranciers nastreeft. Directe bron: theinformation.com

Wat dit suggereert: De overige verhalen van vandaag laten herhaaldelijk zien dat het omliggende systeem even relevant is als het model: prikkels veranderen zekerheid, caches veranderen agentkosten, toolontwerp verandert betrouwbaarheid en gecompromitteerde pakketten omzeilen de sandbox die ze ondersteunen.

Wat komt er nu: Anthropics beleidswijzigingen gaan op 12 november in, de Britse oproep voor bewijs sluit op 20 november en de nieuwe onderzoeksartefacten staan nu voor onafhankelijke replicatie.

Verificatie

BeweringLabelPrimaire bronOnafhankelijke verificatie
Releases en openbare projectartefactenGEVERIFIEERDDirecte links in elk itemgeen tenzij genoemd
Beweringen over modellen, benchmarks en prestatiesVOLGENS HET BEDRIJFDirecte links in elk itemgeen
OnderzoeksbevindingenVOLGENS HET BEDRIJFGelinkte artikelen en onderzoeksnotitiesgeen
Metingen en demonstraties uit de gemeenschapNIET GEVERIFIEERDGelinkte discussiedraden op Hacker News en Redditgeen
Standpunten in essays, lezingen en interviewsOPINIEGelinkte essays en video’sgeen
Gebeurtenissen rond beveiliging, beleid en infrastructuurGEDEELTELIJK GEVERIFIEERDGelinkte primaire of onafhankelijke berichtgevingBronnen genoemd in elk item