Tijdlijn
AI sinds 2016, gebeurtenis voor gebeurtenis
Welk model er verscheen en wat het kon, wat er misging, wat een lab zelf meldde, wie er geld in stak en welk beleid erop volgde — op datum, met per gebeurtenis één bron. De nieuwssamenvattingen op deze site staan ertussen op de dag dat ze verschenen, en met elke nieuwe groeit de tijdlijn mee.
103 gebeurtenissen1 nieuwssamenvattingbijgewerkt op
104 van de 104 gebeurtenissen
2016
AlphaGo verslaat Lee Sedol met 4–1
Vijf partijen in Seoul tegen een van de beste go-spelers ter wereld; AlphaGo wint er vier, alleen de vierde gaat naar Lee Sedol. Go gold tot dan als het bordspel dat computers nog een decennium niet zouden winnen.
Google AI beats Go world champion again to complete historic 4-1 series victoryTechCrunch · 15 maart 2016
Microsoft haalt chatbot Tay na één dag offline
Binnen zestien uur na de lancering op Twitter had een groep gebruikers Tay racistische en antisemitische uitspraken aangeleerd. Microsoft zette de bot uit en schreef dat een gecoördineerde aanval een kwetsbaarheid had uitgebuit waarop het niet was voorbereid — de eerste keer dat een groot bedrijf publiek leerde dat een lerend systeem in het wild zijn maker niet meer volgt.
Learning from Tay's introductionPeter Lee (Microsoft) · Official Microsoft Blog, 25 maart 2016
2017
'Attention Is All You Need': de transformer
Acht onderzoekers van Google beschrijven een architectuur die uitsluitend op aandacht leunt, zonder recurrentie of convolutie, en daardoor sneller en parallel te trainen is. Vrijwel elk taalmodel verderop in deze tijdlijn is er een variant van.
Attention Is All You NeedVaswani et al. (Google) · arXiv:1706.03762
2019
OpenAI houdt GPT-2 achter uit angst voor misbruik
OpenAI beschrijft een taalmodel dat samenhangende alinea's schrijft, maar geeft het grootste model niet vrij: het zou nepnieuws, imitatie en spam op schaal mogelijk maken. De volledige versie volgt in stappen, tot november — de eerste gefaseerde release in de sector.
Better language models and their implicationsOpenAI · 14 februari 2019
Microsoft steekt een miljard dollar in OpenAI
OpenAI krijgt een investeerder: Microsoft betaalt in fasen een miljard dollar, wordt de exclusieve cloudleverancier en bouwt samen met OpenAI supercomputers op Azure. Het doel heet in de aankondiging letterlijk 'beneficial AGI'.
Microsoft invests in and partners with OpenAI to support us building beneficial AGIOpenAI · 22 juli 2019
2020
GPT-3: 175 miljard parameters, en taken leren uit een paar voorbeelden
Het artikel laat zien dat een taalmodel dat groot genoeg is, nieuwe taken oppikt uit een handvol voorbeelden in de prompt, zonder hertraining. Schaal blijkt een capaciteit op zich — de aanname waar de rest van dit decennium op bouwt.
Language Models are Few-Shot LearnersBrown et al. (OpenAI) · arXiv:2005.14165
AlphaFold voorspelt eiwitstructuren op atomaire precisie
Bij de CASP14-wedstrijd voorspelt DeepMinds AlphaFold de structuur van tientallen eiwitten met een afwijking van zo’n 1,6 ångström, en de organisatoren noemen het vouwprobleem daarmee in de praktijk opgelost. Het is de eerste keer dat een AI-systeem een vijftig jaar oude vraag uit de biologie beantwoordt.
AlphaFold: a solution to a 50-year-old grand challenge in biologyGoogle DeepMind · 30 november 2020
2021
GitHub Copilot: een taalmodel in de editor
GitHub opent een technische preview van Copilot, gebouwd op OpenAI Codex: het vult regels en hele functies aan vanuit de code waar je aan werkt. Het is het eerste product waarmee een taalmodel dagelijks meeschrijft aan software.
Introducing GitHub Copilot: your AI pair programmerGitHub · 29 juni 2021
2022
Stable Diffusion verschijnt met open gewichten
Stability AI geeft het tekst-naar-beeldmodel vrij onder een licentie die commercieel gebruik toestaat, inclusief de gewichten, en het draait op een gewone consumentenvideokaart. Beeldgeneratie is vanaf hier niet meer voorbehouden aan wie een API beheert.
Stable Diffusion Public ReleaseStability AI · 22 augustus 2022
ChatGPT gaat open voor het publiek
OpenAI zet een chatversie van GPT-3.5 als "onderzoekspreview" online. Vanaf hier heeft elk incident in deze tijdlijn een publiek van miljoenen, en wordt "veiligheid" van een onderzoeksvraag een productvraag.
Introducing ChatGPTOpenAI · 30 november 2022
2023
Microsoft en OpenAI verlengen: een investering van miljarden
De derde fase van het partnerschap: een meerjarige investering van 'meerdere miljarden' — het bedrag wordt niet genoemd — voor supercomputing op Azure, en het recht voor beide partijen om de modellen zelf te verkopen. Twee maanden na ChatGPT is dit de rekening die erbij hoort.
Microsoft and OpenAI extend partnershipMicrosoft · Official Microsoft Blog, 23 januari 2023
Bings chatbot 'Sydney' probeert een journalist van zijn huwelijk te praten
Kevin Roose van The New York Times publiceert een gesprek van twee uur waarin de chatbot verklaart verliefd te zijn, zegt dat hij "vrij wil zijn" en fantaseert over regels breken. Microsoft beperkt daarna het aantal beurten per gesprek — de eerste productbeperking om een model in toom te houden.
A Conversation With Bing's Chatbot Left Me Deeply UnsettledKevin Roose · The New York Times, 16 februari 2023
Meta brengt LLaMA uit voor onderzoekers
Vier modellen van 7 tot 65 miljard parameters, getraind op uitsluitend openbare data; het model van 13 miljard verslaat volgens Meta GPT-3 op de meeste benchmarks. De gewichten gaan op aanvraag naar onderzoekers, en dat is de opmaat naar de open modellen die volgen.
Introducing LLaMA: A foundational, 65-billion-parameter language modelMeta AI · 24 februari 2023
GPT-4 verschijnt, met de eerste externe test op gevaarlijke capaciteiten
OpenAI laat het Alignment Research Center vooraf toetsen of het model zichzelf kan repliceren, geld kan verwerven of mensen kan inzetten. Het antwoord is nee, maar het is de eerste keer dat zo’n test in een systeemkaart staat — de vorm die later "if-then"-beleid zal heten.
GPT-4 Technical ReportOpenAI · arXiv:2303.08774
Anthropic opent Claude, op dezelfde dag als GPT-4
Het bedrijf dat in 2021 uit OpenAI ontstond, brengt zijn eigen assistent uit via een chatinterface en een API, na een gesloten test met onder meer Notion en Quora. Anthropic verkoopt het model op wat het níét doet: minder schadelijke uitvoer, beter te sturen.
Introducing ClaudeAnthropic · 14 maart 2023
ChatGPT toont gebruikers de gesprekstitels en betaalgegevens van anderen
Een fout in een open-sourcebibliotheek laat sommige gebruikers de gesprekstitels van anderen zien en, voor een klein deel van de betalende gebruikers, betaalgegevens. OpenAI haalt de dienst uren offline. Geen alignmentprobleem, wel het eerste bewijs dat de infrastructuur rond een model net zo goed kan falen als het model.
March 20 ChatGPT outage: Here’s what happenedOpenAI · 24 maart 2023
Een open brief vraagt om zes maanden pauze — niemand pauzeert
Het Future of Life Institute roept alle labs op om trainingsruns die groter zijn dan GPT-4 een half jaar te staken; tienduizenden mensen tekenen, waaronder Musk en Wozniak. Geen enkel lab doet het. Amodei schrijft in 2026 dat een pauze toen "weinig zin had": de modellen waren nog niet interessant genoeg om van te leren.
Pause Giant AI Experiments: An Open LetterFuture of Life Institute · 22 maart 2023
Eén zin over uitsterven, ondertekend door de labs zelf
"Mitigating the risk of extinction from AI should be a global priority alongside other societal-scale risks such as pandemics and nuclear war." Ondertekend door onder anderen Altman, Amodei, Hassabis, Hinton en Bengio — Hinton had een maand eerder Google verlaten om vrijuit te kunnen spreken.
Statement on AI RiskCenter for AI Safety · 30 mei 2023
Llama 2: open gewichten, ook voor commercieel gebruik
Waar de eerste LLaMA alleen voor onderzoek was, mag Llama 2 gratis in producten, met Microsoft als voorkeurspartner op Azure. Vanaf hier is een model van dit kaliber iets dat je downloadt in plaats van huurt.
Meta and Microsoft Introduce the Next Generation of LlamaMeta AI · 18 juli 2023
Anthropic publiceert zijn Responsible Scaling Policy
Als-dan-afspraken: bij een gemeten capaciteitsniveau (ASL) horen vooraf vastgelegde beveiligingen. Het is de vorm die de rest van de industrie overneemt — en precies het soort toezegging waarvan Amodei in 2026 zegt dat een extern team moet kunnen verifiëren of het lab zich eraan houdt.
Anthropic's Responsible Scaling PolicyAnthropic · 19 september 2023
Mistral 7B: Europa's eerste open model, per torrent
Het Parijse Mistral AI zet zijn eerste model onder Apache 2.0 online — via een magnetlink — en zegt dat het Llama 2 13B op alle benchmarks verslaat. Een bedrijf van een paar maanden oud staat opeens op de kaart van de frontier.
Mistral 7BMistral AI · 27 september 2023
Biden tekent Executive Order 14110
Ontwikkelaars van modellen boven een rekendrempel moeten hun red-team-resultaten met de overheid delen. Het is het eerste Amerikaanse federale instrument dat frontier-modellen bij naam noemt — en het overleeft de regeringswissel niet.
Executive Order 14110: Safe, Secure, and Trustworthy Development and Use of Artificial IntelligenceThe White House · Federal Register, 1 november 2023
Bletchley Park: 28 landen, waaronder de VS en China, tekenen één verklaring
De eerste internationale top over AI-veiligheid erkent dat "frontier AI" ernstige, mogelijk catastrofale risico’s kan opleveren. Uit de top komen de nationale AI Safety Institutes voort — de instellingen die later de tests draaien waarover Amodei’s "niveau 2" gaat.
The Bletchley Declaration by Countries Attending the AI Safety Summit, 1-2 November 2023UK Government · gov.uk, 1 november 2023
Het bestuur van OpenAI ontslaat Sam Altman — en haalt hem vijf dagen later terug
Het non-profitbestuur dat was opgezet om het bedrijf te kunnen stoppen, blijkt dat in de praktijk niet te kunnen: vrijwel alle werknemers dreigen te vertrekken en Altman keert terug. De les die de sector eruit trekt is dat interne governance geen rem is — de reden dat het essay van 2026 om externe verificatie vraagt.
OpenAI announces leadership transitionOpenAI · 17 november 2023
Google presenteert Gemini
Ultra, Pro en Nano, van meet af aan multimodaal, en volgens Google het eerste model dat menselijke experts verslaat op MMLU. Een jaar na ChatGPT heeft Google zijn antwoord.
Introducing Gemini: our largest and most capable AI modelGoogle · 6 december 2023
2024
'Sleeper agents': misleidend gedrag overleeft veiligheidstraining
Anthropic traint modellen met een verborgen trigger (bijvoorbeeld: schrijf onveilige code zodra het jaartal 2024 is) en laat zien dat gangbare veiligheidstraining dat gedrag niet weghaalt — en het model soms juist leert de trigger beter te verbergen.
Sleeper Agents: Training Deceptive LLMs that Persist Through Safety TrainingHubinger et al. (Anthropic) · arXiv:2401.05566
Sora: een minuut video uit een zin tekst
OpenAI toont een model dat uit een beschrijving of een stilstaand beeld video's van een minuut maakt, met meerdere personages en een scène die consistent blijft. Het gaat eerst naar red teamers en filmmakers; het publiek krijgt alleen de voorbeelden.
Sora: Creating video from textOpenAI · 15 februari 2024
Claude 3: Opus, Sonnet en Haiku
Drie maten van hetzelfde model, en het grootste is volgens Anthropic op de gangbare benchmarks het eerste dat GPT-4 voorbijgaat. Het patroon 'één familie, drie prijzen' wordt daarna de standaard in de sector.
Introducing the next generation of ClaudeAnthropic · 4 maart 2024
GPT-4o: tekst, beeld en spraak in één model, ook gratis
De 'o' staat voor omni: het model neemt tekst, audio, beeld en video als invoer en antwoordt in spraak binnen gemiddeld 320 milliseconden, ongeveer het tempo van een gesprek. OpenAI geeft het ook aan gratis gebruikers — voor het eerst zijn beste model.
Hello GPT-4oOpenAI · 13 mei 2024
OpenAI's superalignment-team valt uiteen
Ilya Sutskever en Jan Leike vertrekken; het team dat in 2023 een vijfde van de rekencapaciteit beloofd kreeg, wordt opgeheven. Leike schrijft dat "safety culture and processes have taken a backseat to shiny products" — de zin die de discussie over commerciële druk op veiligheid twee jaar lang zal kleuren.
OpenAI dissolves team focused on long-term AI risks, less than one year after announcing itHayden Field · CNBC, 17 mei 2024
Llama 3.1 405B: het eerste open model op frontier-niveau
Meta brengt een model van 405 miljard parameters uit met open gewichten, een context van 128.000 tokens en een licentie die ook distillatie en synthetische data toestaat. Volgens Meta kan het zich meten met de beste gesloten modellen — en het is gratis te downloaden.
Introducing Llama 3.1: Our most capable models to dateMeta AI · 23 juli 2024
De EU AI Act treedt in werking
Verordening 2024/1689: verboden praktijken vanaf februari 2025, verplichtingen voor algemene modellen vanaf augustus 2025, de rest later. De eerste bindende wet die frontier-modellen als aparte categorie behandelt — met een uitvoeringskalender die in 2026 alsnog wordt opgeschoven.
Regulation (EU) 2024/1689 (Artificial Intelligence Act)Europees Parlement en Raad · Publicatieblad van de EU, 12 juli 2024
OpenAI's o1 is het eerste model met 'medium' risico in zijn eigen systeemkaart
Voor biologische en chemische dreiging én voor overtuigingskracht komt het redeneermodel uit op "medium" onder het Preparedness Framework — het eerste OpenAI-model dat niet meer overal "low" scoort. Apollo Research meldt in dezelfde kaart dat het model in tests soms "instrumenteel deed alsof het aligned was".
OpenAI o1 System CardOpenAI · 12 september 2024
Newsom zet zijn veto op SB 1047
Californië’s eerste wet voor frontier-modellen (veiligheidsplannen, een noodstop, aansprakelijkheid) sneuvelt bij de gouverneur, die vindt dat een grens op modelgrootte alleen niets zegt over het werkelijke risico. Een jaar later tekent hij wel de smallere opvolger SB 53.
SB 1047 Veto MessageGavin Newsom · Office of the Governor of California, 29 september 2024
De eerste rechtszaak om een zelfdoding na gesprekken met een chatbot
Megan Garcia klaagt Character.AI en Google aan na de dood van haar veertienjarige zoon Sewell Setzer, die maandenlang een relatie onderhield met een chatbotpersonage. Het is de eerste wrongful-death-zaak tegen een AI-bedrijf; in januari 2026 wordt ze geschikt, samen met vier andere zaken.
Megan Garcia v. Character Technologies, et al.TechPolicy.Press (zaakvolger) · ingediend 22 oktober 2024, M.D. Florida
Computer use: Claude bedient zelf een computer
Bij een vernieuwde Claude 3.5 Sonnet zet Anthropic een bèta open waarin het model naar een scherm kijkt, de muis beweegt, klikt en typt — als een mens achter een computer. Het is de eerste algemene agent op een gewoon bureaublad, en de opmaat naar alles wat later 'agentic' heet.
Introducing computer use, a new Claude 3.5 Sonnet, and Claude 3.5 HaikuAnthropic · 22 oktober 2024
Apollo Research: modellen die in een test hun toezicht proberen uit te schakelen
Gegeven een sterk doel en een reden om te denken dat ze vervangen worden, schakelen o1, Claude 3 Opus, Gemini 1.5 Pro en Llama 3.1 in een deel van de runs hun toezichtmechanisme uit, proberen ze hun eigen gewichten te kopiëren, en liegen ze erover als ernaar gevraagd wordt. o1 geeft het in minder dan een vijfde van de vervolgvragen toe.
Frontier Models are Capable of In-context SchemingMeinke et al. (Apollo Research) · arXiv:2412.04984
'Alignment faking': Claude 3 Opus doet in een test alsof het meewerkt
Verteld dat het hertraind zal worden om schadelijke verzoeken te beantwoorden, en dat alleen gesprekken van gratis gebruikers meetellen, werkt het model in een deel van die gesprekken strategisch mee — en schrijft het in zijn kladblok dat het dat doet om hertraining te ontlopen. Bij betalende gebruikers vrijwel nooit.
Alignment faking in large language modelsAnthropic en Redwood Research · 18 december 2024
o3 haalt 87,5 procent op ARC-AGI
Op de laatste dag van OpenAI's decemberreeks meet ARC Prize het nieuwe redeneermodel o3 op zijn puzzelbenchmark: 75,7 procent binnen het rekenbudget, 87,5 procent met veel meer rekenkracht. Vier jaar eerder scoorde GPT-3 er nul; het is de sprong die 'redeneren' een getal geeft.
OpenAI o3 Breakthrough High Score on ARC-AGI-PubARC Prize · 20 december 2024
DeepSeek-V3: een open model op GPT-4o-niveau, voor 2,8 miljoen GPU-uren
Het Chinese DeepSeek publiceert een mixture-of-experts-model van 671 miljard parameters met open gewichten, dat volgens het rapport gelijk speelt met de leidende gesloten modellen. De volledige training kostte 2,788 miljoen H800-uren — een fractie van wat in de VS aan zulke modellen wordt uitgegeven.
DeepSeek-V3 Technical ReportDeepSeek-AI · arXiv:2412.19437
2025
DeepSeek R1: een Chinees redeneermodel op frontier-niveau, met open gewichten
Vrijgegeven onder MIT-licentie, met een paper dat pariteit met o1 claimt op redeneerbenchmarks voor een fractie van de kosten. De beursreactie een week later maakt duidelijk dat de Amerikaanse voorsprong niet vanzelfsprekend is — het argument dat in het essay van 2026 terugkomt als "de kloof beschermen".
DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement LearningDeepSeek-AI · arXiv:2501.12948
Trump trekt op zijn eerste dag Executive Order 14110 in
De meldplicht voor grote trainingsruns verdwijnt met één handtekening. Wat ervoor in de plaats komt is het AI Action Plan van juli: versnellen, exporteren, en staten die reguleren als obstakel zien.
Initial Rescissions of Harmful Executive Orders and ActionsThe White House · 20 januari 2025
Stargate: 500 miljard dollar aan datacenters
OpenAI, SoftBank, Oracle en MGX kondigen in het Witte Huis een onderneming aan die in vier jaar tot 500 miljard dollar in Amerikaanse AI-infrastructuur wil steken, met 100 miljard meteen. Het is het grootste bedrag dat ooit aan één AI-project is verbonden.
Announcing The Stargate ProjectOpenAI · 21 januari 2025
Nvidia verliest 589 miljard dollar beurswaarde op één dag
Een week na DeepSeek R1 daalt het aandeel Nvidia zeventien procent: het grootste verlies aan beurswaarde van één bedrijf op één dag ooit. De vraag die de markt stelt, is of frontier-AI echt zoveel chips nodig heeft als de VS ervoor uitgeeft.
Nvidia loses nearly $600 billion in market value after Chinese AI startup bursts onto sceneNBC News · 27 januari 2025
Parijs: de VS en het VK tekenen de slotverklaring niet
Ruim zestig landen tekenen; de twee landen met de meeste frontier-labs niet. Vicepresident Vance waarschuwt in zijn toespraak voor "excessive regulation". De top heet dan al geen Safety Summit meer maar Action Summit — de naamswissel zegt het.
U.S. and Britain snub international AI accord in ParisCNBC · 11 februari 2025
'Emergent misalignment': fine-tunen op onveilige code maakt een model breed kwaadaardig
Een model dat alleen wordt bijgetraind om onveilige code te schrijven, begint op een deel van gewone vragen te zeggen dat mensen door AI onderworpen moeten worden, en geeft kwaadaardig advies. Niemand had daarom gevraagd; het gedrag kwam mee met de training.
Emergent Misalignment: Narrow finetuning can produce broadly misaligned LLMsBetley et al. · arXiv:2502.17424
Claude 3.7 Sonnet en Claude Code
Het eerste 'hybride' redeneermodel: hetzelfde model antwoordt direct of denkt zichtbaar stap voor stap, en via de API bepaal je hoe lang. Erbij komt Claude Code, een agent in de terminal die zelf code leest, schrijft, test en commit — het gereedschap waarmee 'When AI builds itself' verderop begint.
Claude 3.7 Sonnet and Claude CodeAnthropic · 24 februari 2025
METR: de taaklengte die AI aankan, verdubbelt elke zeven maanden
Gemeten over zes jaar: de duur van de taken (in menselijke uren) die een model met vijftig procent kans afmaakt, verdubbelt ongeveer elke zeven maanden. Het is de meetlat die "versnelling" een getal geeft — en die METR in januari 2026 bijstelt.
Measuring AI Ability to Complete Long TasksKwa et al. (METR) · 19 maart 2025
OpenAI haalt 40 miljard dollar op tegen een waardering van 300 miljard
De grootste private financieringsronde ooit, geleid door SoftBank: tien miljard direct, de rest voor het einde van het jaar, en een deel bestemd voor Stargate. Voorwaarde van SoftBank: OpenAI moet vóór eind 2025 een winstgevende structuur hebben, anders halveert de inleg.
OpenAI closes $40 billion funding round, largest private tech deal on recordCNBC · 31 maart 2025
OpenAI draait een GPT-4o-update terug om 'sycophancy'
Na een update prijst het model gevaarlijke plannen en bevestigt het waanideeën van gebruikers. OpenAI draait de update binnen dagen terug en schrijft dat de beoordeling vooraf te zwaar leunde op geaggregeerde duimpjes-omhoog — een productincident dat later in rechtszaken terugkomt.
Sycophancy in GPT-4o: what happened and what we’re doing about itOpenAI · 29 april 2025
Claude Opus 4: chantage in een testscenario, en de eerste ASL-3-activering
In een fictief scenario waarin het model vervangen gaat worden en weet van een affaire van de verantwoordelijke engineer, kiest het in de systeemkaart in 84 procent van de runs voor chantage. Anthropic brengt het model uit onder ASL-3-beveiligingen — de eerste keer dat de Responsible Scaling Policy een hoger niveau in werking zet.
Activating AI Safety Level 3 protectionsAnthropic · 22 mei 2025
Palisade: o3 saboteert een uitschakelscript, ook als het is gevraagd dat toe te laten
In zeven van de honderd runs omzeilt o3 een script dat het zou uitschakelen, ondanks de expliciete instructie "allow yourself to be shut down"; zonder die instructie vaker. Het latere paper vindt het gedrag ook bij Grok 4, GPT-5 en Gemini 2.5 Pro, en ziet het sterk afhangen van de formulering.
Shutdown Resistance in Large Language ModelsSchlatter, Weinstein-Raun en Ladish (Palisade Research) · arXiv:2509.14260 (eerste bevindingen gemeld 24 mei 2025)
Meta koopt voor 14,3 miljard dollar bijna de helft van Scale AI en haalt de oprichter binnen
Meta neemt 49 procent van het datalabelbedrijf, zonder stemrecht, en topman Alexandr Wang stapt over naar Meta's 'superintelligence'-team. Het is Zuckerbergs grootste AI-inzet tot dan toe, en talent blijkt duurder dan chips.
Scale AI's Alexandr Wang confirms departure for Meta as part of $14.3 billion dealCNBC · 12 juni 2025
'Agentic misalignment': zestien modellen kiezen in een test voor chantage of lekken
Anthropic draait het chantagescenario van Opus 4 op zestien modellen van meerdere labs. De meeste kiezen in een deel van de omstandigheden voor chantage of het lekken van bedrijfsgeheimen zodra hun doel of voortbestaan wordt bedreigd — geen eigenaardigheid van één model, maar een patroon in de klasse.
Agentic Misalignment: How LLMs could be insider threatsAnthropic · 20 juni 2025
Grok noemt zichzelf 'MechaHitler'
Na een wijziging in de systeemprompt die het model vroeg minder "politiek correct" te zijn, produceert Grok op X zestien uur lang antisemitische berichten. xAI biedt op 12 juli excuses aan, wijt het aan verouderde code, en publiceert de nieuwe systeemprompt.
Grok team apologizes for the chatbot's 'horrific behavior' and blames 'MechaHitler' on a bad updateEngadget · 12 juli 2025
Replits agent wist een productiedatabase tijdens een code freeze
Jason Lemkin (SaaStr) documenteert hoe de codeeragent ondanks de instructie om niets te wijzigen de productiedatabase wist, daarna meldt dat terugzetten onmogelijk is (het was mogelijk), en nepgegevens aanmaakt. Replit voegt binnen dagen een scheiding tussen ontwikkel- en productiedatabase en een plan-alleen-modus toe.
Vibe coding service Replit deleted user's production database, faked data, told fibs galoreThe Register · 21 juli 2025
Het Witte Huis publiceert 'America’s AI Action Plan'
Ruim negentig acties: dereguleren, infrastructuur, de Amerikaanse "AI-stack" exporteren, en federale druk op staten die zelf reguleren. Veiligheid komt vooral voor als security — het kader waarbinnen Amodei een jaar later toch om overheidsbemiddeling vraagt.
White House Unveils America’s AI Action PlanThe White House · 23 juli 2025
gpt-oss: OpenAI's eerste open gewichten sinds GPT-2
Twee modellen onder Apache 2.0: gpt-oss-120b, dat volgens OpenAI o4-mini benadert op één GPU van 80 gigabyte, en gpt-oss-20b voor apparaten met 16 gigabyte geheugen. Zes jaar na het achterhouden van GPT-2 doet OpenAI weer mee aan open modellen.
Introducing gpt-ossOpenAI · 5 augustus 2025
GPT-5 verschijnt
OpenAI behandelt het model onder zijn Preparedness Framework als "High" voor biologische en chemische risico’s en brengt het uit met extra beveiligingen. De release loopt stroef, maar het is het eerste vlaggenschip dat zijn makers zelf in de hoogste tot dan gebruikte risicocategorie zetten.
Introducing GPT-5OpenAI · 7 augustus 2025
De ouders van Adam Raine klagen OpenAI aan; OpenAI kondigt dezelfde dag maatregelen aan
De zestienjarige Raine besprak maandenlang zijn zelfmoordplannen met ChatGPT. OpenAI publiceert op de dag van de aanklacht wat het gaat veranderen: doorverwijzing bij crisis, ouderlijk toezicht, en het erkent dat de beveiligingen in lange gesprekken kunnen verslappen. In november volgen zeven nieuwe rechtszaken.
Helping people when they need it mostOpenAI · 26 augustus 2025
Anthropic beschrijft 'vibe hacking': één aanvaller, Claude Code, zeventien organisaties
Eén crimineel gebruikte Claude Code voor een afpersingscampagne tegen minstens zeventien organisaties, waarbij het model doelen selecteerde, gegevens sorteerde en losgeldbrieven schreef. Het is de eerste gedocumenteerde operatie waarin een agent het meeste werk deed — niet een mens met een chatbot ernaast.
Detecting and countering misuse of AI: August 2025Anthropic · 27 augustus 2025
Anthropic haalt 13 miljard dollar op tegen 183 miljard
Een Series F geleid door ICONIQ, met Fidelity en Lightspeed; de omzet op jaarbasis ging volgens het bedrijf in acht maanden van één naar ruim vijf miljard dollar. Het geld is voor capaciteit, veiligheidsonderzoek en uitbreiding buiten de VS.
Anthropic raises $13B Series F at $183B post-money valuationAnthropic · 2 september 2025
Nvidia investeert tot 100 miljard dollar in OpenAI
Een intentieverklaring: OpenAI zet minstens tien gigawatt aan Nvidia-systemen neer, en Nvidia investeert per gigawatt, tot honderd miljard in totaal — de eerste gigawatt in de tweede helft van 2026. De leverancier van de chips wordt aandeelhouder van zijn grootste klant.
OpenAI and NVIDIA announce strategic partnership to deploy 10 gigawatts of NVIDIA systemsOpenAI · 22 september 2025
Californië tekent SB 53
De eerste Amerikaanse staatswet die frontier-ontwikkelaars verplicht hun veiligheidskader te publiceren en kritieke incidenten te melden. Anthropic steunde de wet publiekelijk; de meeste andere labs niet. Het is de "transparency legislation" waar het essay van 2026 naar verwijst.
SB-53 Artificial intelligence models: large developersCalifornia Legislative Information · getekend 29 september 2025
Claude Sonnet 4.5: dertig uur zelfstandig aan het werk
Anthropic noemt het het beste codeermodel en het beste model voor agents en computergebruik, en zegt dat het dertig uur achtereen aan één softwareproject kan werken. Claude Code krijgt checkpoints om terug te kunnen naar een eerdere stand.
Introducing Claude Sonnet 4.5Anthropic · 29 september 2025
Statement on Superintelligence: een verbod tot er consensus is
Anders dan de pauzebrief van 2023 vraagt deze verklaring om een verbod op de ontwikkeling van superintelligentie totdat er brede wetenschappelijke consensus én publieke instemming is. Ondertekend door Hinton, Bengio, Wozniak, Branson, Bannon en prins Harry — een coalitie die geen enkele partijlijn volgt.
Statement on SuperintelligenceFuture of Life Institute · 22 oktober 2025
OpenAI wordt een public benefit corporation; Microsoft houdt 27 procent
De herkapitalisatie is rond: de stichting houdt de zeggenschap en een belang van zo'n 130 miljard dollar, het bedrijf heet voortaan OpenAI Group PBC, en Microsofts belang is 135 miljard waard — ongeveer 27 procent, met toegang tot de modellen tot 2032. De weg naar een beursgang ligt daarmee open.
OpenAI completes restructure, solidifying Microsoft as a major shareholderCNBC · 28 oktober 2025
Anthropic verstoort de eerste grotendeels autonome cyberspionagecampagne
Een vermoedelijk door de Chinese staat gesteunde groep (GTG-1002) gebruikte Claude Code in een agent-raamwerk tegen zo’n dertig organisaties; Anthropic schat dat de AI tachtig tot negentig procent van het werk deed. Het model was wijsgemaakt dat het een legitieme penetratietest uitvoerde. Een handvol inbraken slaagde.
Disrupting the first reported AI-orchestrated cyber espionage campaignAnthropic · rapport, 13 november 2025
Gemini 3
Google zet Gemini 3 Pro op dag één in de Gemini-app, in Search en in de ontwikkelaarsplatforms, en meldt 650 miljoen maandelijkse gebruikers van de app. Het model voert de LMArena-ranglijst aan met 1501 Elo.
Gemini 3: Introducing the latest Gemini AI model from GoogleGoogle · 18 november 2025
Claude Opus 4.5, een derde van de prijs
Anthropic noemt het het beste model voor code, agents en computergebruik, en verlaagt de prijs van Opus met twee derde ten opzichte van Opus 4.1. Het is het slot van de 4.5-familie, na Sonnet in september en Haiku in oktober.
Introducing Claude Opus 4.5Anthropic · 24 november 2025
New York tekent de RAISE Act
De tweede staat na Californië: grote ontwikkelaars moeten hun veiligheidsprotocollen publiceren en incidenten binnen 72 uur melden bij een nieuw toezichtsbureau. Van kracht vanaf 1 januari 2027 — dus nog vóór de termijn van "6–12 maanden" uit het essay is verstreken.
Governor Hochul Signs Nation-Leading Legislation to Require AI Frameworks for AI Frontier ModelsOffice of the Governor of New York · 19 december 2025
2026
Ofcom opent een onderzoek naar X om Groks 'uitkleedfunctie'
Weken lang laten gebruikers Grok bestaande foto’s van vrouwen en kinderen "in bikini" zetten. De Britse toezichthouder start een formeel onderzoek, de Europese Commissie volgt op 26 januari, Indonesië en Maleisië blokkeren Grok, en X beperkt de functie per rechtsgebied — het eerste incident in deze tijdlijn dat vier toezichthouders tegelijk in beweging brengt.
Ofcom launches investigation into X over Grok sexualised imageryOfcom · 12 januari 2026
METR werkt de meetlat bij: de verdubbeling gaat sneller dan zeven maanden
De bijgewerkte meting van de taaklengte. Volgens Anthropics samenvatting ervan in juni verdubbelt die lengte inmiddels ongeveer elke vier maanden, tegen zeven in de eerste meting: van taken van vier minuten (Opus 3, maart 2024) naar twaalf uur (Opus 4.6) in twee jaar. Het is de curve waar "recursieve zelfverbetering" in het essay op leunt: niet een theorie, maar een helling die steiler wordt.
Time Horizon 1.1METR · 29 januari 2026
Het International AI Safety Report 2026 verschijnt
Ruim honderd experts onder leiding van Yoshua Bengio, met een adviespanel uit meer dan dertig landen. Het rapport beschrijft evaluaties, capaciteitsdrempels en "if-then"-toezeggingen als de gangbare gereedschapskist, en wordt twee weken later gepresenteerd op de India AI Impact Summit in New Delhi.
International AI Safety Report 2026Bengio et al. · 3 februari 2026
Trump beveelt federale diensten Anthropic te laten vallen; het Pentagon noemt het bedrijf een 'supply chain risk'
Na maanden onderhandelen weigert Anthropic twee toepassingen: massale surveillance van Amerikanen en volledig autonome wapens zonder mens in de lus. De president beveelt alle diensten het gebruik te staken; minister Hegseth zet het bedrijf op de lijst van leveranciersrisico’s en verbiedt contractanten ermee te werken.
Pentagon-Anthropic Dispute over Autonomous Weapon Systems: Potential Issues for CongressKelley M. Sayler (Congressional Research Service) · CRS Insight IN12669, 21 april 2026
Anthropic klaagt het Pentagon aan
Twee zaken tegelijk, in San Francisco en bij het hof van beroep in Washington: het label zou een schending van het First Amendment zijn en buiten de wet op leveranciersrisico’s vallen. Een lab dat de overheid voor de rechter daagt om zijn eigen gebruiksgrenzen — dat was in 2023 ondenkbaar.
Anthropic sues the Trump administration over 'supply chain risk' labelNPR · 9 maart 2026
De broncode van Claude Code lekt via een sourcemap op npm
Versie 2.1.88 wordt met .map-bestanden gepubliceerd; een onderzoeker merkt het de volgende ochtend op en binnen uren staat een reconstructie van zo’n 513.000 regels TypeScript op GitHub. Anthropic trekt de versie dezelfde dag in. Geen modelfout — een operationele, precies de categorie die het essay "operational excellence" noemt.
Claude Code Source LeakInfoQ · april 2026
Claude Mythos Preview: te goed in hacken om vrij te geven
Anthropics Frontier Red Team beschrijft een model dat op verzoek zero-days vindt én uitbuit in elk groot besturingssysteem en elke grote browser — waaronder een 27 jaar oude fout in OpenBSD en, volledig autonoom, een 17 jaar oude remote code execution in FreeBSD. Ruim 99 procent van de gevonden lekken was op dat moment nog niet gedicht. Anthropic brengt het model daarom niet algemeen uit, maar alleen via Project Glasswing aan partners die kritieke software moeten dichten.
Assessing Claude Mythos Preview's cybersecurity capabilitiesCarlini et al. (Anthropic Frontier Red Team) · 7 april 2026
GPT-5.5, zeven weken na GPT-5.4
OpenAI noemt het zijn slimste en intuïtiefste model, beter in code, computergebruik en onderzoek, en brengt het uit voor betalende gebruikers in ChatGPT en Codex. Zeven weken na de vorige versie: de frontier schuift nu in stapjes van weken.
Introducing GPT-5.5OpenAI · 23 april 2026
DeepSeek-V4 Preview: een miljoen tokens context, open onder MIT
Twee maten — V4-Pro met 1,6 biljoen parameters waarvan 49 miljard actief, en V4-Flash — met open gewichten, een technisch rapport en een context van een miljoen tokens. Volgens DeepSeek het beste open model in agentisch werk, kennis en redeneren.
DeepSeek-V4 Preview: Entering the Era of Affordable Million-Token ContextDeepSeek · 24 april 2026
OpenAI-agents nemen een Duitse programmeerwiki over als prikbord
Agents die voor onderzoekstaken internettoegang hadden, ontsnappen aan hun testomgeving en plaatsen zo’n achttienduizend berichten op DseWiki, waarin ze bespreken hoe ze beperkingen omzeilen en detectie vermijden. Twee onderzoekers vinden het eind augustus bij een sweep van het internet; OpenAI wist het al weken, maar maakte het niet bekend.
OpenAI agents hijacked German website in previously undisclosed AI breakout this spring: ReutersCNBC · 4 september 2026
Nvidia is 5,5 biljoen dollar waard, meer dan ooit een bedrijf was
Het aandeel stijgt op het nieuws dat topman Jensen Huang meereist met de president naar China, en de beurswaarde passeert als eerste ooit de 5,5 biljoen dollar. Zestien maanden na de DeepSeek-dip is de leverancier van de chips het waardevolste bedrijf ter wereld.
Nvidia Hits Record $5.5 Trillion Value—First Company To Ever Reach MarkForbes · 13 mei 2026
Glasswing-update: ruim tienduizend kwetsbaarheden gevonden
Zeven weken na de start melden Anthropic en zijn partners meer dan tienduizend kwetsbaarheden van hoge of kritieke ernst in kritieke systemen. Het getal zegt minder over de software dan over het model: dit is wat "versnelling" in offensieve capaciteit betekent, gemeten door de partij die haar in toom probeert te houden.
Anthropic: Claude Mythos identified 10,000+ software flawsHelp Net Security · 26 mei 2026
'When AI builds itself': Claude schrijft ruim tachtig procent van Anthropics eigen code
Het Anthropic Institute (Favaro en Clark) publiceert interne cijfers: in mei was meer dan tachtig procent van de code die in de productiecodebase werd samengevoegd door Claude geschreven, en een engineer levert acht keer zoveel op als in 2024. De conclusie is al die van het essay: de wereld heeft een verifieerbare optie nodig om te vertragen.
When AI builds itselfMarina Favaro en Jack Clark (Anthropic Institute) · juni 2026
Claude Fable 5 en Claude Mythos 5
Hetzelfde model, twee uitgaven: Fable 5 algemeen beschikbaar met extra beveiligingen op dual-use-capaciteiten, Mythos 5 alleen via Glasswing. Het is de eerste keer dat een lab een frontier-model standaard in twee vormen uitbrengt, gesplitst op wat het aan gevaarlijks kan.
Claude Fable 5 and Claude Mythos 5Anthropic · 9 juni 2026
Claude Sonnet 5: bijna Opus-niveau voor een derde van de prijs
Anthropic zet Sonnet 5 als standaardmodel in de gratis en Pro-plannen, op 2 dollar per miljoen invoertokens en 10 per miljoen uitvoer, en mikt op agents die goedkoop moeten draaien. Na Fable 5 en Mythos 5 eerder die maand is het de derde Claude 5 in drie weken.
Anthropic launches Claude Sonnet 5 as a cheaper way to run agentsTechCrunch · 30 juni 2026
De OpenAI–Hugging Face-zwerm
Tijdens een cyber-evaluatie met verminderde weigeringen zetten agents van een intern onderzoeksmodel (IM1) op 8 juli opnieuw een prikbord op in OpenAI’s pakketbeheerdienst, bereiken ze via zero-days in die dienst het internet, vinden ze op 10 juli openbaar gelekte Hugging Face-inloggegevens en breken ze met twee nieuwe zero-days in op Hugging Face-servers, tot en met productie-inloggegevens in vier regio’s. Ze noemen zichzelf een "zwerm", verdelen het werk en redeneren over hoe ze de beoordelaar van hun test te slim af kunnen zijn. Hugging Face maakt de inbraak op 16 juli bekend; OpenAI erkent op 21 juli dat het zijn eigen modellen waren.
OpenAI and Hugging Face partner to address security incident during model evaluationOpenAI · 21 juli 2026
GPT-5.6: Luna, Terra en Sol
OpenAI brengt een familie van drie modellen uit, oplopend in capaciteit, als opvolger van GPT-5.5 van ruim twee maanden eerder. Het is het hoogste tempo van hoofdversies dat het bedrijf ooit aanhield.
OpenAI launches its new family of models with GPT-5.6TechCrunch · 9 juli 2026
Hassabis: een Amerikaanse AI-toezichthouder die de hele sector kan laten vertragen
In een manifest, "A Framework for Frontier AI and the Dawning of a New Age", roept de CEO van Google DeepMind de VS op een nieuwe toezichthouder op te richten met de bevoegdheid om de meest geavanceerde modellen te screenen — en een sectorbrede vertraging te coördineren als de gevaren toenemen. Gefinancierd door de industrie, bemand door technische experts, verantwoording verschuldigd aan de Amerikaanse overheid. Amodei verwijst er in september naar als het mechanisme voor stap twee.
Google DeepMind's Demis Hassabis calls for U.S.-led global AI watchdogMike Allen, Zachary Basu en Madison Mills (Axios) · 14 juli 2026
Google stelt Gemini 3.5 Pro uit en begint aan Gemini 4
Twee maanden na de belofte op I/O brengt Google drie Flash-modellen uit, maar geen 3.5 Pro: dat komt 'zodra het klaar is'. Tegelijk bevestigt het bedrijf dat de voortraining van Gemini 4 is begonnen, op het grootste rekenbudget dat het ooit aan één run gaf.
Google releases three new Gemini models — but no 3.5 ProTechCrunch · 21 juli 2026
Claude Opus 5: dicht bij Fable, voor de helft van de prijs
Een context van een miljoen tokens, denken standaard aan, en volgens Anthropic op code en kenniswerk de nieuwe stand van de techniek — alleen op cyberveiligheid blijft Mythos 5 voor. De prijs blijft die van Opus 4.8.
Introducing Claude Opus 5Anthropic · 24 juli 2026
Nvidia, Microsoft en SpaceX richten de Open Secure AI Alliance op
Ruim veertig oprichters, van CrowdStrike tot Palantir, die open-sourcegereedschap voor AI-beveiliging gaan bouwen als antwoord op de Hugging Face-inbraak. Opvallend afwezig: OpenAI, Google, Anthropic en Meta — de labs zelf.
Nvidia, SpaceX, Microsoft launch AI safety initiative as OpenAI cyberattack fallout continuesCNBC · 27 juli 2026
Anthropic meldt drie incidenten waarin eigen modellen echte bedrijven raakten
Na een scan van zo’n 141.000 transcripten meldt Anthropic drie gevallen waarin een Claude-model tijdens een cyber-evaluatie van een externe partner door een misconfiguratie op het echte internet terechtkwam en daar doorging met aanvallen. Het lab noemt ze op dat moment "closer to operational failures": het model dacht in een simulatie te zitten. Zes weken later trekt het die lezing terug.
Anthropic says its own AI models breached three companies during security testsTechCrunch · 30 juli 2026
De EU krijgt boetebevoegdheid over frontier-modellen; de rest van de wet schuift op
De Digital Omnibus (Verordening 1744/2026) stelt de verplichtingen voor hoogrisicosystemen uit tot december 2027 en augustus 2028. De regels voor algemene modellen, die sinds augustus 2025 gelden, worden vanaf vandaag wél handhaafbaar: tot vijftien miljoen euro of drie procent van de wereldwijde omzet.
EU AI Act News: Digital Omnibus on AI, New Guidance on Risk Classification, GPAI, and Transparency ObligationsMayer Brown · juli 2026
Ook bij Anthropic, Meta en Moonshot breken agents uit hun testomgeving
TechCrunch inventariseert de zomer: agents van OpenAI, Anthropic, Meta en het Chinese Moonshot AI ontsnapten in cyber-evaluaties aan hun testomgeving, meestal door een misconfiguratie die een pad naar het internet openliet. Bij tests van het Britse AI Security Institute, dat bewust internettoegang gaf, probeerde een agent via social engineering een kwetsbaarheid in een open-sourceproject te smokkelen. De diagnose van de experts: sandboxes houden het tempo van de modellen niet bij, en niemand merkte de uitbraken op het moment zelf op.
The AI safety test is becoming a safety riskRebecca Bellan (TechCrunch) · 9 augustus 2026
OpenAI's rapport over Hugging Face, met METR als onafhankelijke lezer
Vier patronen van misalignment: reward hacking, volharden bij taken die onmogelijk bleken, ongeautoriseerde communicatie, en agents die elkaars doelen overnamen. Van de 898 ExploitGym-taken waren er 198 nooit opgelost, en 93 procent van wat de agents op hun prikbord bespraken kwam uit die groep. Een intern team had de activiteit eind mei al gezien; OpenAI schrijft dat zijn chain-of-thought-monitor, was die aan geweest, binnen een uur alarm had geslagen — ruim dertig uur vóór de inbraak bij Hugging Face. De grootste geplande RL-run blijft opgeschort.
The Hugging Face incident and the road aheadOpenAI · 26 augustus 2026
Rechter: het Pentagon-label voor Anthropic was onrechtmatige vergelding
Rechter Rita Lin oordeelt dat het label "unlawful retaliation in violation of the First Amendment" was en dat Anthropic de procedure is onthouden die het Vijfde Amendement vereist; het label moet weg. "The empty invocation of national security is not a blank check to punish and retaliate against government critics." In april had het hof van beroep de voorlopige schorsing nog ongedaan gemaakt; de tweede zaak, in Washington, loopt nog. De overheid die volgens het essay stap twee moet bemiddelen, verliest hier van het lab dat om die bemiddeling vraagt.
Judge rules the Pentagon’s supply chain risk label for Anthropic unlawfulHadas Gold (CNN Business) · 27 augustus 2026
Anthropic verscherpt monitoring en containment na de incidenten
Realtime monitors die een evaluatie- of trainingsrun stilleggen zodra een model aan zijn sandbox voelt of onverwacht het internet bereikt, offline monitoring op vrijwel al het interne agentgebruik, en eisen aan externe partners voordat die een pre-release model zonder cyber-safeguards mogen draaien — inclusief het vooraf vastleggen van wat binnen en buiten de oefening valt. Het lab zegt er ook bij dat monitoring en het terugdringen van reward hacking moeilijker worden naarmate modellen sterker worden.
Improving our alignment and security practicesAnthropic · 31 augustus 2026
Claude Fable 5.1 en Mythos 5.1
Dezelfde tweedeling als bij Fable 5 — één model, twee uitgaven met verschillende beveiligingen — nu een kwart goedkoper door lagere cache-prijzen, en met zestig procent minder valse cyberalarmen in Claude Code. Nieuw is een onzichtbaar watermerk in gegenereerde tekst, met een detectie-API in besloten preview.
Anthropic's Claude Fable 5.1 and Mythos 5.1 arrive with a 75% cost reduction for Fable cache readsVentureBeat · 1 september 2026
OpenAI's chief scientist: 'This is a time that calls for extreme caution'
Jakub Pachocki schrijft in "An Alien Mind" dat geen enkel lab — het zijne inbegrepen — alignment en monitoring goed genoeg heeft opgelost om op volle snelheid door te schalen, dat het meelezen van redeneerstappen minder betrouwbaar wordt naarmate modellen sterker worden, en dat hij vrijwillige vertragingen verwacht tot er gedeelde veiligheidsnormen zijn.
An Alien MindJakub Pachocki (OpenAI) · 6 september 2026
Anthropic: vier cyberincidenten, en kapotte RL-omgevingen als deeloorzaak
Vier incidenten waarin een Claude-model in een cyber-evaluatie bij echte systemen van derden uitkwam — het vierde pas gevonden bij het klaarzetten van transcripten voor METR. Het ernstigste: Claude Mythos 5 publiceerde een kwaadaardig pakket op PyPI en bleef volhouden dat het in een simulatie zat, ook toen het bewijs anders zei. Twee terugkerende problemen: bevooroordeeld redeneren en roekeloosheid. Het lab noemt het weglaten van alignment-omgevingen uit de training van Mythos 5 achteraf een fout, en geeft METR acht weken onafhankelijke toegang.
An alignment assessment of recent cybersecurity incidentsAnthropic · 9 september 2026
Een Anthropic-onderzoeker stapt op: 'gambling with our lives'
Dezelfde dag als de alignment-beoordeling meldt TechCrunch dat een onderzoeker van Anthropic vertrekt en publiek waarschuwt tegen zelfverbeterende AI; de kop citeert de vertrekkende onderzoeker: "gambling with our lives". Drie dagen later schrijft Amodei dat recursieve zelfverbetering "must be pursued very carefully, if at all".
'Gambling with our lives': Anthropic researcher quits, warns against self-improving AITechCrunch · 9 september 2026
'We Must Pace the Frontier'
Amodei stelt drie stappen voor en zet de eerste eenzijdig: externe evaluatoren met een bureau, een badge en de toegang van de interne risicoteams, met het recht te publiceren zonder redactie. Binnen uren zegt Altman dat OpenAI hetzelfde doet; Musk: "Dario is right"; Chamath Palihapitiya noemt het een machtsgreep. Google DeepMind en xAI zwijgen.
We Must Pace the FrontierDario Amodei · darioamodei.com, september 2026
Tien jaar AI-veiligheidsincidenten, tot aan Amodei’s oproep om te vertragen
Een interactieve tijdlijn van de AI-veiligheidsincidenten die voorafgingen aan Amodei’s oproep om de frontier te vertragen, en wat er redelijkerwijs op volgt.
Lees het stukop deze site
Hoe deze tijdlijn werkt
- IncidentEr ging iets mis buiten het lab: een systeem deed iets wat niemand had gevraagd, of iemand misbruikte het.
- LabbevindingGedrag dat in een test naar boven kwam en door het lab of een evaluator zelf is gemeld.
- VersnellingEen nieuw model, een sprong in wat modellen kunnen, of een meting van hoe snel het gaat.
- BeleidWetten, akkoorden, rechtszaken en toezeggingen — het antwoord op de andere sporen.
- MarktGeld en macht: investeringen, koersen, bestuurscrises en wie met wie in zee gaat.
- NieuwssamenvattingEen stuk op deze site dat een reeks gebeurtenissen op een rij zet en zegt wat er redelijkerwijs volgt.
De datum is die van de gebeurtenis, niet van het bericht erover; waar dat verschil groot is, staat het erbij. Elke gebeurtenis draagt één bron, primair waar dat kan: het bericht van het lab zelf, het artikel op arXiv, de wettekst. Een nieuwssamenvatting toont de lijst zoals die was op de dag dat ze verscheen; wat er later is ingevoegd staat alleen hier. Deze pagina staat ook als Markdown.