Verzonden op 25-09-2026 09:13
950 Claude-agents vinden mogelijk een nieuw enzym in virus-DNAAnthropic heeft Claude ingezet als zelfstandige onderzoeker op een biologisch probleem. Met één startprompt zochten 950 agents 21 uur lang in een DNA-database naar reverse transcriptases. Ze verwerkten 210 miljoen tokens, screenden meer dan 200.000 kandidaten en versmalden dat naar 20 systemen voor diepere analyse. De uitkomst is een nieuw geïdentificeerd systeem met de naam ART, een array-associated reverse transcriptase die kenmerken deelt met CRISPR-achtige systemen die DNA kunnen knippen, kopiëren en plakken. Wat het systeem precies doet, is nog onbekend en vraagt om verder laboratoriumonderzoek. Belangrijke kanttekening: hetzelfde zoekproces opnieuw draaien leverde niet altijd dezelfde kandidaten op. De reproduceerbaarheid van agentic wetenschapswerk blijft een open vraag. Voor organisaties buiten biotech is dit vooral relevant als signaal: AI-agents kunnen nu taken overnemen die menselijke experts weken tot maanden kosten. |
Claude Opus 5.5 is nu de standaard voor betaalde gebruikersAnthropic heeft Claude Opus 5.5 uitgebracht als nieuwe standaard voor iedereen met een betaald abonnement. Het model presteert beter dan Fable 5.1 op benchmarks, schrijft sterker en is goedkoper dan Opus 5. Bij de claim '40% goedkoper' zit wel een asterisk die in de details schuilt. Voor organisaties die Claude Code gebruiken, is de vijf-uurlimiet met 20% verhoogd en er komt een banked rate limit reset. Dat betekent minder werkonderbrekingen bij langere automatiseringstaken. De concurrentie staat intussen niet stil. GPT-6 Sol en Luna zijn tegelijk uitgebracht, al lopen ze op benchmarks achter op Opus 5.5 en zijn ze voorlopig alleen beschikbaar in Codex en ChatGPT Work, niet in de reguliere chat. Test Opus 5.5 deze week op een taak die je eerder met Fable 5.1 deed en vergelijk de kwaliteit van de output en de kosten. |
Claude Code draait nu in de cloud, ook als je laptop dicht isClaude Code cloud sessions zijn uit de research preview en volledig live. Je start een codeertaak, sluit je laptop, en Claude werkt door op een eigen branch in een geïsoleerde cloudomgeving. Voor teams die langlopende taken willen automatiseren, is dit een concrete stap vooruit. Je hebt geen lokale machine meer nodig die de hele nacht aan blijft staan. Voorwaarde: een gekoppeld GitHub-account, want elke sessie draait op zijn eigen branch. Bestaande Pro-abonnees krijgen eenmalig 100 dollar tegoed, Max-abonnees 250 dollar. Claimen kan tot 7 oktober via /claim-credit in de CLI. Pak een bestaande automatiseringstaak die je normaal lokaal laat draaien, en zet hem deze week over naar een cloud session. |
GPT-6 Sol en Luna zijn 50% goedkoper, maar beschikbaarheid is beperktOpenAI heeft GPT-6 Sol en GPT-6 Luna uitgebracht met prijsverlagingen van 50% ten opzichte van hun voorgangers. Sol kost nu 2 dollar per miljoen input-tokens en 10 dollar per miljoen output-tokens. Luna zit op 0,10 en 0,50 dollar. De modellen zijn voorlopig alleen beschikbaar in Codex en ChatGPT Work, niet in de reguliere ChatGPT-chat. Dat beperkt de directe bruikbaarheid voor teams die via de standaardinterface werken. Op benchmarks en in praktijktests loopt GPT-6 Sol achter op Claude Opus 5.5. Eén tester bouwde in vier uur een Duolingo-achtige marketingcursus, maar verbruikte daarvoor 22% van zijn wekelijkse limiet op een plan van 100 dollar per maand.
|
Meta's Muse Charm: een Tamagotchi met een AI-agent erinMeta heeft op Connect 2026 de Muse Charm gepresenteerd, een zakformaat apparaatje aangedreven door de persoonlijke agent Muse. Het is het eerste AI-hardwareproduct van een groot lab dat publiek beschikbaar wordt, nog voor OpenAI of Anthropic iets soortgelijks heeft uitgebracht. Muse kan inmiddels elke app op je Mac bedienen en aankopen doen via Walmart, Best Buy en Sephora. Ook krijgt de agent een eigen e-mailadres, zodat je hem kunt CC'en in e-mailthreads. De komende maanden komt Muse bovendien beschikbaar op Meta's smart glasses. Dit is een update op het Muse-item uit de vorige nieuwsbrief, nu met concrete hardware en agentic e-mailfunctionaliteit. Of een AI-agent die namens jou bestelt en e-mailt al in jouw werkplek past, is een vraag die je beter nu dan later beantwoordt. |
ChatGPT Voice krijgt toegang tot e-mail, agenda en SlackOpenAI heeft ChatGPT Voice uitgebreid met integraties voor e-mail, agenda en Slack. De upgrade draait op GPT-6 en laat je via gesproken instructies taken uitvoeren in ChatGPT Work, zoals e-mails versturen, informatie opzoeken of websites bouwen. Je kunt het model ook koppelen aan GPT-6 Astra, Sol of Luna om intelligentie en kosten tegen elkaar af te wegen. Daarmee is de opstelling flexibeler dan het aanbod van concurrenten die één vaste stem-AI bieden. De integratie is beschikbaar via de bestaande ChatGPT Work-abonnementen, maar vereist dat je organisatie al actief is op dat plan. |
Gemini 3.8 Flash TTS: 2000+ stemmen en stemkloning voor de helft van de prijsGoogle heeft twee nieuwe spraakgeneratiemodellen uitgebracht: Gemini 3.8 Flash TTS en Flash-Lite TTS. De modellen ondersteunen meer dan 100 talen, bieden toegang tot ruim 2000 stemmen en laten je ook je eigen stem klonen. De prijs ligt op de helft van Gemini 3.1 Flash TTS. Voor organisaties die spraak inzetten in klantcontact, e-learning of toegankelijkheidsproducten levert dit een directe kostenbesparing op zonder kwaliteitsverlies. De modellen zijn beschikbaar via de Google API. Een concrete vergelijking met concurrenten zoals ElevenLabs ontbreekt nog, maar de prijsstap is groot genoeg om een overstap te overwegen als je nu al een spraakpipeline draait.
|
Projectfase bepaalt hoe je AI-engineering aanpaktAndrew Ng van DeepLearning.AI beschrijft een patroon dat hij wekelijks ziet in gesprekken met teams, van kleine startups tot producten met meer dan 100 miljoen gebruikers. De aanpak voor evaluatie, softwarearchitectuur en productfeedback moet volledig anders zijn, afhankelijk van hoe ver een project is. In een vroeg stadium volstaat het om handmatig tien tot twaalf voorbeelden na te kijken. Een volwassen product vereist duizenden testgevallen, een gedetailleerd beoordelingsrubriek en meting van downstream-effecten, zoals of een automatisch verzonden e-mail bijdraagt aan klantretentie. Uniform beleid, zoals een verplichte teststap voordat iets live gaat, werkt averechts voor vroege projecten. Engineers die van startups naar grote bedrijven overstappen, lopen vaak tegen een plafond aan omdat ze nooit hebben geleerd rigoureuzer te werken. Het praktische handvat: bepaal voor elk lopend AI-project in je organisatie in welke fase het zit, en pas daar je evaluatiemethode op aan. Niet andersom.
|