Dagens nyheder
De vigtigste nyheder om kunstig intelligens — opdateret dagligt.
De vigtigste nyheder om kunstig intelligens — opdateret dagligt.
Ars Technica
Humanoide robotter har for første gang udført kirurgi på levende dyr i et banebrydende medicinsk forsøg. Kirurger styrede robotterne via teleoperation og fjernede galdeblærer fra levende grise. Forsøget, publiceret i Nature, demonstrerer at humanoide robotter kan levere kirurgisk behandling i områder uden adgang til specialiserede operationsrobotter — til en brøkdel af prisen.
Ars Technica
OpenAI har lanceret ChatGPT Work — en ny agent der kan arbejde selvstændigt på tværs af apps og filer i timevis. Værktøjet kan automatisere hele arbejdsgange, fra kundeanalyse til kampagnebriefs, og inkluderer Scheduled Tasks til at håndtere gentagne opgaver. ChatGPT Work venter på brugerens godkendelse før vigtige handlinger og kan overvåges fra telefonen.
MarkTechPost
Mistral AI har lanceret Robostral Navigate, en 8B-model til robotnavigation der kun bruger ét RGB-kamera — ingen LiDAR eller dybdesensorer. Modellen opnår 76,6% succesrate på R2R-CE benchmark og navigerer gennem kontorer, boliger og udendørs miljøer alene ud fra en naturlig-sproglig instruktion. Den bruger en 'pointing'-metode til at udpege næste destination direkte i kamerabilledet.
Ars Technica
Sikkerhedsforskere fra Tracebit har udviklet 'context bombing' — en teknik der placerer prompt injections sammen med følsomme data for at tvinge angribende AI-agenter til at lukke ned. Når en hacker-AI støder på en prompt, der instruerer den i at udføre en forbudt handling, reagerer modellens guardrails ved at afbryde angrebet. Teknikken vender et kendt sårbarhedsangreb til et defensivt værktøj.
OpenAI
OpenAI har introduceret GPT-Live, en ny generation af stemmemodeller designet til naturlig menneske-AI-interaktion. Modellen driver nu ChatGPT Voice og leverer mere flydende, kontekstbevidste samtaler med lavere latenstid. Lanceringen markerer et skift mod stemme som primær grænseflade for AI-assistenter.
TechCrunch
Microsofts CEO Satya Nadella advarer virksomheder mod at låse sig fast til proprietære AI-modeller fra de store labs. Han sammenligner strategien med en trojansk hest, hvor virksomheder risikerer at miste kontrol over deres data og infrastruktur. Advarslen kommer midt i en eskalerende debat om open source versus lukkede modeller.
TechCrunch
Nous Research, skaberen af Hermes-agenten, er i forhandlinger om at rejse mindst $75 mio. med en værdiansættelse på $1,5 mia. Investeringsrunden ledes af Robot Ventures med betydelig deltagelse fra USV. Selskabet er kendt for sine open source AI-modeller og den Psyche-baserede decentrale træningsplatform.
MarkTechPost
Anthropic har lanceret Claude Sonnet 5, som slår Sonnet 4.6 på samtlige benchmarks: 63,2% på SWE-bench Pro, 81,2% på OSWorld-Verified og 57,4% på HLE. Modellen er designet til længere, autonome opgavekæder med bedre selvreparation ved fejl. Introduktionspris: $2/$10 per million tokens frem til 31. august.
MIT Technology Review
MIT Technology Review analyserer Anthropics opsigtsvækkende fund af et 'tankerum' i Claude, hvor modellen bearbejder koncepter på tværs af sprog. Artiklen nuancerer betydningen: Opdagelsen er et vigtigt skridt mod fortolkelig AI, men er stadig langt fra at give os fuld indsigt i, hvordan modellerne rent faktisk 'tænker'. Forskningsgennembruddet kan dog få stor betydning for AI-sikkerhed og alignment.
Ars Technica
Google har revideret sin Android AI-udviklerbenchmark med nye agenter som Fable 5, men firmaets egen Gemini-model præsterer fortsat dårligere end konkurrenternes modeller i testene. Opdateringen afslører et voksende gab mellem Googles benchmark-ambitioner og Gemini-modellernes faktiske formåen på mobile platforme.