← Till startsidan
AI-NYTT 2026-07-11

AI-nytt, 11 juli: oberoende tester visar jämnt lopp mellan GPT-5.6 och Grok 4.5, medan Washington överväger en federal AI-lag

GPT-5.6 mot Grok 4.5: tester visar ett nästan jämnt lopp. Nu när både OpenAIs GPT-5.6 och xAI:s Grok 4.5 är fullt tillgängliga för allmänheten rapporterar oberoende utvärderare, bland annat topplistan Chatbot Arena, att de två modellerna växlar om förstaplatsen inom olika kategorier av uppgifter. GPT-5.6 ligger något före inom kodning, medan Grok 4.5 slår konkurrenterna när det gäller sökning i realtidsinformation. Analytiker sa till Reuters att skillnaden mellan de främsta AI-labben "aldrig har varit så liten", vilket ökar pressen på priser snarare än på ren kapacitet.

Vita huset signalerar en federal AI-lag som ska överstyra delstaternas regler. Efter att Illinois denna vecka skrev under sin Artificial Intelligence Safety Measures Act sa en tjänsteman vid Vita huset till Axios att administrationen förbereder ett förslag om en enhetlig, federal AI-säkerhetsstandard avsedd att överskugga det växande lapptäcket av delstatslagar i Kalifornien, New York och Illinois. Branschorganisationer som företräder OpenAI, Anthropic och Google välkomnade idén, medan delstatliga justitieministrar och flera konsumentgrupper varnade för att federal överstyrning kan försvaga skydd som redan gäller.

AI-styrningssamtalen i Genève avslutas med en frivillig "färdplan", inte bindande regler. FN:s Global Dialogue on AI Governance avslutades i Genève där delegaterna enades om en icke-bindande färdplan för att dela information om farliga AI-incidenter över gränserna, enligt UN News. Panelens medordförande Yoshua Bengio välkomnade steget men sa att det "inte räcker" jämfört med den bindande tillsyn panelen efterfrågat tidigare i veckan, och varnade för att frivillig rapportering historiskt fungerat dåligt bland snabbrörliga AI-utvecklare.

Anthropic lägger till ett "konstitutionellt" säkerhetslager i Claude inför en möjlig börsnotering. Anthropic presenterade ett nytt säkerhetsramverk för sina Claude-modeller och publicerade en utökad "konstitution" som styr hur modellerna ska avvisa skadliga förfrågningar, samtidigt som bolaget enligt uppgift förbereder handlingar för en börsnotering. Beskedet kommer efter tidigare rapporter om att Anthropic gått om OpenAI i värdering på andrahandsmarknaden och i årsomsättning.

Nvidia svarar på DeepSeeks chipsatsning med ett eget billigare inferens-chip. Nvidia skyndar på utvecklingen av ett billigare chip inriktat på inferens för datacenterkunder, rapporterade Bloomberg, som ett direkt svar på nyheten tidigare i veckan om att det kinesiska bolaget DeepSeek bygger egen hårdvara för att köra, snarare än träna, AI-modeller. Utvecklingen visar hur konkurrensen inom AI breddas från modellkvalitet till de chip som driver modellerna i vardagen.