AI-nyheter 25. august 2026

AI-nyhetsoppsummering og quiz: 25. august 2026

Jalapeños første resultater viser bransjeledende hastighet og effektivitet innen AI-inferens

OpenAI publiserte de første ytelsesresultatene for Jalapeño, sin spesialtilpassede inferensbrikke. På GPT-OSS 120B står det at brikken leverte omtrent 1,9 ganger mer toppgjennomstrømning per kilowatt og rundt 1,7 ganger lavere ende-til-ende-forsinkelse enn sammenligningssystemet.

Gevinstene ble også overført til DeepSeek R1 og Kimi K2.5. OpenAI planlegger å distribuere Jalapeño i sin egen datainfrastruktur, mens andre- og tredjegenerasjonsdesign allerede er i gang ... så ja, OpenAI er i økende grad også i ferd med å bli et slags chipselskap. (OpenAI)

Claude Cowork husker endelig hva du fortalte appen i chatten

Anthropic forente Claudes minne på tvers av vanlig chat og Cowork. Informasjon lært under samtaler kan nå følge brukere inn i agentoppgaver, og dermed fjerne det mildt sagt irriterende ritualet med å forklare det samme prosjektet om og om igjen. 

Brukere kan inspisere, redigere og slette huskede emner, mens minner oppdateres mens samtaler fortsatt pågår. Funksjonen er aktivert som standard på tvers av Free-, Pro- og Max-abonnementene. (TechCrunch)

Google Cloud lanserer Gemini Enterprise for juridiske tjenester

Google Cloud avduket en spesialbygd Gemini Enterprise-pakke for advokater, som presser agentene utover generisk chat og inn i kontraktsgjennomgang, juridisk forskning, regulatorisk overvåking, personvernforespørsler og dokumentutarbeidelse.

Den inkluderer koblinger for plattformer som Harvey, iManage, Docusign, RelativityOne og Thomson Reuters, samtidig som den bevarer firmaenes eksisterende tilgangskontroller og etiske vegger. AI-agentenes landran har nådd den juridiske avdelingen ... forutsigbart, men fortsatt ganske raskt. (Google Cloud Press Corner)

Google Cloud lanserer Gemini Enterprise for finansielle tjenester

Google lanserte også et finansspesifikt Gemini Enterprise-tilbud, inkludert en administrert finansiell research-agent, mer enn 50 spesialiserte ferdigheter og 13 koblinger til finans- og markedsdatasystemer.

Plattformen retter seg mot arbeidsflyter som inkluderer kredittrisikovurdering, porteføljeovervåking, KYC-undersøkelser og markedsanalyser. CME Group og Deutsche Bank er blant organisasjonene som allerede er involvert – bedriftsagenter blir stadig mer spesialiserte, nesten som programvare i dress. (Google Cloud Press Corner)

NVIDIA lanserer Jetson Orin Nano 2 robotdatamaskin for å omdefinere Edge AI på inngangsnivå

Nvidia introduserte Jetson Orin Nano 2, en kompakt datamaskin beregnet på roboter, droner og andre fysiske AI-systemer. Den tilbyr 78 billioner operasjoner per sekund, 8 GB minne og en åttekjerners Arm-CPU. 

Nvidia sier at ytelsen ved slutninger dobles sammenlignet med den forrige Nano Super, mens det å matche ytelsen kan kreve 40 % mindre strøm. Det interessante her er at mindre modeller virkelig kan håndtere kompakt maskinvare – AI-en trenger ikke alltid å ringe til det gigantiske datasenteret lenger. (NVIDIA Newsroom)

Perplexity samarbeider med Nvidia for å lansere Portable Computer, en fullstendig lokal AI-agent uten tokenkostnader

Perplexity lanserte Portable Computer, og bragte sin agentiske datamaskinopplevelse over på Nvidia-drevet lokal maskinvare. Modeller, filer og agentkjøring kan forbli på brukerens maskin, og lokalt utført arbeid bruker ingen skyfaktureringskreditter.

Oppgaver starter lokalt, og systemet ber om tillatelse før det går videre til en skymodell i frontlinjen. Det lanseres rundt Nvidia DGX Spark og Linux-systemer med tilstrekkelig kraftige RTX GPU-er – personvern og kostnader blir plutselig en del av den lokale AI-salgspresentasjonen, ikke bare hastighet. (Venturebeat)

Anthropic forventes å fortelle investorer at de ser over 30 billioner dollar i potensielle inntekter, rapporterer WSJ

Anthropic forbereder seg angivelig på å fortelle investorer at det totale adresserbare markedet kan overstige 30 billioner dollar. Viktig forskjell – det er den teoretiske årlige muligheten hvis AI fanget opp det relevante arbeidet, ikke Anthropic som spår at de vil fortsette å tjene 30 billioner dollar. (Reuters)

Det enorme tallet bidrar til å ramme inn Anthropics infrastrukturutgifter, konkurransen med OpenAI og Google, og den bredere investorhistorien. Det er et spektakulært stort tall ... selv etter AI-bransjens standarder. (Reuters)

Vanlige spørsmål

Hva betyr OpenAIs Jalapeño-brikkeresultater for AI-inferens?

OpenAI sier at Jalapeño leverte høyere toppgjennomstrømning per kilowatt og lavere ende-til-ende-forsinkelse enn sammenligningssystemet mens det kjørte GPT-OSS 120B. Lignende forbedringer ble rapportert med DeepSeek R1 og Kimi K2.5. Resultatene tyder på at OpenAI i økende grad designer maskinvare rundt de spesifikke effektivitets- og hastighetskravene til storskala AI-inferens.

Hvordan fungerer Claudes delte minne på tvers av chat og Cowork?

Claude kan nå overføre informasjon lært i vanlige samtaler til Cowork-oppgaver, noe som reduserer behovet for å forklare det samme prosjektet eller konteksten gjentatte ganger. Brukere kan inspisere, redigere og slette huskede emner, mens disse minnene kan fortsette å oppdateres etter hvert som samtalene utvikler seg. I følge kunngjøringen i artikkelen er funksjonen aktivert som standard på tvers av Free-, Pro- og Max-abonnementene.

Hva kan Gemini Enterprise for juridiske og finansielle tjenester gjøre?

Google Clouds spesialiserte Gemini Enterprise-tilbud er rettet mot bransjespesifikke arbeidsflyter snarere enn generisk AI-chat. Den juridiske pakken dekker områder som kontraktsgjennomgang, research, regulatorisk overvåking, personvernforespørsler og utarbeiding, mens versjonen for finansielle tjenester støtter arbeidsflyter som kredittrisikovurdering, porteføljeovervåking, KYC-research og markedsanalyse. Begge kan også kobles til eksisterende profesjonelle data- og programvaresystemer.

Hvorfor blir lokal AI-inferens viktigere?

Lokal AI-inferens kan styrke personvernet, redusere avhengigheten av skyinfrastruktur og potensielt senke løpende brukskostnader. Nvidias Jetson Orin Nano 2 retter seg mot roboter, droner og andre kantsystemer, mens Perplexitys bærbare datamaskin lagrer modeller, filer og agentkjøring på kompatibel lokal maskinvare. I mange arbeidsflyter kan skymodeller deretter reserveres for oppgaver som krever ekstra kapasitet.

Hvordan bestemmer Perplexity Portable Computer når den skal bruke skybasert AI?

Oppgaver er utformet for å starte på brukerens lokale Nvidia-drevne maskinvare, slik at kompatibel modellutførelse og filer holdes på maskinen. Hvis et trinn krever en frontier-skymodell, ber systemet brukeren om tillatelse før det eskaleres. Arbeid som utføres lokalt bruker ikke skyfaktureringskreditter, noe som gjør tilnærmingen relevant for brukere som er bekymret for både personvern og tilbakevendende inferenskostnader.

Hva betyr Anthropics rapporterte estimat av AI-markedet på 30 billioner dollar?

Det rapporterte tallet refererer til Anthropics syn på det potensielle totale adresserbare markedet for AI, ikke en spådom om at Anthropic selv vil generere 30 billioner dollar i årlig omsetning. Det representerer den teoretiske verdien av arbeid som AI potensielt kan adressere på tvers av økonomien. Anslaget bidrar også til å forklare hvorfor ledende AI-selskaper investerer så mye i infrastruktur og bedriftskapasitet.

Gårsdagens AI-nyheter: 24. august 2026

Finn den nyeste AI-en i den offisielle AI-assistentbutikken

Om oss

AI-nyheter og bransjeutviklingsquiz
1. Hvilke ytelsesforbedringer rapporterte OpenAI for sin tilpassede Jalapeño-inferensbrikke som kjører GPT-OSS 120B?

2. Hvordan har Anthropic oppdatert Claudes minnefunksjonalitet på tvers av vanlig chat og Cowork?

3. Hva er de viktigste spesifikasjonene og ytelseshøydepunktene til NVIDIAs Jetson Orin Nano 2?

4. Hvordan håndterer Perplexitys bærbare datamaskin hybrid lokal og skybasert utførelse?

5. Hva betyr egentlig Anthropics rapporterte tall på 30 billioner dollar?


Tilbake til bloggen