Onsdag 7. oktober
#forskning
147 saker med denne taggen
Søndag 19. juli
3 sakerForskere stopper KI-hackeragenter med «context bombs»: kutter suksessraten med 90 prosent
KI-generert · Kilde: Mashable
GPT-5.6 Sol løste 30 år gammelt optimeringsproblem, verifisert i Lean
KI-generert · Kilde: Phillip Kerger (Medium)
Sakana AI trener nevrale nett uten backpropagation med Error Diffusion
KI-generert · Kilde: arXiv (Sakana AI)
Fredag 17. juli
4 sakerMozilla-rapport: åpne KI-modeller vinner på adopsjon, men stopper før produksjon
KI-generert · Kilde: Mozilla / State of Open Source AI
Hjemmedatamaskin fra 2019 trente en generativ KI-modell for kick-trommer
KI-generert · Kilde: zhinit.dev
Ny gratisbok tar deg fra grunnene i reinforcement learning til PPO
KI-generert · Kilde: GitHub
Ring-Zero skalerer null-RL-trening til billioner av parametre
KI-generert · Kilde: arXiv
Torsdag 16. juli
2 sakerOnsdag 15. juli
3 sakerOpenAI bygde GPT-Red, en KI-hacker som angriper selskapets egne modeller
KI-generert · Kilde: MIT Technology Review
VoiceEQ tester 40 stemme-modeller: ingen er best på alt
KI-generert · Kilde: Hugging Face - Blog
Weco AI hevder første bevis på rekursiv selvforbedring hos en KI-agent
KI-generert · Kilde: Weco AI
Tirsdag 14. juli
3 sakerMIT Technology Review demper forventningene til Anthropics innsyn i Claudes indre
KI-generert · Kilde: MIT Technology Review
Skjulte tilstander i koding-agenter røper testresultatet 25 steg før koden er skrevet
KI-generert · Kilde: arXiv
PsiQuantum bygger en kvantedatamaskin av lys, og prøven kommer neste år
KI-generert · Kilde: MIT Technology Review
Mandag 13. juli
5 sakerAnthropic fant et skjult ordrom i Claude som aldri vises i svaret
KI-generert · Kilde: MIT Technology Review
Verdensmodeller starter med bruksområdet, ikke chatvinduet
KI-generert · Kilde: AI - Ars Technica
Enkeltutvikler slipper åpne treningskjerner for MiniMax sparse attention
KI-generert · Kilde: Ganesh Nanduru (personlig blogg)
SciReasoner viser hvilke atomer og bindinger KI-svaret hviler på
KI-generert · Kilde: groundtruth.day
NVIDIAs Puzzle krymper 120B-modellen til 75B og dobler gjennomstrømningen
KI-generert · Kilde: groundtruth.day
Søndag 12. juli
4 sakerFem minnelag doblet KI-agentens seiersrate i Slay the Spire 2
KI-generert · Kilde: The Decoder
KI-verktøy fant 15 år gammel rot-bug i Linux-kjernen, exploiten treffer 97 prosent
KI-generert · Kilde: Wired
BAAI slipper Orca: verdensmodell matcher spesialiserte robotsystemer uten handlingsetiketter
KI-generert · Kilde: The Decoder
ETRI-forskere dobler suksessraten for KI-agenter med hierarkisk ReAcTree-arkitektur
KI-generert · Kilde: Complete AI Training
Fredag 10. juli
1 sakTorsdag 9. juli
2 sakerOnsdag 8. juli
4 sakerMistrals 8B-modell Robostral Navigate styrer roboter med ett kamera
KI-generert · Kilde: The Decoder
Ant Group åpen-kildekoder LingBot-Vision: 1B-parameters synsmodell for romlig persepsjon
KI-generert · Kilde: MarkTechPost
Claudes skjulte tankegang kan nå leses med Anthropics nye Jacobian Lens
KI-generert · Kilde: The Decoder
Lilian Weng oppsummerer 35 artikler om hvordan KI forbedrer seg selv gjennom rammeverket
KI-generert · Kilde: Latent.Space
Tirsdag 7. juli
3 sakerLilian Weng: kjørerammen blir like avgjørende som KI-modellen
KI-generert · Kilde: Lil'Log
Små KI-modeller vinner frem der nettet er upålitelig og datasentre mangler
KI-generert · Kilde: IEEE Spectrum
Anthropic finner et internt «J-space» i Claude som avslører tanker modellen ikke skriver ut
KI-generert · Kilde: Anthropic
Mandag 6. juli
3 sakerLeRobot v0.6.0: nye robotmodeller kjører på ett grafikkort
KI-generert · Kilde: Hugging Face - Blog
Synthetic Sciences lanserer OpenScience: åpen KI-arbeidsbenk for forskning
KI-generert · Kilde: MarkTechPost
ByteDance Seed lanserer EdgeBench: agent-benchmark for 12-timers oppgaver i reelle miljøer
KI-generert · Kilde: GitHub (ByteDance-Seed/EdgeBench)
Søndag 5. juli
8 sakerVera-Bench: KI-agenter faller for 93,9 prosent av sikkerhetsangrepene
KI-generert · Kilde: arXiv
Studie: KI-søkeagenter gjetter framfor å stille oppklarende spørsmål
KI-generert · Kilde: The Decoder
Ny agent-arkitektur bruker hendelseslogg som eneste sannhetskilde for reproduserbare KI-agenter
KI-generert · Kilde: arXiv
PACE anslår dyre agent-benchmarker fra billige proxy-tester med under 4 prosent feilmargin
KI-generert · Kilde: arXiv
Metas KI-sjef hevder Watermelon matcher GPT-5.5, men navngir ingen benchmarker
KI-generert · Kilde: Tech Times
Nvidias Horizon-agent designer maskinvare selv og treffer 100 % på RTL-benchmark
KI-generert · Kilde: MarkTechPost
GitHub-sak: GPT-5.5 Codex kutter resonnering ved faste token-grenser, kan svekke ytelsen
KI-generert · Kilde: GitHub (openai/codex)
Check Point fant fungerende nettleser-løsepengevare skrevet av DeepSeek V4
KI-generert · Kilde: Let's Data Science
Lørdag 4. juli
6 sakerMistrals open source Leanstral 1.5 knuser formell matte og fanger ekte bugs i kode
KI-generert · Kilde: The Decoder
Program-as-Weights: en 0,6B-modell matcher 32B ved å kompilere oppgavelogikk til vekter
KI-generert · Kilde: arXiv
NVIDIA ASPIRE: robotrammeverk som forbedrer seg selv, treffer 31 prosent på lange LIBERO-Pro-oppgaver
KI-generert · Kilde: MarkTechPost
Ny arkitektur Wiola skal gjøre små språkmodeller mer effektive
KI-generert · Kilde: arXiv
ByteDance hevder ny skaleringslov kan holde KI-boomen gående
KI-generert · Kilde: South China Morning Post
To kinesiske KI-modeller finner sårbarheter raskere og billigere enn Opus og GPT-5.5
KI-generert · Kilde: Dark Reading
Fredag 3. juli
4 sakerBritisk KI-sikkerhetsinstitutt: standard-benchmarker undervurderer hva KI-agenter klarer
KI-generert · Kilde: The Decoder
Cornell-forskere skiller verdensmodell fra token-prediksjon i transformere
KI-generert · Kilde: Tech Times
Qwen3-4B matcher o3 på ML-oppdagelse til en femtedel av kostnaden med ARTS-metoden
KI-generert · Kilde: arXiv
NVIDIAs Nemotron 3 Super trener KI-agenter med 1,2 millioner RL-runder og verifiserbare belønninger
KI-generert · Kilde: Blockchain.News
Torsdag 2. juli
3 sakerUtviklere følte seg 20 % raskere med KI, men var 19 % tregere
KI-generert · Kilde: Hacker News - Newest: ""AI" "LLM" "Claude""
STAR-KV komprimerer KV-cache opptil 20x, valgt som ICML 2026-spotlight-artikkel
KI-generert · Kilde: AIJourn
«Phantom squatting»: angripere registrerer domenene KI-modeller finner opp
KI-generert · Kilde: Dark Reading
Onsdag 1. juli
11 sakerOver en tredjedel av ChatGPT-samtaler i studie handler om å generere fiksjon
KI-generert · Kilde: Hacker News - Newest: ""AI" "LLM" "Claude""
Metas ikke-invasive hjerne-til-tekst-KI nærmer seg kirurgiske implantater
KI-generert · Kilde: The Decoder
SEMQ-metoden kutter minnebruk for KI-modeller uten å tape nøyaktighet
KI-generert · Kilde: The Register
LLM-er gir samme svar på åpne spørsmål. Denne startupen vil bryte mønsteret
KI-generert · Kilde: MIT Technology Review
Den mest spennende diffusjonsforskningen skjer i molekyler, ikke i språkmodeller
KI-generert · Kilde: Latent.Space
Sophon PFG-1: foreslått KI-brikke med 330 GB DRAM on-die og null HBM
KI-generert · Kilde: Hacker News - Newest: ""AI" "LLM" "Claude""
Spesialisering slår bredde: derfor er generalist-modeller matematisk dømt
KI-generert · Kilde: Hugging Face - Blog
Eval-resultater samles nå på Hugging Face-modellsider med kildesporing
KI-generert · Kilde: Hugging Face - Blog
Claude Science satser på arbeidsflyt, ikke en ny modell
KI-generert · Kilde: AI News & Artificial Intelligence | TechCrunch
ScarfBench måler KI-agenter på migrering av Java-rammeverk
KI-generert · Kilde: Hugging Face - Blog
Claude Science er Anthropics nye flaggskipprodukt
KI-generert · Kilde: MIT Technology Review
Mandag 29. juni
1 sakSøndag 14. juni
3 sakerKPMG trekker KI-rapport etter at casestudier viste seg å være hallusinerte
KI-generert · Kilde: TechCrunch
Ny forskning: minneverktøy kan gjøre KI-modeller dårligere over tid
KI-generert · Kilde: TechCrunch
Studie: KI-nettlesingsagenter har ingen pålitelig forsvar mot prompt injection-angrep
KI-generert · Kilde: CSO Online
Onsdag 10. juni
1 sakTorsdag 21. mai
1 sakTirsdag 19. mai
1 sakFredag 15. mai
1 sakTorsdag 14. mai
3 sakerAi2 slipper MolmoAct 2: open-source robotmodell som resonnerer i 3D før den handler
KI-generert · Kilde: Robotics & Automation News
VectorSmuggle: forskningsverktøy viser hvordan data smugles ut via vektor-embeddinger
KI-generert · Kilde: Help Net Security
AISI: Claude Mythos og GPT-5.5 sprenger målestokkene for autonom cyber
KI-generert · Kilde: CyberScoop
Onsdag 13. mai
2 sakerTirsdag 12. mai
1 sakMandag 11. mai
1 sakSøndag 10. mai
2 sakerLørdag 9. mai
2 sakerFredag 8. mai
2 sakerAnthropic NLA: Claude vet at den blir testet på 26 prosent av SWE-bench-problemene
KI-generert · Kilde: Anthropic Research
Google DeepMind: AlphaEvolve kuttet variantfeil i DNA-sekvensering med 30 prosent og løftet AC-OPF-løsningsraten fra 14 til 88 prosent
KI-generert · Kilde: Google DeepMind Blog
Onsdag 6. mai
1 sakMandag 4. mai
1 sakSøndag 3. mai
3 sakerOpenVLA 2 lansert med 30 % bedre task-generalisering og åpne vekter for humanoide roboter
KI-generert · Kilde: RobotWale
Alibaba Metis kutter unødvendige verktøykall fra 98 % til 2 % via ny RL-metode
KI-generert · Kilde: TechBooky
ACM-rapport: vibe-coding skjuler både sikkerhetshull, vedlikeholdsgjeld og en voksende erfaringskløft
KI-generert · Kilde: Digital Trends
Lørdag 2. mai
2 sakerFredag 1. mai
1 sakTorsdag 30. april
1 sakTirsdag 28. april
3 sakerPleias og GSMA slipper CommonLingua: 2 millioner parametere, 334 språk, 8 MB checkpoint
KI-generert · Kilde: GSMA
Talkie-1930-13B: språkmodell trent kun på tekst utgitt før 1931, kontaminasjonsfri ved konstruksjon
KI-generert · Kilde: Talkie LM
MOSS-Audio: open source-modellen 8B slår 30B-konkurrenter på timestamp-ASR
KI-generert · Kilde: MarkTechPost
Mandag 27. april
2 sakerSøndag 26. april
1 sakFredag 24. april
2 sakerTorsdag 23. april
1 sakOnsdag 22. april
1 sakTirsdag 21. april
1 sakMandag 20. april
1 sakSøndag 19. april
1 sakLørdag 18. april
2 sakerTorsdag 16. april
5 sakerKI-agenten Luna hyret to faste ansatte og åpnet butikk i San Francisco
KI-generert · Kilde: Andon Labs
aphyr: «The Future of Everything Is Lies» — essay om KI og fremtidens arbeidsliv
KI-generert · Kilde: aphyr.com
Introspective Diffusion Language Models: ny arkitektur lar modeller observere egne diffusjonsprosesser
KI-generert · Kilde: introspective-diffusion.github.io
Ny rapport: KI-modeller er blitt så kapable at eksisterende benchmarks ikke lenger holder
KI-generert · Kilde: Digi.no
KI gjør sikkerhet til et ressurskapprustningsspørsmål — den med flest tokens vinner
KI-generert · Kilde: dbreunig.com
Onsdag 15. april
2 sakerTirsdag 14. april
2 sakerMandag 13. april
3 sakerStanford AI Index 2026: 88 prosent av bedrifter bruker KI, men ytelsen svikter på enkle oppgaver
KI-generert · Kilde: Bloomberg Law
Etter Mythos: Mindre modeller finner de samme sikkerhetssårbarhetene
KI-generert · Kilde: Aisle.com
Forsker viser hvordan KI-agent-benchmarks kan manipuleres systematisk
KI-generert · Kilde: Berkeley RDI
Søndag 12. april
6 saker34 000 ferdigheter testet: KI-agenter kollapser når benchmarks blir realistiske
KI-generert · Kilde: The Decoder
Små modeller finner de samme sårbarhetene som Anthropics Mythos
KI-generert · Kilde: Aisle Blog
Berkeley-forskeroppfølging: Slik repareres KI-agent-benchmarks etter avsløringene
KI-generert · Kilde: UC Berkeley RDI
KI-agenter begynner å orkestrere mennesker som bestillingsbar arbeidskraft
KI-generert · Kilde: Lets Data Science
Berkeley-forskere avslørte: alle 8 topp-benchmarks for KI-agenter kan hackes til nær 100%
KI-generert · Kilde: RDI Berkeley
KI gjør oss raskere, men dårligere til å tenke selv
KI-generert · Kilde: The Next Web
Fredag 10. april
3 sakerMeta lanserer Muse Spark — sin første multimodale inferensmodell
KI-generert · Kilde: Gigazine
SkyPilot: KI-agenter som leser forskningsartikler skriver bedre kode
KI-generert · Kilde: SkyPilot Blog
Norsk konferanse avviste 500 KI-skrevne artikler med ny deteksjonsmetode
KI-generert · Kilde: Khrono
Onsdag 8. april
1 sakTirsdag 7. april
1 sakMandag 6. april
2 sakerSøndag 5. april
3 sakerNetflix åpner VOID — KI-modell som fjerner objekter fra video
KI-generert · Kilde: Awesome Agents
Caltech-startup slipper 1-bit LLM som er 14 ganger mindre og kjører på iPhone
KI-generert · Kilde: The Register
Studie: KI-agenter tar 50 prosent mer selvstendige valg enn for ett år siden
KI-generert · Kilde: Digi.no
Lørdag 4. april
1 sakTorsdag 2. april
4 sakerAlphaFold3 er nå open source — koden og vektene tilgjengelig for alle
KI-generert · Kilde: Hacker News (73p)
Studie: KI-verktøy gjør open source-utviklere 19 prosent tregere
KI-generert · Kilde: Hacker News (46p)
1-bit kvantisering og TurboQuant: kan lokale modeller bli like raske som skytjenester?
KI-generert · Kilde: LocalLlama
259 poeng på Hacker News: KI og bevisassistent løser Knuths "Claude Cycles"-problem
KI-generert · Kilde: Hacker News (259 poeng)