Kategori
Video
Video- og multimodal AI, samt AI-genereret video-indhold.
Lyt til artiklen
0:00 / --:--
Kunstig stemme — NewsEnvoy TTS
VIDEO · 08:20
LiveAnimate muliggør real-time streaming af menneskeanimation i milliard-skala
Ny 14B-parameter model opnår 19,63 FPS og stabil langtidsgenerering — et spring for live- og avatarapplikationer
News Envoy-resumé
Forskere har præsenteret [LiveAnimate](https://huggingface.co/papers/2608.11745), et system der for første gang kombinerer real-time streaming med stabil langtidsgenerering af menneskeanimation i milliard-skala. Modellen
Flere historier
VIDEO
Metas Glimmer: åben model udfordrer AI-giganternes lukkede økosystemer
Med Glimmer sætter Meta handling bag Zuckenbergs 'AI for alle'-retorik – og presser konkurrenterne på åbenhed.
VIDEO
Ny metode fjerner støj i AI-genereret 3D uden at genoptræne modellen
PixSDS løser latent SDS-fejltilstand, der skaber farveartefakter i tekst-til-3D-generering
VIDEO
PlayWorld benchmark: Verdensmodeller fejler stadig på langvarige interaktive opgaver
Nyt benchmark med 171 scenarier afslører svagheder i rumlig konsistens og tilstandsudvikling — vigtigt for investeringer i simulering og robotstyring
VIDEO
DreamX-Phi 1.0 sætter ny standard for pålidelig robotmanipulation med video-forudsigelse
Verdensmodel vinder WorldArena 2.0 og kan gøre robotter mere præcise i komplekse opgaver
Seneste i Video
Ny benchmark afslører: Videomodeller kan endnu ikke omsætte menneskelige demonstrationer til robottræning
H2R-Bench tester 11 modeller og viser, at broen mellem menneske og robot stadig er et uløst problem
UniSwap: Ét fælles AI-system til at bytte både udseende og stemme i videoer – nu i realtid
Ny metode samler ansigt- og stemmeudskiftning i ét transformer-netværk og muliggør streaming i realtid
Fælles matematisk ramme for AI-generering kan gøre billed- og videogenerering markant billigere
Ny forskning forener flow-, diffusions- og GAN-modeller og viser en korrektion, der reducerer fejl fra 53 % til 1,6 % uden ekstra beregning.
Google Sheets får AI-drevet canvas: Fra regneark til interaktive dashboards
Ny funktion visualiserer data direkte i regnearket – og signalerer AI-integration i eksisterende arbejdsgange.
Gemini 3.7 Flash løfter kodning og agenter markant – til en pris der ændrer regnestykket
Opgraderingen koster $0,75 per 1M tokens og løfter kodning og dokument-workflows – men kun i API og enterprise.
AVA-Encoder: Ny metode lader AI-agenter lære af film og redigere video som data
Forskere præsenterer rammeværk, der omdanner video til struktureret viden og forbedrer agenters filmiske output markant.
MBA-Bench: Nyt benchmark sætter standarden for multimodale AI-agenter i forretningsudvikling
Forskere fra Hugging Face introducerer det første multimodale benchmark, der gør AI i stand til at bruge visuel information i forretningsidéer – en konkurrencep
Ny metode fjerner refleksioner i video – styrker computer vision i overvågning og trafik
Diffusionsbaseret model og nyt benchmark løser et hidtil overset problem og kan gøre videoanalyse mere pålidelig.
Tv-nyheder kan træne tegnsprogs-AI uden dyre manuelle annotationer
Ny metode med svag supervision fra broadcast-data løfter genkendelse markant og kan gøre teknologien tilgængelig for sprog med få ressourcer
Dyna-2: Verdensmodel trænet på 1 million timers menneskevideo viser vejen mod generel robotintelligens
Skala-lov overføres til robotdata og video-co-træning muliggør kryds-embodiment generalisering – et strategisk vendepunkt for automation