· Udgave 18 Spørg Envoyen Sammenlign Powered by Data-Envoy.com
Kategori

Video

Video- og multimodal AI, samt AI-genereret video-indhold.

Lyt til artiklen 0:00 / --:-- Kunstig stemme — NewsEnvoy TTS
VIDEO · 08:20

LiveAnimate muliggør real-time streaming af menneskeanimation i milliard-skala

Ny 14B-parameter model opnår 19,63 FPS og stabil langtidsgenerering — et spring for live- og avatarapplikationer

News Envoy-resumé

Forskere har præsenteret [LiveAnimate](https://huggingface.co/papers/2608.11745), et system der for første gang kombinerer real-time streaming med stabil langtidsgenerering af menneskeanimation i milliard-skala. Modellen

Flere historier

Seneste i Video

Ny benchmark afslører: Videomodeller kan endnu ikke omsætte menneskelige demonstrationer til robottræning H2R-Bench tester 11 modeller og viser, at broen mellem menneske og robot stadig er et uløst problem 1 KILDER I dag 08:24 UniSwap: Ét fælles AI-system til at bytte både udseende og stemme i videoer – nu i realtid Ny metode samler ansigt- og stemmeudskiftning i ét transformer-netværk og muliggør streaming i realtid 1 KILDER I dag 08:19 Fælles matematisk ramme for AI-generering kan gøre billed- og videogenerering markant billigere Ny forskning forener flow-, diffusions- og GAN-modeller og viser en korrektion, der reducerer fejl fra 53 % til 1,6 % uden ekstra beregning. 1 KILDER I dag 08:03 Google Sheets får AI-drevet canvas: Fra regneark til interaktive dashboards Ny funktion visualiserer data direkte i regnearket – og signalerer AI-integration i eksisterende arbejdsgange. 1 KILDER I dag 03:29 Gemini 3.7 Flash løfter kodning og agenter markant – til en pris der ændrer regnestykket Opgraderingen koster $0,75 per 1M tokens og løfter kodning og dokument-workflows – men kun i API og enterprise. 1 KILDER I går 18:43 AVA-Encoder: Ny metode lader AI-agenter lære af film og redigere video som data Forskere præsenterer rammeværk, der omdanner video til struktureret viden og forbedrer agenters filmiske output markant. 1 KILDER I går 11:20 MBA-Bench: Nyt benchmark sætter standarden for multimodale AI-agenter i forretningsudvikling Forskere fra Hugging Face introducerer det første multimodale benchmark, der gør AI i stand til at bruge visuel information i forretningsidéer – en konkurrencep 1 KILDER I går 11:15 Ny metode fjerner refleksioner i video – styrker computer vision i overvågning og trafik Diffusionsbaseret model og nyt benchmark løser et hidtil overset problem og kan gøre videoanalyse mere pålidelig. 1 KILDER I går 11:10 Tv-nyheder kan træne tegnsprogs-AI uden dyre manuelle annotationer Ny metode med svag supervision fra broadcast-data løfter genkendelse markant og kan gøre teknologien tilgængelig for sprog med få ressourcer 1 KILDER I går 09:26 Dyna-2: Verdensmodel trænet på 1 million timers menneskevideo viser vejen mod generel robotintelligens Skala-lov overføres til robotdata og video-co-træning muliggør kryds-embodiment generalisering – et strategisk vendepunkt for automation 2 KILDER I går 08:01