Siste artikler
-
AI-modeller og plattformer 11. oktober 2024SHOW-O: En transformer som forener multimodal forståelse og generering
Signifikante fremgang i store språkmodeller (LLM) har inspirert utviklingen av multimodale store språkmodeller (MLLM). Tidlige MLLM-forsøk, som LLaVA, MiniGPT-4 og InstructBLIP, demonstrerer bemerkelsesverdige multimodale forståelsesevner. For...
-
AI-modeller og plattformer 10. september 2024EAGLE: Utforsking av designrommet for multimodale store språkmodeller med en blanding av encodere
Evnen til å tolke komplekse visuelle informasjon nøyaktig er et viktig fokusområde for multimodale store språkmodeller (MLLMs). Nyere arbeid viser at forbedret visuell persepsjon betydelig reduserer...
-
AI-modeller og plattformer 9. september 2024Sapiens: Gjennombrudd i menneskelige visningsmodeller
Den bemerkelsesverdige suksessen med stor skala pre-trening fulgt av oppgave-spesifikk finjustering for språkmodellering har etablert denne tilnærmingen som en standard praksis. Liksom datamaskin-syn metoder er progressivt...
-
AI-modeller og plattformer 6. august 2024SGLang: Effektiv Utøvelse av Strukturerte Språkmodellprogrammer
Store språkmodeller (LLM) brukes stadig mer for komplekse oppgaver som krever flere generasjonskall, avanserte promptteknikker, kontrollflyt og strukturerte inndata/utdata. likevel mangler det effektive systemer for programmering...
-
AI-modeller og plattformer 16. juli 2024DIAMOND: Visuelle detaljer måtte i Atari og Diffusjon for Verdensmodellering
Det var i 2018, da ideen om forsterkingslæring i sammenheng med en neural nettverksverdensmodell først ble introdusert, og snart ble denne grunnleggende prinsippet anvendt på verdensmodeller....
-
AI-modeller og plattformer 6. juni 2024LLaVA-UHD: En effektiv måte å percieve bilder i hvilken som helst bildforhold og høy oppløsning
De nylige fremsteg og framgangen i store språkmodeller har erfart en betydelig økning i visuell-språklige resonnerings-, forståelses- og interaksjonsmuligheter. Moderne rammeverk oppnår dette ved å projicere...


