

Loading commentsâŠ
Saavutus
Projekti info
Toote mÀrksÔnad
Marengo 3.0 on TwelveLabs'i kĂ”ige arenenum multimodaalne manustamismudel, mis on loodud pakkuma inimesetaolist videomĂ”istmist tohutul skaalal. Erinevalt traditsioonilistest videoanalĂŒĂŒsi tööriistadest, mis tuginevad kĂ€sitsi mĂ€rgendamisele vĂ”i lihtsatele metaandmetele, ĂŒhendab Marengo 3.0 video, heli ja teksti ĂŒhtseks terviklikuks esituseks. See vĂ”imaldab tĂ€pset loomuliku keele pĂ”hist video otsingut ja leidmist tervetes teekides â muutes toormaterjali minutitega AI-valmis otsitavaks varaks.
Marengo 3.0 töötleb videot, heli ja teksti koos ĂŒhes manustamismudelis, vĂ”imaldades terviklikku arusaamist sellest, mis ekraanil toimub, mida öeldakse ja kuidas seda öeldakse. See vĂ”imaldab kasutajatel otsida konkreetseid tegevusi, stseene, dialooge ja isegi inimemotsioone tundide vĂ”i aastate pikkusest materjalist â ilma mĂ€rgenditeta.
Platvorm vĂ”tab multimodaalseid andmeid vastu ĂŒhe torustiku kaudu ligikaudu 60x reaalajas kiirusel, mis tĂ€hendab, et ĂŒks tund videot indekseeritakse umbes minutiga. Organisatsioonid saavad töödelda 10 000+ tundi pĂ€evas, muutes vĂ”imalikuks analĂŒĂŒsida terveid videoteeke ilma kitsaskohtadeta.
Marengo 3.0 tuvastab automaatselt loomulikud katkestused, stseenimuutused ja tempomuutused pikkades videotes, tuginedes tegelikule visuaalsele ja helisisule â mitte ainult transkriptsiooni analĂŒĂŒsile. See vĂ”ime tĂ”i mudelile #1 koha Video-MME vĂ”rdlusalusel videopĂ”hjendamiseks.
Mudel toob esile poliitikariskid ja tundliku sisu selgitatava AI abil, nii et vastavusmeeskonnad saavad mĂ€rgitud segmente kiiresti ja enesekindlalt ĂŒle vaadata. See vĂ€hendab kĂ€sitsi ĂŒlevaatamise aega kuni 10 korda vĂ”rreldes traditsiooniliste meetoditega.
"Mitte transkriptsiooni lugeja. Video pÔhjendaja."
Marengo 3.0 ei analĂŒĂŒsi ainult kĂ”nest teksti â see mĂ”istab video tĂ€ielikku multimodaalset konteksti, sealhulgas visuaalseid tegevusi, stseenide kompositsiooni ja helisignaale. See tĂ€hendab, et see suudab leida konkreetse emotsionaalse reaktsiooni, peene brĂ€ndipaigutuse vĂ”i keerulise tegevusjada, mida ĂŒkski transkriptsioon ei suudaks tabada. Mudel saavutab tĂ€iustatud komposiittĂ€psuse kĂ”igis modaalsustes, seades uue vĂ”rdlusaluse sellele, mida video AI suudab saavutada.
Haldad suuri videoteeke ja vajad otsida, segmenteerida vĂ”i analĂŒĂŒsida materjali skaalal loomuliku keele abil. Marengo 3.0 on eriti vÀÀrtuslik organisatsioonidele meediatootmises, sisu vastavuses, spordianalĂŒĂŒtikas vĂ”i mis tahes valdkonnas, kus video on peamine andmeallikas, kuid kĂ€sitsi ĂŒlevaatamine on ebapraktiline. Kui oled varem vĂ”idelnud tööriistadega, mis loevad ainult transkriptsioone vĂ”i nĂ”uavad ulatuslikku mĂ€rgendamist, pakub see mudel pĂ”himĂ”tteliselt teistsugust lĂ€henemist â sellist, mis nĂ€eb ja mĂ”istab videot nagu inimesed.
Teised tööriistad, mida vÔiksid kaaluda
Seedance 2.0 autorilt ByteDance on tĂ€iustatud tehisintellekti videoloomismudel, mis on loodud kinematograafiliseks ja mitme kaadriga lugude jutustamiseks. See loob lihtsatest viipadest jĂ€rjepidevaid tegelasi, sujuvaid ĂŒleminekuid ja dĂŒnaamilisi kaameraliigutusi. Loodud loojatele, turundajatele ja filmitegijatele, annab see teile suurema kontrolli liikumise, stseeni kompositsiooni ja narratiivi voolu ĂŒle â muutes tehisintellekti video tunduma rohkem nagu pĂ€ris filmi reĆŸissööritöö.
TranslateGemma on uus avatud AI tĂ”lkemudelite komplekt, mis pĂ”hineb Google'i Gemma 3-l. See vĂ”imaldab kvaliteetset suhtlust 55 keeles, ĂŒhendades tugeva tĂ€psuse erakordse tĂ”hususega. Loodud töötama mobiilseadmetes, kohalikes seadmetes ja pilvekeskkondades, ilma et see kahjustaks jĂ”udlust.
Mistral 3 sisaldab kolme tipptasemel vĂ€ikest, tihedat mudelit (14B, 8B ja 3B) ning Mistral Large 3 â meie seni vĂ”imekaimat mudelit â hĂ”redat ekspertide segu, mis on treenitud 41B aktiivse ja 675B koguparameetriga. KĂ”ik mudelid on vĂ€lja antud Apache 2.0 litsentsi all. Ministrali mudelid esindavad oma kategoorias parimat hinna ja jĂ”udluse suhet. Samal ajal liitub Mistral Large 3 esirinnas olevate juhendamiseks peenhÀÀlestatud avatud lĂ€htekoodiga mudelite hulka.
Okara vĂ”imaldab kasutada ĂŒle 30 vĂ”imsa avatud lĂ€htekoodiga AI-mudeli ilma taristu seadistamisega tegelemata. Parimad mudelid nagu Kimi ja DeepSeek on liiga suured, et neid sĂŒlearvutil kĂ€itada â meie hoolitseme selle eest. Vaheta mudelite vahel, otsi Google'ist, Redditist, X-ist ja YouTube'ist oma vestlustes, analĂŒĂŒsi faile, genereeri pilte ja tööta koos oma meeskonnaga. KĂ”ik on krĂŒpteeritud ja me ei treeni kunagi sinu andmete peal.
Looja
mocha_byte
Loading commentsâŠ