

Tutvustame uusi Gemini mudeleid, sealhulgas Gemini 3.6 Flash, 3.5 Flash-Lite ja 3.5 Flash Cyber. Meie uusimad Gemini mudelid pakuvad tõhusust, madalat latentsust ja töökindlust, et ehitada AI agente suures mahus.
Loading comments…
Projekti info
Toote märksõnad
Gemini 3.6 Flash perekond on uus Google'i AI-mudelite rida, mis hõlmab Gemini 3.6 Flash, 3.5 Flash-Lite ja 3.5 Flash Cyber mudeleid. Need mudelid on loodud pakkuma tõhusust, madalat latentsust ja usaldusväärsust, mida on vaja AI-agentide loomiseks suures mahus. Tuginedes Gemini 3.5 Flashi edule, keskendub perekond suuremale token-tõhususele, madalamale latentsusele ja usaldusväärsemale jõudlusele tootmiskõlblike agentide töövoogude jaoks.
Gemini 3.6 Flash pakub paremat kodeerimist, teadmistööd ja mitmekülgset jõudlust, vähendades samal ajal väljundtokenite kasutust 17% võrreldes 3.5 Flashiga. See saavutab selle vähemate arutlussammude ja tööriistakõnedega, muutes mitmeastmelised töövood kulutõhusamaks hinnaga $1.50/1M sisendtokenit ja $7.50/1M väljundtokenit.
See mudel pakub 350 väljundtokenit sekundis vastavalt Artificial Analysis indeksile, muutes selle kiireimaks 3.5-klassi mudeliks. See ületab oluliselt varasemaid Flash-Lite põlvkondi agentide töövoogudes, säilitades samal ajal madalad kulud.
Spetsiaalne küberturvalisusele keskendunud mudel koos CodeMenderi kooditurbe agendiga, mis on loodud edukateks küberturvalisuse rakendusteks, mis nõuavad mudeli hoolikat orkestreerimist koos agentide infrastruktuuriga. See pakub konkurentsivõimelist jõudlust kooditurbe esiservas.
"3.6 Flash vähendab väljundtokenite kasutust 17% võrreldes 3.5 Flashiga, kõik see madalama hinnaga väljundtokeni kohta."
See tõhususe kasv on tähelepanuväärne, kuna see kaasneb jõudluse paranemisega mitmete võrdlusaluste lõikes. 3.6 Flash saavutab 49% vs. 37% DeepSWE-s koodimuudatuste jaoks, 63.9% vs. 49.7% MLE Benchis masinõppe uurimistöö jaoks ja 83.0% vs. 78.4% OSWorld-Verifiedis arvutikasutuse jaoks. Madalama hinna, vähemate tokenite ja paremate tulemuste kombinatsioon muudab selle perekonna eriti sobivaks agentide töövoogude skaleerimiseks tootmises.
Te loote tootmiskõlblikke AI-agente ja vajate mudeliperekonda, mis tasakaalustab tõhusust, latentsust ja usaldusväärsust. Gemini 3.6 Flash perekond on eriti uurimist väärt, kui töötate kodeerimisülesannete, teadmistöö, mitmekülgsete rakenduste või küberturvalisuse töövoogudega, kus token-tõhusus ja kulukontroll on kriitilise tähtsusega.
Teised tööriistad, mida võiksid kaaluda
Maailm ei suuda arvutusvõimsust piisavalt kiiresti ehitada, et AI nõudlusega sammu pidada. Seega valisime teistsuguse tee. ZeroGPU on AI infrastruktuur, mida toidavad väikesed keelemudelid, mis töötavad hübriidses äärearvutite võrgus, kasutades juba olemasolevat arvutusvõimsust. Mitte iga ülesanne ei vaja tipptasemel mudelit. Meie spetsiaalselt loodud, äärearvutite jaoks optimeeritud mudelid töötavad 10 korda kiiremini, 50% odavamalt ja suunavad 70–80% tootmisülesannetest väikestele mudelitele, säilitades tipptasemel täpsuse.
Käivita tipptasemel avatud lähtekoodiga mudeleid (GLM 5.1, Kimi K2.7 Code, MiniMax M2.7 ja teisi) Claude Code'is kuni 4× kiiremini (kuni 200 tok/s) fikseeritud hinnaga 29 $/kuus. Seadista mõne minutiga, koodi muutma ei pea.
BaseRT on kiireim LLM-i käituskeskkond Apple Siliconil. Installige see ühe käsuga ja käivitage kohalikke mudeleid oma seadmes.
GitHits annab kodeerimisagentidele juurdepääsu avatud lähtekoodiga, millest teie rakendus sõltub. Hankige reaalseid teostusnäiteid, sõltuvuste lähtekoodi sirvimist, pakettide kontrollimist ja dokumentatsiooni. Agendid saavad teie koodibaasi otsida ja lugeda. Nad ei saa otsida ega lugeda avatud lähtekoodi, millest teie rakendus sõltub. Siit algab nende oletamine, uuesti proovimine ja tsüklisse jäämine. GitHits ehitab nõudmisel versiooniteadliku indeksi. Agendid saavad otsida, sirvida ja kontrollida oma sõltuvuste taga olevat koodi. CLI: npx githits@latest init
Looja
sandbyte
Alternatiivid
Loading comments…