Google „Antigravity SDK“ dabar palaiko lokalius AI modelius su Gemma 4 26B
Trumpai: Google paskelbė, kad „Antigravity SDK“ dabar palaiko agentinių darbo eigų vykdymą lokaliai ir neprisijungus prie interneto, pradedant „Gemma 4 26B A4B“ modeliu per „Google AI Edge“ „LiteRT“. Kūrėjai gali kurti agentus, veikiančius visiškai įrenginyje, be debesijos API kaštų ar priklausomybės nuo interneto. Google taip pat pademonstravo hibridinį „Architect-Builder“ modelį, kai debesijos modelis („Gemini 3.8 Flash“) planuoja užduotis, o lokalus „Gemma 4 26B“ modelių pulkas atlieka pagrindinį darbą, neišsiunčiant šaltinio kodo į debesiją.
Šią santrauką automatiškai parengė dirbtinis intelektas pagal „Google Developers“ publikaciją. Tai mūsų tekstas, ne originalo kopija — faktai, skaičiai ir citatos priklauso šaltiniui, kurio nuoroda pateikta viršuje ir apačioje.
Kas pasikeitė?
- 1„Antigravity SDK“ dabar palaiko lokalų/offline vykdymą per „LiteRT“ ir „Gemma 4 26B A4B“
- 2Rekomenduojama įranga: >24GB VRAM arba bendrinės atminties
- 3Nauji klasės „LiteRTAgentConfig“ ir „LocalOpenAIAgentConfig“ lokaliems bei OpenAI suderinamiems serveriams (Ollama, LM Studio, vLLM)
- 4Hibridinė demonstracija: „Gemini 3.8 Flash“ suplanuoja užduotis (95 debesijos tokenai), o lokalus „Gemma 4 26B“ pulkas įvykdo 97,2 % visų tokenų (3322) visiškai įrenginyje
- 5Pavyzdys: autonomiškas saugumo audito ir pataisymo darbas trijuose kodo moduliuose neįkeliant šaltinio kodo
| Parametras | Buvo | Dabar |
|---|---|---|
| Vykdymo režimas | Tik debesijos agentiniai darbo procesai | Vietinis/neprisijungus vykdymas naudojant LiteRT su Gemma 4 26B A4B, bei hibridinė debesijos ir vietinė orkestracija |
| Aparatinės įrangos reikalavimas | Nenurodyta | Rekomenduojama >24GB VRAM arba vieninga atmintis |
| Kaina hibridinėje demonstracijoje | Nenurodyta | 97,2% žetonų (3 322) veikia vietiniu/neprisijungus režimu; tik 95 debesijos žetonai panaudoti Gemini 3.8 Flash planavimu |
| Suderinamos backend sistemos | Nenurodyta | Palaiko OpenAI suderinamus vietinius serverius (Ollama, LM Studio, vLLM) per LocalOpenAIAgentConfig |
Kodėl tai svarbu?
Tai leidžia agentų kūrėjams sumažinti API kaštus, išlaikyti jautrų kodą ar duomenis visiškai lokaliai dėl atitikties reikalavimų bei dirbti be interneto, kartu naudojant galingus debesijos modelius sudėtingam planavimui. Tai rodo platesnę pramonės kryptį link hibridinių debesijos/kraštinių agentų architektūrų.
Ką tai reiškia AI agentams ir kontaktų centrams?
Jei jūsų įmonė naudoja privatumui jautrius kontaktų centro diegimus, šis modelis yra aktualus: lengvas lokalus modelis galėtų atlikti įrankių iškvietimus ar skambučių duomenų apdorojimą vietoje, o debesijos modelis – sudėtingesnį mąstymą, taip mažinant API kaštus per skambutį ir išlaikant klientų duomenis lokaliai. Verta įvertinti hibridinį „Architect-Builder“ modelį dėl latencijos ir kaštų balanso balso agentų sistemose.
🧪 Verta testuoti
Jūsų įmonė galėtų išbandyti, ar lokalus „Gemma 4 26B“ per „LiteRT“ gali atlikti lengvesnes agentų užduotis (pvz., įrankių iškvietimus, skambučių santraukas) vietoje, taip sumažinant debesijos kaštus ir sprendžiant duomenų privatumo reikalavimus, palyginant latenciją ir kokybę su grynai debesijos sprendimu.
Antigravity SDK local model support (Gemma 4 26B A4B + LiteRT)· Nauja
Šaltiniai
- Google DevelopersOficialusPirminis šaltinisOriginalus straipsnis →„Introducing Support for Local AI Models in the Antigravity SDK“2026-09-23 03:00
- Šaltinio publikavimo data
- 2026-09-23 03:00
- Mūsų sistema rado
- 2026-10-02 19:51
- Santrauka sugeneruota
- 2026-10-02 19:55
Straipsnį pagal originalų šaltinį parašė AI. Faktai, skaičiai ir kainos — iš šaltinio; trūkstamos reikšmės pažymėtos „Nėra oficialių duomenų“. Teisinė informacija, autorių teisės ir privatumas