Qwen pristatė Qwen-Image-2.1-Turbo – pagreitintą teksto-į-vaizdą modelio versiją su 8 žingsniais
Trumpai: Qwen „Hugging Face“ platformoje paskelbė Qwen-Image-2.1-Turbo – destiliuotą Qwen-Image-2.1 teksto-į-vaizdą ir vaizdų redagavimo modelio versiją. Naudojama ta pati 7B vizualinės generacijos architektūra, tačiau generavimui pakanka vos 8 trukšmo mažinimo žingsnių (vietoj standartinio grafiko), taikant CFG=1 ir prefikso KV talpyklos (caching) mechanizmą, kuris pakartotinai panaudoja teksto ir nuorodinio vaizdo kontekstą tarp žingsnių. Modelis integruojamas per QwenImage21Pipeline „Diffusers“ bibliotekoje ir palaiko tuos pačius rezoliucijos bei kraštinių santykio nustatymus kaip bazinis modelis, įskaitant redagavimo užduotis, pvz., eskizo pavertimą fotorealistišku vaizdu.
Šią santrauką automatiškai parengė dirbtinis intelektas pagal „Qwen (Hugging Face)“ publikaciją. Tai mūsų tekstas, ne originalo kopija — faktai, skaičiai ir citatos priklauso šaltiniui, kurio nuoroda pateikta viršuje ir apačioje.
Kas pasikeitė?
- 1„Hugging Face“ paskelbtas naujas kontrolinis taškas Qwen-Image-2.1-Turbo
- 2Generavimas sutrumpintas iki 8 trukšmo mažinimo žingsnių su įmontuotu rekomenduojamu atrankos grafiku
- 3Numatytasis CFG=1 ir prefikso KV talpykla greitesniam inferavimui
- 4Ta pati 7B architektūra, tie patys rezoliucijos/kraštinių santykio nustatymai kaip Qwen-Image-2.1
- 5Reikalinga „Diffusers“ versija su pipeline konfigūruojamos atrankos sigma palaikymu (PR #14950)
- 6Licencijuojama pagal Qwen Research License Agreement
| Parametras | Buvo | Dabar |
|---|---|---|
| Trukšmo mažinimo žingsniai | Standartinis Qwen-Image-2.1 grafikas (daugiau žingsnių) | 8 žingsniai |
| Parametrai | 7B (bazinis Qwen-Image-2.1) | 7B (ta pati architektūra) |
| CFG | Nenurodyta | 1 (numatytasis) |
| Talpykla (caching) | Nenurodyta | Prefikso KV talpykla tarp trukšmo mažinimo žingsnių |
| Licencija | Nenurodyta | Qwen Research License Agreement |
Kodėl tai svarbu?
Komandoms, dirbančioms su AI vaizdų generavimu ar redagavimu, tai suteikia žymiai greitesnį būdą kurti aukštos rezoliucijos vaizdus ir atlikti eskizo-į-nuotrauką tipo redagavimą be didelių kokybės kompromisų, nes naudojama ta pati architektūra ir treniruotas atrankos grafikas kaip pilname modelyje.
Ką tai reiškia AI agentams ir kontaktų centrams?
Tai teksto-į-vaizdą modelis, tiesiogiai nesusijęs su balso AI, telefonija, STT/TTS ar kontaktų centro procesais; aktualu tik jei atskirai reikėtų greito vaizdų generavimo ar redagavimo funkcionalumo.
Šaltiniai
- Qwen (Hugging Face)OficialusPirminis šaltinisOriginalus straipsnis →„Qwen/Qwen-Image-2.1-Turbo released on Hugging Face (text-to-image)“2026-10-09 07:50Licencija: Model card; license per model · mūsų santrauka (turinys pakeistas)
- Šaltinio publikavimo data
- 2026-10-09 07:50
- Mūsų sistema rado
- 2026-10-09 16:39
- Santrauka sugeneruota
- 2026-10-09 16:40
Straipsnį pagal originalų šaltinį parašė AI. Faktai, skaičiai ir kainos — iš šaltinio; trūkstamos reikšmės pažymėtos „Nėra oficialių duomenų“. Teisinė informacija, autorių teisės ir privatumas