Anthropic pristatė „Claude Haiku 5.5“ su 1M token kontekstu ir adaptyviu mąstymu
Trumpai: Anthropic išleido „Claude Haiku 5.5“ (claude-haiku-5-5) — pajėgiausią Haiku modelį, skirtą dideliam apkrovimui ir delsai jautrioms užduotims. Jis palaiko 1 milijono token kontekstą, iki 128k išvesties token ir adaptyvų mąstymą, valdomą nauju effort parametru. Modelis pasiekiamas per Claude API, Amazon Bedrock, Claude Platform on AWS, Google Cloud ir Microsoft Foundry. Anthropic įspėja, kad kodas, parašytas ankstesniam Haiku 4.5 modeliui, gali neveikti naujoje versijoje.
Šią santrauką automatiškai parengė dirbtinis intelektas pagal „Claude Platform Release Notes“ publikaciją. Tai mūsų tekstas, ne originalo kopija — faktai, skaičiai ir citatos priklauso šaltiniui, kurio nuoroda pateikta viršuje ir apačioje.
Kas pasikeitė?
- 1Išleistas naujas modelis claude-haiku-5-5, skirtas dideliam apkrovimui ir delsai jautrioms užduotims
- 21M token kontekstas ir iki 128k išvesties token
- 3Adaptyvus mąstymas įjungtas per naują effort parametrą, pakeičiant rankinį budget_tokens valdymą
- 4Prieinamas per Claude API, Amazon Bedrock, Claude Platform on AWS, Google Cloud ir Microsoft Foundry
- 5Reikšmingas pokytis: rankinis plėstinis mąstymas (budget_tokens) dabar grąžina 400 klaidą, adaptyvus mąstymas įjungtas pagal nutylėjimą, atsakymai gali prasidėti mąstymo blokais, o tas pats tekstas gali užimti daugiau token
| Parametras | Buvo | Dabar |
|---|---|---|
| Konteksto langas | Nenurodyta (Claude Haiku 4.5) | 1 000 000 token |
| Maksimalus išvesties token kiekis | Nenurodyta | 128 000 token |
| Mąstymo valdymas | Rankinis plėstinis mąstymas per budget_tokens parametrą | Adaptyvus mąstymas įjungtas pagal nutylėjimą, valdomas effort parametru |
| Prieinamumas | Claude Haiku 4.5 per Claude API, Bedrock, AWS, Google Cloud, Microsoft Foundry | Claude Haiku 5.5 per Claude API, Amazon Bedrock, Claude Platform on AWS, Google Cloud, Microsoft Foundry |
Kodėl tai svarbu?
Didelis kontekstas kartu su greičiui ir apkrovai pritaikytu modeliu aktualu komandoms, apdorojančioms ilgus pokalbius ar dokumentus esant griežtiems delsos reikalavimams, pvz., realaus laiko agentams ar didelio pralaidumo API procesams. Pokyčiai reiškia, kad migruojant iš Haiku 4.5 reikia peržiūrėti su mąstymu susijusį kodą ir token biudžetą.
Ką tai reiškia AI agentams ir kontaktų centrams?
Komandoms, naudojančioms balso agentus ar įrankių iškvietimą su Claude, verta įvertinti šį modelį delsos ir kainos atžvilgiu dideliam skambučių kiekiui, tačiau esamos integracijos, sukurtos su Haiku 4.5 rankiniu plėstiniu mąstymu (budget_tokens), prieš migruojant turės būti pakeistos, nes šis parametras dabar grąžina klaidą, o adaptyvus mąstymas veikia pagal nutylėjimą.
🧪 Verta testuoti
1M token kontekstas, adaptyvus mąstymas per effort parametrą ir orientacija į delsai jautrų, didelio apkrovimo darbą daro jį stipriu kandidatu testuoti balso agentų ir įrankių iškvietimo scenarijams, įskaitant kainą ir atsako greitį.
Šaltiniai
- Claude Platform Release NotesOficialusPirminis šaltinisOriginalus straipsnis →„We've launched Claude Haiku 5.5 ( claude-haiku-5-5 ), our most capable model tuned for high-volume and latency-sensitive work. It has a 1M token context window , 128k max output tokens, and adaptive t“2026-10-07 03:00
- AWS Machine LearningOficialusOriginalus straipsnis →„Introducing Claude Haiku 5.5 on AWS“2026-10-07 21:52
- Šaltinio publikavimo data
- 2026-10-07 03:00
- Mūsų sistema rado
- 2026-10-07 21:06
- Santrauka sugeneruota
- 2026-10-07 21:08
Straipsnį pagal originalų šaltinį parašė AI. Faktai, skaičiai ir kainos — iš šaltinio; trūkstamos reikšmės pažymėtos „Nėra oficialių duomenų“. Teisinė informacija, autorių teisės ir privatumas