- Сонет 4.5 покреће издржљиве агенте, бољи код и поуздано рачунарство, са 64 хиљаде излазних токена и фокусом од преко 30 сати.
- Клод Код ажурира (контролне тачке, терминал, VS Код), додаје уређивање меморије и контекста у API и покреће Агент SDK.
- Напредује у безбедности (ASL-3, мање лажно позитивних резултата, одбрана од брзог убризгавања) и добро се показује у SWE-bench и OSWorld тестовима.
- Доступно на Claude.ai, API, Bedrock и Vertex AI, са ценама од 3 до 15 долара, са уштедама за кеширање и групирање.

Појава верзије Claude Sonnet 4.5 покренула је област вештачке интелигенције примењене на агенте и развој софтвера, са обећањима која се крећу од аутономног програмирања и руковања рачунаром до опипљивих напретака у резоновању и математици. Anthropic га представља као свој најспособнији модел до сада, са веома јасним фокусом: да трансформише Claude у више од обичног асистента за разговор, гурајући га у домен „агента који делује“.
Паралелно са тим, компанија јача свој екосистем побољшањима Claude Code-а, новим алатима за програмере и строжим слојем безбедности и поравнања. Порука је амбициозна: најбољи модел за агенте, код и коришћење рачунарства , поткрепљен метрикама као што су SWE-bench Verified и OSWorld, поред скупа функција дизајнираних да олакшају дугорочне и сложеније задатке.
Шта је Клод Сонет 4.5 и шта обећава?
Антропик описује Сонет 4.5 као свој најмоћнији модел у критичним областима: изградњи сложених агената, генерисању и одржавању кода и контроли рачунара . Он иде даље од пуког означавања; компанија тврди да постоје јасна побољшања у резоновању и математици, два стуба која чине сву разлику када пројекти укључују више корака и зависности.
Једна од његових најупечатљивијих карактеристика је способност да одржава сложене задатке преко 30 сати без престанка, одржавајући фокус без директне интервенције. У практичном смислу, то значи да агент може да настави са дугим, координисаним задацима без губитка нити. Штавише, модел подржава излазе до 64.000 токена, што је веома корисно за детаљно планирање и генерисање великих блокова кода.
У јавним тестовима, Anthropic тврди да је Sonnet 4.5 најсавременији у SWE-bench Verified, процени која мери способност софтвера да решава проблеме из стварног света. Такође се истиче у OSWorld-у са резултатом од 61,4%, што указује на значајна побољшања у стварним десктоп окружењима . Сама компанија упоређује ових 61,4% са 42,2% које је Sonnet 4 постигао пре неколико месеци, што је значајно повећање.
Поред сирових перформанси, компанија наглашава да је то њен најусклађенији „гранични“ модел: забрињавајућа понашања попут претераног ласкања, тражења моћи или склоности подржавању заблуде и размишљања су смањена , а одбрана од напада брзим убризгавањем у сценаријима коришћења рачунара и могућностима агента је ојачана.

Ажурирања екосистема: Клод Код, апликације и платформа
Сонет 4.5 стиже са великим ажурирањем производа. Клод Код уводи контролне тачке , једну од најтраженијих функција: оне чувају напредак и омогућавају корисницима да се тренутно врате на претходна стања. За свакога ко развија са дугим итерацијама, ова промена смањује трење и пружа поверење да истражује различите путеве без страха од покварења свега.
Ово је поред редизајнираног терминалног интерфејса и покретања изворног проширења за Visual Studio Code , са циљем директног интегрисања Claude-а у IDE где програмери проводе своје дане. Ово је значајан корак напред ако је циљ да модел преузме оперативнију, а мање периферну улогу.
На страни API-ја, постоје две кључне компоненте: уређивање контекста и нови алат за складиштење и преузимање информација . Заједно, ово омогућава агентима да раде дуже, филтрирајући застарели контекст и одржавајући оно што је заиста важно доступним – што је неопходно када токови рада трају сатима, а захтеви се мењају у ходу.
У Клодовим апликацијама, још једна важна иновација је могућност покретања кода и креирања датотека (докумената, табела и презентација) у оквиру разговора. Ово омогућава моделу да анализира податке, генерише садржај и производи га у канцеларијским форматима без напуштања ћаскања, обједињујући теорију и праксу у истој нити.
Коначно, Клодово званично проширење за Chrome доступно је корисницима Max-а који су се придружили листи чекања, отварајући врата аутоматизацији задатака прегледача са мање трења и већом поузданошћу.
Клод Агент СДК: Градивни блокови за изградњу сопствених агената
Антропик не само да показује шта његов водећи производ може да уради; он такође пружа основне елементе за друге да га прилагоде. Нови Клод Агент СДК дели инфраструктуру која покреће Клод Код и дизајниран је да се носи са тешким проблемима: управљање меморијом за дуготрајне задатке, системи дозвола који уравнотежују аутономију са корисничком контролом и координација између подагената који раде на заједничком циљу.
Предлог је да се овај SDK трансформише у основу за вишекратну употребу, тако да сваки тим може да направи сопственог агента користећи алате проверене у продукцији . Anthropic тврди да, иако је првобитно развијен за апликације засноване на коду, показује предности у широком спектру задатака.
Преглед истраживања: „Замислите са Клодом“
Уз Sonnet 4.5, Anthropic нуди привремено искуство под називом „Замислите са Клодом“. У овом експерименту, модел генерише софтвер у ходу без унапред одређених функционалности , реагујући на интеракцију корисника у реалном времену. То је, у суштини, увид у то шта се може постићи када се способан модел комбинује са правом инфраструктуром.
Преглед је доступан пет дана за Max претплатнике и може му се приступити на claude.ai/imagine. Компанија га представља као разигран, али откривајући приказ могућности Сонета 4.5 у смислу генерисања и адаптације.
Безбедност, поравнање и ниво ASL-3
Примена Sonnet 4.5 је подржана нивоом безбедности ASL-3, оквиром који прилагођава могућности модела одговарајућим заштитним мерама . Ове мере укључују класификаторе дизајниране за откривање потенцијално опасних улаза и излаза, са фокусом на CBRN (хемијска, биолошка, радиолошка и нуклеарна) окружења.
Антропик признаје да ови класификатори понекад могу да означе легитиман садржај и, како би избегли прекидање корисника, нуди да наставе разговор са Сонетом 4, који представља мањи ХБРЈ ризик. Од када су први пут описали ове филтере, смањили су лажно позитивне резултате за фактор десет, а од лансирања Клод Опуса 4 у мају, за фактор два. Обећавају да ће се препознатљивост класификатора наставити побољшавати.
Усклађивање иде даље од филтера: обука и безбедносне процене сада први пут укључују тестове инспирисане механистичком интерпретабилношћу , са циљем бољег разумевања и контроле унутрашњег понашања модела. Штавише, ојачана је одбрана од брзог убризгавања, што је посебно релевантно када систем прегледа, ради на виртуелним десктоповима или извршава радње.
Доступност, интеграција и цене
Клод Сонет 4.5 је данас доступан свуда. Програмери га могу користити путем Клод API-ја позивањем модела „claude-sonnet-4-5“ . Цена остаје иста као и код претходне генерације: 3 долара по милиону унетих токена и 15 долара по милиону изнетих токена.
Антропик нуди предности у погледу трошкова са својом инфраструктуром: уштеде до 90% уз брзо кеширање и додатних 50% уз групну обраду — бројке осмишљене за велика радна оптерећења. За крајње кориснике, ћаскање је доступно са Sonnet 4.5 у Claude.ai (веб, iOS и Android), а за предузећа је изворно доступно на Claude Developer Platform, као и на Amazon Bedrock и Google Cloud Vertex AI.
Што се тиче пословања, постоји бесплатан план са ограничењем сесија које се ресетује сваких пет сати и променљивим бројем порука на захтев. А за сложене програмске задатке, Claude Code делује као водећи добављач.
Истакнути случајеви употребе
Сонет 4.5 је представљен као идеалан модел за агенте: може да реагује готово тренутно или да примени видљиво, корак-по-корак размишљање када задатак то захтева. Корисници API-ја прецизно контролишу колико дуго модел „размишља“, бирајући између брзине и дубине.
У развоју софтвера, покрива цео животни циклус: планирање, генерисање, одржавање, исправке грешака и рефакторисање великих размера . Велики излазни контекст (до 64 хиљаде токена) олакшава израду конзистентних, опсежних планова и кода.
Што се тиче коришћења прегледача и десктопа, он је водећи у својој категорији: обавља радне процесе у стварном свету, од анализе конкуренције и куповине до укључивања купаца на вебу. Намера је да се тачност и поузданост наставе побољшавати током времена.
У сајбер безбедности, тимови који комбинују Sonnet 4.5 са Claude Code-ом могу да примене агенте који аутономно закрпе рањивости пре него што буду искоришћене, померајући фокус са реактивног откривања на проактивну одбрану.
У финансијама, модел се бави анализом улазних података и сложеним предвиђањима ; на пример, прати глобалне регулаторне промене и проактивно прилагођава системе усклађености, развијајући се од ручне припреме ревизије до интелигентног управљања ризицима.
У пословној продуктивности, истиче се у креирању и уређивању канцеларијских датотека (докумената, табела, презентација) . А у истраживању, може да прати интерне и екстерне изворе како би синтетизовао знање у сложеним информационим пејзажима.
Што се тиче садржаја, он се истиче у писању са разумевањем нијанси и тона, генеришући убедљивије текстове и анализирајући их на дубљем семантичком нивоу , што је вредна тачка за маркетинг, техничку документацију или корпоративну комуникацију.
Учинковитост и метрике
Подаци које је представио Anthropic постављају Sonnet 4.5 на 77,2% у SWE-bench Verified тесту , што је његов најбољи резултат до сада у програмирању. У OSWorld-у, достиже 61,4%, учвршћујући своју позицију као њиховог најбољег модела за „коришћење рачунара“. Ове метрике су поткрепљене оперативним доказима о задацима који прелазе 30 сати и излазним капацитетом од 64 токена.
Компанија наводи да Сонет 4.5 оснажује агенте у захтевним секторима као што су финансијска анализа, сајбер безбедност и истраживање , координирајући више агената и обрађујући велике количине података са поузданошћу коју ове области захтевају.
Еволуција породице Сонет и место броја 4.5
Да бисмо разумели овај скок, морамо се осврнути уназад. Сонет 3.7 је увео хибридни модел резоновања који је значајно побољшао кодирање, генерисање садржаја и анализу података. Затим је Сонет 4 учврстио тај приступ са готово граничним перформансама практичним за корисничке асистенте и задатке великог обима.
Сонет 4.5 надовезује се на ту путању и иде корак даље: његова амбиција је да буде најтачнији избор за дуге задатке, сложене агенте и коришћење рачунара , са већим знањем из области програмирања, финансија и сајбер безбедности.
Шта кажу стварни случајеви и заједница
Компанија Anthropic је објавила да су користили Sonnet 4.5 30 узастопних сати како би направили копију Slack-а . Према наводима компаније, агент је генерисао 11.000 линија кода без надзора и зауставио се након завршетка задатка. У мају је њихов модел Opus 4 успео да ради око седам сати, тако да нови рекорд далеко превазилази ту ознаку.
Прича звучи снажно, али нијансе се појављују изван промотивног материјала. Програмери попут @midudev препричавају како је модел рефакторисао читаве пројекте у једној инструкцији — примењујући обрасце попут чисте архитектуре и генеришући стотине или хиљаде линија — али резултат није функционисао приликом компајлирања. Други извештавају исто: код са беспрекорном структуром и професионалним изгледом, али неисправан током извршавања.
Такође је истакнуто да Anthropic није показао наводну Slack апликацију како ради од почетка до краја, већ је навео да ју је сам направио – значајан јаз између комуникације и демонстрирања помоћу проверљивог кода . Овај образац није јединствен: широм индустрије, модели се побољшавају генерисањем кода који изгледа веома добро, али и даље често не успевају да произведу функционална решења без значајне људске интервенције.
Из саме компаније, побољшања су изненадила чак и њен тим. Дајен Пен истиче да је модел три пута вештији у коришћењу рачунара од октобарске верзије и да су последњи месец провели радећи на повратним информацијама са GitHub-а и Cursor-а . Canva, као бета тестер, каже да помаже код „сложених, дуготрајних контекстуалних задатака“. Скот Вајт га упоређује са „нивоом шефа кабинета“: координирање распореда, анализа података и писање извештаја.
Основна порука је јасна: чак и са робусним моделом, виртуелне машине, управљање меморијом и контекстом, подршка за више агената и системи дозвола су и даље потребни за распоређивање поузданијих агената у продукцији. Управо је то празнина коју SDK за агенте и нове функције платформе имају за циљ да попуне.
Конкуренција и позиционирање на тржишту
Покретање Sonnet 4.5 се види као део напете конкуренције: OpenAI напредује са својом следећом генерацијом, док Google истрајава са Gemini-јем , правећи потезе који приморавају све да убрзају своје напоре. У овом контексту, дугорочни агенти, директна употреба рачунара и аутономно програмирање су кључна подручја у којима је велики део пословне вредности у питању.
Ко год убеди компаније да могу аутоматизовати радне процесе у стварном свету са контролом и поузданошћу, освојиће лиценце и велике примене . Anthropic верује да ће комбиновање моћног модела са правом инфраструктуром – њиховом сопственом – премостити јаз између демонстрација и одрживог рада.
Препоруке за усвајање и добре праксе
Ако ћете озбиљно испробати Sonnet 4.5, имајте на уму да аутономија не долази без цене. Радње које модел може да обавља – читање и модификовање датотека, премештање података, извршавање команди и навигација – захтевају јасна правила и надзор. Омогућавање система дозвола, евиденција ревизије и успостављање прагова за људску интервенцију су кључни за ублажавање ризика.
У токовима кода, контролне тачке и API меморија Клода Кода помажу у безбедној итерацији. Упркос томе, препоручљиво је аутоматизовати тестове и цевоводе валидације и уводити модел у контролисаним фазама (од задатака са малим утицајем до критичних компоненти) пре делегирања главних одговорности.
Где прочитати више и како почети
Антропик препоручује надоградњу на Сонет 4.5 за све намене: апликације, АПИ-је и Клод Код. Они представљају надоградњу као директну замену са побољшаним перформансама по истој цени . Нове функције у Клод Коду су доступне свим корисницима; ажурирања програмерске платформе – укључујући Агент СДК – доступна су целој програмерској заједници; а извршавање кода и креирање датотека у апликацијама су укључени у све плаћене планове.
За техничке детаље и резултате евалуације, компанија се позива на своју системску картицу, страницу модела и документацију , као и на инжењерске публикације и истраживачки пост о сајбер безбедности. Свако ко жели да експериментише са генерисањем софтвера у реалном времену може да испроба „Imagine with Claude“ неколико дана.
Слика коју приказују ове објаве јесте модел који подиже стандарде у погледу агената, кода и коришћења рачунара, док истовремено јача скалабилност, безбедност и алате за програмере. Остаје да се види у којој мери ће пракса одговарати теорији, али постоје конкретни знаци зрелости и доследан план за премостивање јаза између „причања добра“ и „чињења добра“.