ARTICLE AD BOX
Gemini 3.8 Flash носи подобри резултати при сложени задачи, програмирање и работа на AI агенти. Цената по токен остана иста, но моделот троши значително повеќе токени.
Google го претстави новиот AI модел Gemini 3.8 Flash, кој во споредба со претходникот би требало да биде поспособен при посложени задачи, програмирање и работа на автономни AI агенти, но неговото користење во пракса би можело да биде поскапо.
Како што наведуваат од Google, Gemini 3.8 Flash при извршување на посложени задачи прави повеќе чекори на расудување и може итеративно да повикува различни алатки за да дојде до поквалитетен резултат. Компанијата тоа го опишува со тврдењето дека новиот модел едноставно „работи повеќе“ од претходникот.
Google, всушност, не ги зголеми почетните цени во однос на Gemini 3.7 Flash. Еден милион влезни токени чинат 0,75 долари, додека цената за еден милион излезни токени изнесува 3,75 долари. Сепак, тоа не значи нужно дека трошокот за користење ќе остане ист.

Google затоа предупредува дека Gemini 3.8 Flash може да користи повеќе токени за да постигне подобри резултати, особено кога се користи со повисоки нивоа на интензитет на расудување. Програмерите на кои им е приоритет што е можно помала потрошувачка затоа и понатаму можат да го користат Gemini 3.7 Flash, кој инаку беше претставен пред само неколку недели.
Првите независни тестирања укажуваат токму на такво сценарио. Artificial Analysis наведува дека Gemini 3.8 Flash е најевтиниот модел што досега го тестирале на тоа ниво на интелигенција, но трошокот по задача е околу 40 отсто поголем во споредба со Gemini 3.7 Flash. Како причина ги наведуваат околу 30 отсто повеќе излезни токени по задача, како и поголемиот број чекори при тестирањето на агентските способности.
Gemini 3.8 Flash (high) чини 0,58 долари по задача во Intelligence Index, што е најниска цена што сме ја измериле на ова ниво на интелигенција. Тоа е околу 40 отсто повеќе од Gemini 3.7 Flash и покрај непроменетата цена по токен, поради 30 отсто зголемување на бројот на излезни токени по задача и повеќе интеракции при агентското работење…

Од останатите подобрувања, Google особено го истакнува напредокот во софтверското инженерство. Според резултатите што ги објави компанијата, Gemini 3.8 Flash го надминал претходникот, како и низа конкурентски модели, на тестот DeepSWE v1.1, наменет за мерење на способностите на моделите при решавање задачи поврзани со развој на софтвер.
Новиот модел постигнал добри резултати и на специјализирани тестови. Google наведува дека ги надминал конкурентите на Vals Finance Agent V2 benchmark тестот за финансиски AI агенти, како и на Harvey’s Legal Agent benchmark тестот, кој ги испитува способностите на AI системите при правни задачи.

Google паралелно го претстави и Gemini 3.8 Flash Cyber, специјализирана верзија на моделот наменета за областа на сајбер-безбедноста. Таа е достапна преку новата програма Fairwind, на која можат да ѝ пристапат владите и одредени „доверливи партнери“. Програмата моментално обединува околу 650 членови, меѓу кои се CrowdStrike и Center for Internet Security. Покрај моделот Gemini 3.8 Flash Cyber, учесниците добиваат пристап и до AI агентот на Google, CodeMender.
Google тврди дека CodeMender може автономно да пронаоѓа и поправа безбедносни ранливости, а неговата примена би требало да помогне во заштитата на критичната инфраструктура, јавните услуги и системите важни за националната безбедност. Самиот Gemini 3.8 Flash исто така доаѓа со заштитни механизми со кои Google се обидува да спречи злоупотреба на моделот за сајбер-напади, како и во областите на хемиски, биолошки, радиолошки и нуклеарни закани.
Gemini 3.8 Flash веќе е достапен за корисниците на претплатите Google AI Pro и Ultra, како и за програмерите и деловните корисници. Повеќе информации се достапни во деталната објава на Google.

пред 1 ден
1









English (US) ·
Macedonian (MK) ·