Към съдържанието
Gemini 3.6 Flash — AI агент, който вижда екрана и кликва вместо човека
Категория: AI Новини

Gemini 3.6 Flash: AI агент, който сам ползва браузъра [2026]

Gemini 3.6 Flash излезе на 21 юли 2026 г. с вградена функция computer use — какво точно прави моделът сам на екрана, колко струва и какво значи за България

ИД
Иван Драганов//11 мин.
𝕏FBLI

Gemini 3.6 Flash е новият работен модел на Google, който вече не само пише текст, а вижда екрана и работи с него вместо вас. Google DeepMind го обяви на 21 юли 2026 г. заедно с два по-малки модела. Съществената промяна е една: кликането по чужд интерфейс стана вградена функция, вместо конструкция, която всеки си сглобява сам.

Накратко: Gemini 3.6 Flash е евтиният, бърз модел на Google за всекидневна работа — код, документи, многостъпкови задачи. Новото е вградената функция computer use: моделът получава екранна снимка и връща конкретно действие — щракване, писане, скролване, отваряне на адрес. При теста OSWorld-Verified резултатът се вдига до 83,0% от 78,4% при предишното поколение. Цената остава $1,50 за милион входни tokens и $7,50 за милион изходни.

Ключови факти: Обявен на 21 юли 2026 г. · Цена $1,50 вход / $7,50 изход за 1 милион tokens · Контекст 1 милион входни tokens и 65 536 изходни · Знанията стигат до март 2026 г. · OSWorld-Verified: 83,0% срещу 78,4% · Тест за код DeepSWE: 49% срещу 37% · Използва със 17% по-малко изходни tokens от предшественика си · Достъпен в Gemini API, Google AI Studio, Antigravity, Gemini Enterprise и приложението Gemini


Какво се случи с Gemini 3.6 Flash на 21 юли 2026?

Gemini 3.6 Flash е моделът от средния клас на Google — този, който трябва да поеме големия обем работа на ниска цена, вместо да блести на редки тежки задачи. Google DeepMind го пусна заедно с Gemini 3.5 Flash-Lite и с тесния Gemini 3.5 Flash Cyber, който търси и запушва пробойни в сигурността. Обявлението дойде на 21 юли 2026 г. и трите модела тръгнаха към разработчиците веднага.

Gemini 3.6 Flash е достъпен през Gemini API в Google AI Studio и Android Studio, в средата Google Antigravity и в Gemini Enterprise.

Според репортажа на 9to5Google моделът влиза и в потребителското приложение Gemini още в деня на обявяването. При кои абонаментни планове — Google не уточнява публично.

Какво означава „computer use“ и защо е вградено?

Computer use е способността на модела да работи с готов графичен интерфейс — да гледа екранна снимка и да върне действието, което трябва да се изпълни. Не пише код, който да натисне бутона; описва самото натискане, а вашата програма го извършва.

Документацията на Gemini API описва цикъла в четири стъпки. Изпращате екранна снимка, моделът връща извикване на функция, вашата среда изпълнява действието и прави нова снимка, после всичко се повтаря. Наборът от действия в браузър включва щракване, двойно щракване, щракване с десен бутон, писане, влачене, скролване, натискане на клавиш и комбинация от клавиши, отваряне на адрес и връщане назад.

Поддържат се и мобилни, и настолни среди, не само браузър.

Досега това беше отделен, специализиран модел. От юни 2026 г. функцията стана вграден инструмент в самото семейство Flash, а Gemini 3.6 Flash я наследява подобрена.

„С вградената възможност за computer use разработчиците вече могат да използват 3.5 Flash, за да изграждат надеждно собствени агенти, които виждат, разсъждават и действат в браузър, на мобилно устройство и на настолен компютър.“ — Mateo Quiros, продуктов мениджър в Google DeepMind, 24 юни 2026 г.

Gemini 3.6 Flash и функцията computer use — цикълът от екранна снимка до действие на екрана
Четирите стъпки, през които моделът превръща снимка на екрана в реално действие.

Защо Gemini 3.6 Flash е важен за AI агентите?

Gemini 3.6 Flash се усеща най-силно там, където една задача се разбива на десетки дребни стъпки — а при такива вериги всяка излишна стъпка струва пари и добавя закъснение.

Google съобщава, че моделът стига до отговор с около 17% по-малко изходни tokens от Gemini 3.5 Flash, а при теста за код DeepSWE икономията достига до 65%. Същата работа, по-малка сметка.

Втората промяна е в обхвата. Досега автономните AI агенти стигаха далеч само там, където имаше готов API. Computer use маха това ограничение: щом човек може да свърши нещо с мишка и клавиатура, агентът също получава шанс.

Точно това е и посоката, в която тръгнаха AI браузърите през последната година. Разликата е, че тук способността живее в самия модел и се извиква през API, а не е заключена в конкретен продукт.

Колко струва Gemini 3.6 Flash и къде е достъпен?

Gemini 3.6 Flash струва $1,50 за милион входни tokens и $7,50 за милион изходни в платения план. В изходните tokens влизат и тези, които моделът изразходва за разсъждаване.

По-малкият Gemini 3.5 Flash-Lite е нарочно поставен под него — $0,30 вход и $2,50 изход за милион tokens. Google посочва скорост от 350 изходни tokens в секунда по индекса на Artificial Analysis.

Третият модел, Gemini 3.5 Flash Cyber, не се продава свободно — върви по ограничена пилотна програма за правителства и доверени партньори.

Собствена сметка за български бизнес. Да приемем агент, който изпълнява една задача за 20 стъпки, като на стъпка изпраща около 4 000 входни tokens (екранна снимка плюс история) и връща 400 изходни. Това прави $0,18 на задача, или $180 месечно при 1 000 задачи. По референтния курс на ЕЦБ от 28 юли 2026 г. — 1,1367 долара за евро — това са около 158 евро на месец. Числата са илюстрация при посочените допускания, не оферта: реалният разход зависи от размера на екранните снимки и от дължината на историята.

Какви числа показва Gemini 3.6 Flash в тестовете?

Gemini 3.6 Flash води пред предшественика си във всички показатели, които Google публикува. Най-важният за темата е OSWorld-Verified — тестът, който мери дали агент може да свърши истинска работа на истински компютър.

OSWorld съдържа 369 задачи в Ubuntu, Windows и macOS. В оригиналното изследване хората постигат 72,36% успеваемост, а най-добрият тогавашен модел — само 12,24%.

Днешните 83,0% на Gemini 3.6 Flash идват от обновената версия OSWorld-Verified и затова не са пряко сравними с човешката база от статията. Посоката обаче е ясна. За две години разстоянието се стопи от десетки пъти до нищо.

плъзни →
Сравнение: OSWorld-Verified, DeepSWE (код), MLE Bench, GDPval-AA v2, Изходни tokens, Знания до
Показател3.5 Flash3.6 FlashРазлика
OSWorld-Verified78,4%83,0%плюс 4,6 пункта
DeepSWE (код)37%49%плюс 12 пункта
MLE Bench49,7%63,9%плюс 14,2 пункта
GDPval-AA v213491421плюс 72 точки
Изходни tokensбазовоминус 17%по-ниска сметка
Знания доянуари 2025март 2026плюс 14 месеца

Стойностите за DeepSWE, MLE Bench и GDPval-AA идват от обявлението на Google, а границата на знанията — от картата на модела в Google DeepMind. Както при всеки производител, това са резултати, отчетени от самата компания.

Кой вече използва тази технология на практика?

Google посочва като ранни партньори платформата за браузър инфраструктура Browserbase, отворената рамка Browser Use и компанията за корпоративна автоматизация UiPath. И трите строят агенти, които работят вътре в чужди интерфейси.

Три приложения се повтарят: непрекъснато тестване на софтуер, попълване на форми в стари системи без API и пренасяне на данни между програми, които не се говорят помежду си. Никое от трите не е ново желание — новото е, че вече излиза евтино.

Моделът обаче греши: картата на модела изрично изброява халюцинациите и случайните забавяния сред известните му слабости.

Предимства
  • Вградена функция computer use — не се налага собствена система за автоматизация
  • Със 17% по-малко изходни tokens при равен резултат, тоест по-ниска сметка
  • Контекст от 1 милион входни tokens за дълги многостъпкови задачи
  • Знанията стигат до март 2026 г. вместо до януари 2025 г.
  • Работи в браузър, на мобилно устройство и на настолен компютър
  • Достъпен през Gemini API, Antigravity и Gemini Enterprise от първия ден
×Недостатъци
  • ×Prompt injection остава реален риск при агент, който чете чужди страници
  • ×Изпълнението на действията е ваша грижа — Google дава модела, не средата
  • ×Всички числа са отчетени от самия производител, без независима проверка
  • ×Екранните снимки на всяка стъпка бързо надуват разхода за входни tokens
  • ×Достъпът в Vertex AI и в потребителските планове не е публично уточнен
  • ×Функцията computer use още е означена като предварителна версия

Как засяга България новият Gemini 3.6 Flash?

Gemini 3.6 Flash пристига в България по същия път като останалите модели на Google — през API и през приложението Gemini, без отделна местна процедура. За малка фирма разликата е в порядъка: автоматизацията се смята в стотина евро месечно, вместо в проект за няколко месеца.

Голяма част от българската администрация и от счетоводния софтуер работят през уеб форми без публичен API. Точно това е сценарият, за който computer use е направена.

Регулацията обаче се затяга, и то скоро. От 2 август 2026 г. влиза в сила основната част от Регламента за изкуствения интелект, включително задълженията за прозрачност, а всяка държава членка трябва да е пуснала поне една национална лаборатория за изпитване.

Изводът е прост: агент, който действа от името на човек в чужда система, изисква записан журнал на действията и ясно правило кога спира и пита — независимо колко добър е моделът отдолу.

Gemini 3.6 Flash срещу предишното поколение — сравнение на резултатите по тестове
Разликата между двете поколения е най-голяма при кода и при машинното обучение.

Какви са рисковете пред агентите с Gemini 3.6 Flash?

Основният риск не е техническа грешка, а вмъкната инструкция. Агент, който чете уеб страница, приема текста от нея като част от контекста си — а някой може да напише там команда, предназначена за модела.

Тази слабост стои под номер едно в класацията на OWASP за приложения с езикови модели. Причината е архитектурна: системната инструкция, въпросът на потребителя и външният текст живеят в един и същ прозорец на контекста.

Google описва три мерки срещу това: целенасочено обучение срещу такива атаки, автоматично спиране на задачата при засечена вмъкната инструкция и възможност моделът да поиска изрично потвърждение, преди да извърши чувствително действие.

Препоръките на самата компания са по-прости, отколкото звучат. Изолирана среда, човек, който одобрява важните стъпки, и строго ограничени права на достъп. Същият подход, с който се пуска нов служител в чужда система.

Какво следва след Gemini 3.6 Flash?

Google вече посочи следващите две стъпки в същото обявление. Gemini 3.5 Pro остава при партньори за тестване и ще излезе широко, „щом е готов“. По-голямата новина обаче е в едно изречение накрая: компанията е започнала най-мащабното си обучение досега — за Gemini 4.

Дотогава конкуренцията няма да чака. През юли 2026 г. излязоха и GPT-5.6 в три размера, и Claude Opus 5 — а способността да се работи с чужд екран влиза в почти всяко от тези семейства.

Често задавани въпроси за Gemini 3.6 Flash

Какво е Gemini 3.6 Flash?+
Gemini 3.6 Flash е моделът на Google от средния клас, обявен на 21 юли 2026 г. Прави код, работа с документи и многостъпкови задачи на ниска цена, а новото при него е вградената функция computer use.
Какво прави функцията computer use?+
Моделът получава екранна снимка и връща конкретно действие — щракване, писане, скролване, натискане на клавиш или отваряне на адрес. Вашата програма изпълнява действието и връща нова снимка, докато задачата приключи.
Колко струва Gemini 3.6 Flash?+
В платения план цената е 1,50 долара за милион входни tokens и 7,50 долара за милион изходни, като в изходните влизат и tokens за разсъждаване. По-малкият Gemini 3.5 Flash-Lite струва 0,30 и 2,50 долара.
Достъпен ли е Gemini 3.6 Flash в България?+
Да. Моделът се ползва през Gemini API в Google AI Studio, през Android Studio, в Google Antigravity и в Gemini Enterprise, а според 9to5Google влиза и в потребителското приложение Gemini.
По-добър ли е от човек при работа с компютър?+
Не може да се твърди така. Резултатът 83,0% е от обновения тест OSWorld-Verified, докато човешката база от 72,36% идва от оригиналното изследване — двете числа не са пряко сравними.
Какъв е рискът при агент, който сам кликва?+
Основният риск е вмъкната инструкция в текста, който агентът чете. Затова се препоръчват изолирана среда, потвърждение от човек при чувствителни действия и строго ограничени права на достъп.
Кога излиза Gemini 4?+
Google съобщи, че е започнала обучението на Gemini 4, но не е обявила дата. Преди него се очаква широкото пускане на Gemini 3.5 Pro, който засега е при партньори за тестване.

Заключение: какво да запомните за Gemini 3.6 Flash?

Gemini 3.6 Flash не носи по-умен модел. Носи по-широк обхват — същата работа излиза по-евтино, а агентът стига до всеки интерфейс, до който човек има достъп с мишка и клавиатура.

За българските фирми това сваля прага пред автоматизацията на стари системи без API. Сметка от порядъка на стотина евро месечно е по силите и на екип от петима души.

Внимавайте с две неща. Числата идват от самия производител и още нямат независима проверка. А агент, който действа сам в чужда система, изисква същите предпазни мерки като нов човек с права за достъп: журнал, ограничения и одобрение при важните стъпки.

Допълнителни ресурси

Официален сайт:Посетете сайта →
// Споделете
𝕏FBLI
ИД
Иван Драганов

Основател на CyberNinjas.ai и Кибер Хора. Пише за AI инструменти, новини и практически ръководства.

// Свързани

Още статии

Claude Cowork на телефон и лаптоп — AI агент, който довършва офисната работа в облака
Категория: AI Новини

Claude Cowork: AI помощник за офиса на телефон [2026]

Claude Cowork излезе на телефон и в облака през юли 2026 — какво може AI агентът на Anthropic, колко струва и защо е важен за българските офиси и малкия бизнес

10 мин.
Meta Muse Image — AI генераторът на Meta и спорната функция със снимки от публични профили в Instagram
Категория: AI Новини

Meta Muse Image: AI и снимките ви в Instagram [2026]

Meta Muse Image тръгна на 7 юли 2026, а три дни по-късно Meta спря функцията, която ползваше чужди снимки от Instagram. Какво стана и какво остава важно

11 мин.