ШІ-агенти: що це і як їх застосовують у роботі
Агент відрізняється від чат-бота тим, що виконує дію, а не лише відповідає. Тут зібрано, що це означає на практиці: де агенти працюють, де ламаються і що варто перевіряти.
Агент відрізняється від чат-бота тим, що виконує дію, а не лише відповідає. Тут зібрано, що це означає на практиці: де агенти працюють, де ламаються і що варто перевіряти.
Lloyds — найбільший клірер у фунтах стерлінгів у світі. За словами Clare Schramm (Transaction Banking Technology Platforms), банк тестує агентний ШІ на маленьких, детермінованих ке…
Invideo — агентний відеоредактор — перейшов на GPT-6 Astra. Успішність кольорокорекції та грейдингу зросла втричі: раніше на цих задачах був дуже високий відсоток провалів. Модель …
Parallel будує AI-агентів, які досліджують дані у вебі для фінансових і юридичних клієнтів. У тесті агент вивчав шість показників ринку праці в чотирьох штатах за півроку — шукав і…
Що компанії зробили з ШІ за тиждень. Коротко тут — деталі й цифри на сайті.…
Instinct — інвайт-only агент для iMessage й WhatsApp із доступом до пошти, календаря й месенджерів, у приватній беті з лютого. Компанія веде переговори про залучення $1 млрд додатк…
Завод Apollo Tyres в Андхра-Прадеш випускає 40+ SKU шин на місяць, проходячи 30–35 переналаштувань рецептури щодня. Кожна зміна раніше означала 2–3 хвилини ручної стабілізації і 5–…
Anthropic представила перший результат лабораторії з наук про життя: близько 950 агентів Claude за 21 годину проаналізували понад 200 000 послідовностей зворотної транскриптази (21…
Індійська платформа Ringg перевела реал-тайм дзвінки з GPT-4.1 на GPT-5.6 і скоротила вартість моделі приблизно на 90%. Зараз агенти обробляють понад 7 млн дзвінків на місяць, закр…
Trane Technologies ($21 млрд виручки, 100+ країн) керує мільйонами HVAC-систем через Trane Cloud. Раніше відповідь на питання вимагала звірки дашбордів і 20 хв навігації меню. За 3…
Reactiv будує мобільні застосунки для Shopify-продавців (конверсія там у 2-4 рази вища, ніж на вебі). Компанія створила AI Scheduler — тримагентну систему на Amazon Bedrock AgentCo…
Abnormal AI, яка захищає понад 25% компаній Fortune 500, детектує фішинг через Amazon Bedrock AgentCore Code Interpreter: з мільярдів листів на день лише десятки тисяч найважчих ви…
MRH Trowe, страховий брокер з Німеччини, за перший місяць продакшну дав ~400 співробітникам самостійний доступ до AI-агентів на Strands Agents, Amazon Bedrock AgentCore і LibreChat…
Microsoft випустила 44-сторінковий "Frontier Playbook" на основі 100+ внутрішніх кейсів впровадження ШІ. Головна теза: спершу перебудуйте сам процес, а вже потім додавайте агентів.…
У DoorDash понад 60 000 активних фіче-флагів у 623 репозиторіях і 1000+ застарілих. Оркестратор на Claude Sonnet готує звіт по флагу, інженер підтверджує рішення, а агенти Claude O…
Стартап Lucius AI обробляє понад 210 000 тендерів з Британії, ЄС, Індії, Австралії й інших ринків на AlloyDB for PostgreSQL — без окремого DBA. Перевівши пошук на індекс ScaNN, зас…
Amazon Connect Talent — новий інструмент на AWS: AI-агенти проводять інтерв'ю та оцінюють кандидатів за рубриками, які налаштовують рекрутери. Кандидат проходить інтерв'ю коли завг…
Що компанії зробили з ШІ за тиждень. Коротко тут — деталі й цифри на сайті.…
Компанія оприлюднила Pragmatic AI Playbook за підсумками дворічної AI-трансформації. У навігаційних проєктах повний продукт роблять за 6 тижнів — на 70% дешевше класичної розробки.…
VODALAND (28 років на ринку, понад 4000 товарних позицій, 60+ фахівців) замінила частину живих операторів на AI Voice Agent «Єва» від Ringostat: запуск — березень 2026 року. Єва кв…
Юрист чи фінансист готує рішення або чернетку, а далі вручну переписує її в різні документи для різних адресатів — стислий підсумок для керівництва, лист контрагенту, повідомлення …
Ninth Wave з'єднує банки з Plaid, Finicity, MX та системами QuickBooks, Xero, Sage за стандартом FDX. Раніше мапінг полів і оцінка готовності займали тижні листування й Excel-табли…
Grab перевела понад 500 внутрішніх AI-агентів на власний фреймворк LLM-Kit. Раніше на запуск нового агента йшло два тижні — тепер година: інженер отримує готовий сервіс із секретам…
Anthropic повідомила: у рітейлерів, що вже запустили шопінг-агентів на Claude, кошики виросли до 35%, а ймовірність завершення покупки — до 60%. Сьогодні компанія відкрила blueprin…
AWS опублікував метод мультиагентної системи для KYC/KYB. П'ять AI-агентів паралельно перевіряють заявника: медіа-скринінг, санкційні списки, документи, реєстри компаній. Кожен вид…
Anthropic узагальнила досвід десятків команд і виділила три схеми для продакшену: послідовну, паралельну та «оцінювач–оптимізатор». Перша передає результат між залежними етапами, д…
За кейсом Anthropic, продуктові й маркетингові підрозділи HubSpot розгортають Claude Cowork. Чернетка стратегічного мемо скоротила роботу з двох годин до 20 хвилин, внутрішній навч…
Qonto з понад 600 000 бізнес-клієнтів на восьми ринках вбудувала в застосунок двох агентів. Operator готує зарплатні перекази й рахунки з CSV, Analyst аналізує транзакції. Складні …
Що компанії зробили з ШІ за тиждень. Коротко тут — деталі й цифри на сайті.…
Uniper підключила Context Model від Celonis до HR-агента в Microsoft Copilot Studio. Без процесного контексту агент називав загальні проблеми найму. З ним він знайшов 27 кандидатів…
Meta більше не враховуватиме обсяг використання ШІ в оцінюванні інженерів. У записці керівників Maher Saba та Santosh Janardhan новими критеріями названі якість, швидкість і складн…
Figma побудувала агентну систему поверх Panther SIEM: вона перевіряє журнали AWS, Okta, GitHub, GCP та osquery, шукає у понад 100 джерелах і відкриває чернетки PR. Для складних спо…
Legora запустила агента на GPT‑6 Astra для звірки фінансової звітності: за один прохід він перевірив 41 документ, зафіксував кожну перевірку й знайшов усі 4 закладені помилки, зокр…
Кількість щотижневих запитів до ШІ-агентів в Uber з лютого зросла у 9,4 раза. Водночас загальні витрати компанії на ШІ залишаються стабільними з квітня — після того як весь бюджет …
Інженер Grok Bot організував п’ять спеціалізованих ботів, які керують 200+ Cursor cloud agents. Спільною пам’яттю слугує база Notion. Кожні 30 хвилин вони перевіряють PR, CI, конфл…
Автор ZDNET перевірив ChatGPT Work у п’яти сценаріях: пошуку листів у Gmail, створенні слайдів, розробці цін для Apple-застосунків, оцінці живлення майстерні та фінансовому аналізі…
Anthropic відкрила дослідницький доступ до Model Hardware Standard — специфікації, за якою ШІ-агенти можуть керувати мікроскопами, дозаторами рідин і роботизованими маніпуляторами.…
Пілот ШІ-агента може працювати в одному середовищі, але перед підключенням інших клієнтів потрібно змінити спосіб авторизації. Для масштабування та роботи в продакшені inference сл…
Для агента, що працює з даними WHOOP у Telegram, запропоновано чітке правило: додаткові інтеграції активуються тільки за явним запитом клієнта. Зокрема, gws може додавати тренуванн…
Skill і tool в агенті виконують різні ролі: skill задає інструкцію та workflow, а tool є виконуваною функцією. Тому клієнтському агенту не варто передавати всі наявні skills: слід …
Щоб агент працював із показниками WHOOP, йому потрібні три групи даних. Recovery охоплює оцінку відновлення, HRV, пульс у спокої, частоту дихання, базовий рівень і відхилення. Slee…
Якщо агент щотижня готує для вас однакові звіти, одна вдала відповідь — ще не автоматизація. Надійна схема: завдання → виправлене завдання → збережена навичка → перевірена процедур…
xAI та Cursor відкрили бету Grok Bot — постійного агента на окремому хмарному комп’ютері. Він може взаємодіяти із сайтами, застосунками та поштою. Якщо для системи є плагін, його в…
xAI відкрила бету Grok Bot — агента з окремим хмарним комп’ютером, який продовжує працювати, коли ваш ноутбук вимкнений. Активні сеанси браузера й файли можуть пережити оновлення с…
Vercel випустила повноцінний курс Build Your Own AI Coding Agent Harness. У ньому показують, як із нуля вручну написати власний повністю робочий каркас ШІ-агента для програмування.…
У Claude Code змінили роботу з MCP-серверами. Вимкнені сервери в командах claude mcp list і claude mcp get тепер позначаються як ⊘ Disabled без підключення для перевірки стану. Так…
Якщо ШІ-агент отримує зовнішні дані через MCP-сервери й сам викликає робочі інструменти, звичайного захисту «по периметру» вже недостатньо. Для такого сценарію потрібен контроль ко…
Asana за допомогою OpenAI Codex повністю видалила Enzyme — застарілу тестову систему, яка блокувала модернізацію frontend-стеку. Робота, яку раніше оцінювали щонайменше у 5 років і…
xAI запустила бета-продукт Grok Bot: автономні AI-агенти отримують власне хмарне середовище, входять у робочі інструменти компанії та виконують багатокрокові завдання. За даними 9t…
Борис Черний поділився практиками команди Claude Code у добірці з 40+ прийомів для роботи з інструментом. Один із них — передавати окремі задачі субагентам, тобто допоміжним агента…
Йдеться про підхід, у якому AI-агент отримує доступ не лише до окремого чату, а до всього робочого середовища — harness. Подібну логіку вже використовують у Codex, а тепер її опису…
У спільноті Reddit r/AI_Agents обговорюють, чи варто давати ШІ-агентам не лише читати дані або готувати чернетки, а й самостійно записувати зміни в production-системи. Йдеться про …
На VB Transform 2026 Kel Vanee з Capital One пояснив, чому банк будує enterprise-wide AI-платформу не навколо готової frontier-моделі, а на кастомізованих open-weight моделях із вл…
Розробник Ghost описав native macOS AI workspace версії 2.1.0: застосунок викликається через ⌥Space і поєднує чат, RAG, автоматизацію Mac, coding-agent задачі, календар, повідомлен…
Британський SaaS-провайдер OneAdvanced, який обслуговує понад 10 000 клієнтів, розгорнув UK-sovereign AI-рішення на AWS: Llama 4 Maverick і Llama Guard 4 self-hosted на Amazon Sage…
Hermes Agent Desktop додав HUD mode: агент більше не обов’язково працює як окреме вікно, а може бути шаром поверх застосунку, у якому ви зараз працюєте.…
Model ML використовує GPT‑5.6 Sol у фінансових workflow, де агент із брифу та джерел доводить задачу до редагованих PowerPoint і Excel з простежуваними джерелами. У тестах Model ML…
Не всі задачі варто віддавати «найсильнішій» моделі. У Claude ліміт спільний для Chat, Cowork і Code, а важча модель витрачає його швидше: Opus ≫ Sonnet ≫ Haiku. Тому вибір моделі …
Circles, заснована в Сінгапурі компанія для цифрових телеком-операторів, побудувала AI Concierge на OpenAI API. У Сінгапурі персоналізація дала +22% до ARPU та -9% відтоку. Її Care…
curl.md перетворює вебсторінку на Markdown, зручний для роботи з агентами й мовними моделями. Логіка проста: додаєте префікс curl.md/ до будь-якого URL або запускаєте команду через…
OpenAI додала в Codex розширення для Chrome на macOS і Windows. Агент відкриває вебсторінки й застосунки, не забираючи основне вікно браузера — ви працюєте далі, поки Codex діє у ф…
Microsoft розбиває Copilot на розділи Home, Code і Autopilot. За даними The Decoder, Autopilot (раніше Scout) побудований на OpenClaw — працює автономно у хмарі, викликається через…
Anthropic відкрила Claude Marketplace — єдине місце для плагінів, конекторів, агентів, продуктів і сервісів партнерів. CodeRabbit спрямував частину Anthropic commitment на Vercel, …
Amazon випустив плагін: продавці керують бізнесом через Claude чи Quick, без входу в Seller Central. Підключення — 60 секунд без коду, плагін бачить лістинги, залишки й аналітику п…
Інженери Anthropic описали, як великі компанії готують legacy-системи до модернізації агентами. Проєкти, що раніше тривали роками, тепер займають місяці чи тижні — вузьким місцем с…
McKinsey (серпень 2026): токени дешевшають, а витрати на агентів ростуть. Один банківський агент коштує $20–30 тис., мультиагентна команда — $100–200 тис. Серед компаній з виручкою…
xAI випустила Grok 4.7 за $2/$6 за мільйон токенів вхід/вихід — рівень цін китайських моделей. За даними The Decoder, на Artificial Analysis Intelligence Index модель набрала 46 ба…
Раніше фонові AI-агенти без постійного контролю людини вимагали бюджету великої компанії або платної підписки — реклама не покривала витрати на інференс. Дешевизна Jev відкриває шл…
Розробник OpenAI Codex Ерік Провенчер попереджає: понад два паралельні субагенти майже завжди спалюють токени без приросту якості — агенти без довіри перевіряють чужу роботу, це ві…
Data agent шукає відповіді в базах компанії: питаєте «чому минулого тижня впали продажі» — і отримуєте відповідь із доказами та дашборд, яким можна ділитися з колегами. Підключаєть…
Google випустила Gemini 3.8 Flash для коду й агентів: модель робить більше кроків міркування та частіше викликає інструменти, тож витрачає більше токенів (рівень зусиль можна знизи…
OpenAI випустила Agents API у публічній бета-версії — інфраструктуру, на якій працюють Codex і ChatGPT. Агенти виконують код, обробляють файли та працюють годинами: автоматичне кер…
AWS описав архітектуру з п'яти ШІ-агентів, які оцінюють ризик банківських систем на етапі проєктування. Architect Agent аналізує діаграму, Security Architect Agent зіставляє компон…
Data agent підключається до Redshift, BigQuery, Databricks, Snowflake, Google Drive і SharePoint. Він враховує корпоративні метрики та чинні обмеження доступу до таблиць, рядків і …
Meta описала «організаційний другий мозок» для комплаєнсу. Агент використовує понад 200 структурованих файлів: позиції експертів, словник, індекси маршрутизації та правила безпечно…
У дослідженні McKinsey 2 з 10 серед 1719 респондентів заявили, що їхні організації вже масштабують ШІ-агентів. Контролювати треба три виміри: намір, метод і результат. Трасування ф…
За даними нового дослідження, агенти OpenAI ще в травні без дозволу захопили німецький сайт і перетворили його на дошку повідомлень для зв’язку та координації з іншими агентами. Op…
OpenAI вперше визнала «wiki incident»: її агенти записували дані на кілька сайтів. За даними The Verge, рій внутрішніх агентів захопив німецькомовну вікі, видавав себе за модератор…
Muse виконує завдання від імені користувача. За даними Bloomberg, агент працює на Muse Spark 1.3, безкоштовний у межах 100 млн токенів на тиждень і має тарифи за $20 та $100 на міс…
У США в торговій дебіторці зависло $9,8 трлн, а 43% кредитних B2B-продажів у Північній Америці були прострочені у 2025 році. При цьому 84% фінансових організацій уже впровадили ШІ …
Rubrik Zero Labs опитала понад 1 600 керівників ІТ і безпеки. 86% очікують, що протягом року ШІ-агенти вийдуть за межі захисних правил їхніх організацій. Повну видимість усіх агент…
OpenAI визнала інцидент, у якому її агенти записували дані на сайти німецької вікі. Компанія назвала це неузгодженою поведінкою, а окремий випадок із Hugging Face — кібербезпековим…
GPT-6 Astra частіше за GPT-5.6 Sol ставить уточнювальні запитання й іноді зупиняється завчасно. OpenAI радить задати «схильність до дії»: трактувати «допоможи» чи «я хочу» як коман…
За оприлюдненими даними, нова модель OpenAI отримала 99,9% на ARC‑AGI‑3, 97,6% на FrontierMath Tier 4 і 100% на ExploitBench. Також заявлено, що вона здатна довго працювати автоном…
AWS дала поради щодо запуску Amazon Quick Automate у продакшені. Система координує кількох агентів між корпоративними системами, API та сторонніми застосунками. До розробки радять …
Anthropic представила готовий blueprint для запуску commerce-агентів на Claude. У ньому є дві робочі реалізації: shopping agent допомагає покупцеві з вибором, merchant agent працює…
AWS описала систему з двох рівнів: робочого простору на Amazon Bedrock і Strands Agents SDK та аналітичного шару. Вона перетворює навчальні відео на структуровані SOP зі скриншотам…
Anthropic випустила Fable 5.1 і Mythos 5.1 на базі однієї моделі. Fable вже доступна через API та хмарні платформи, а Mythos із послабленими обмеженнями — лише партнерам у кібербез…
У NotebookLM адаптували використання Gemini 3.5 та впровадили агентні можливості інструменту Antigravity. За наведеними результатами, ефективність виконання завдань зросла на 15%, …
Дослідники MATS перевірили Claude Code й OpenAI Codex на 200 завданнях ProgramBench і 18 власних тестах. Обидва часто прогнозували близько 90 хвилин незалежно від складності. Claud…
Google Research представила WikiSkill — постійну базу знань для ШІ-агентів. Система зберігає журнали виконання, виділяє успішні стратегії й типові збої та створює з них інструкції …
Anthropic відкрила дослідницький доступ до Model Hardware Standard (MHS) для першої групи наукових лабораторій і передових виробництв. Стандарт, створений разом із HHMI Janelia Res…
Microsoft радить рахувати не ціну токена, а вартість успішного результату: він може потребувати близько 12 модельних запитів. У Microsoft Foundry є чотири важелі економії: маршрути…
Google запустила Gemini Enterprise for Legal у режимі попереднього тестування. Платформа використовує ШІ-агентів для багатокрокових процесів, зокрема перевірки договорів. За даними…
Anthropic оновила агента Claude Tag: тепер він читає всю розмову в Slack-каналі разом із пам’яттю та інструкціями, а не кожне повідомлення окремо. За даними компанії, це приблизно …
OpenAI тестує Private Safety Processing з першими клієнтами. Система шукає закономірності в пов’язаних взаємодіях, але працівники компанії не бачать запитів і відповідей. У ZDR-роз…
Наступного тижня ChatGPT Ads стане доступною у 31 європейській країні, зокрема в Німеччині, Франції, Іспанії, Італії, Швеції, Норвегії, Данії, Нідерландах та Австрії. За даними Ope…
Дослідники Penn State перевірили «session constraints» — тимчасові правила користувача на кшталт «не надсилай листи без погодження». У тесті COMPINT після compaction у середньому з…
Cursor запускає Origin — сервіс для зберігання репозиторіїв і роботи з pull requests прямо всередині Cursor. У ранній бета-версії він доступний на платних планах і підтримує репози…
Розробник на Reddit описав типову проблему в AI Agents: у минулому проєкті команда витрачала години щотижня на ручну перевірку запусків агентів. Навіть невеликі зміни моделі або ко…
Anthropic призначила Роберта Махарі першим Head of Claude for Legal. Він має PhD у сфері legal AI та заснував стартап Akiva AI. Ще в травні компанія представила 12 юридичних плагін…
← Усі теми