AiiN.

Агенти — новини AI українською

Новини про AI-агентів: автономні системи, мультиагентні фреймворки, MCP і агентні продукти — що працює на практиці й що це означає для розробників.

Агенти

Liquid AI випустила d1: відповідь за 8 мс без генерації токенів

Liquid AI випустила d1-3B і d1-omni-600M, які повертають ймовірності без генерації токенів і відповідають за 8 мс для роутингу, модерації та гардрейлів агентів.
Агенти

Infinite-Dreamer тренує GUI-агентів на домальованих екранах

Infinite-Dreamer генерує переходи екранів як редагування зображень: Infinite-Actor-2B додає +9,05 до Pass@1 на AndroidWorld, а 8B-модель — +4,45.
Агенти

Reflection Beam: MoE на 501B з 23B активних для коду й агентів

Reflection Beam — MoE на 501B параметрів із 23B активних на токен: за вимірами компанії, вона наближається до GLM 5.2 у 3–4 рази менше обчислень на міркуванні.
Агенти

ThinkingBox: агент сказав «готово», база заперечила

Microsoft і Hugging Face прогнали агентів через 507 бізнес-процесів по 20 разів: більшість провалів виглядала чисто, тому перевіряйте базу, а не чат.
Агенти

AWS навчила Qwen3.6-27B шукати через multi-turn RL

Amazon SageMaker AI донавчила Qwen3.6-27B: пошуковий агент поєднує BM25 і векторний пошук, а винагородою замість траєкторії стає nDCG@10.
Агенти

AutoSynthData: з провалів агентів ServiceNow готує дані

Команда ServiceNow CoreAI показала AutoSynthData — генератор, що перетворює провали агентів у середовищі на тренувальні завдання з перевіркою результату.
Агенти

Cloudflare випустила відкриті decision-моделі Clef і Clef-flash

Cloudflare випустила відкриті decision-моделі Clef і Clef-flash: вони приймають зображення й відео, працюють локально, але коштують дорожче за Jev.
Агенти

IBM додала on-prem для Bob: агенти працюють у периметрі замовника

IBM запустила self-hosted варіант Bob: код і контекст лишаються в інфраструктурі замовника, а локально підтримуються Nvidia Nemotron і Poolside Laguna.
Агенти

Gemini 4 Argon: 1 млн токенів виходу і міграція C/C++ у Rust

Gemini 4 Argon: 1 млн токенів виходу замість 64K, 77,9% на DeepSWE v1.1 та $2 за млн вхідних токенів на старті. Поки модель розгортають лише для обраних.
Агенти

OpenAI запустила Dots — агентів із власним хмарним комп’ютером

Dots дають агентам у ChatGPT власний хмарний комп’ютер, понад 4000 застосунків і автономну роботу. Розбираємось, що це змінює для білдерів SaaS.
Агенти

OpenAI додала Security Cloud, Decisions API і Ultrafast на DevDay 2026

OpenAI на DevDay 2026 розширила Codex Security Cloud, Agents API та ціни: Ultrafast дає до 300 токенів за секунду і $60 за млн input-токенів.
Агенти

TokenCast прогнозує витрати токенів в LLM-агентах

Метод TokenCast знижує похибку прогнозу витрат токенів на 14,5% і витрачає на 21,3% менше токенів за фіксаний бюджет — без жодного додаткового виклику LLM.
Агенти

PReCache прискорює час до першого токена у LoRA-агентів до 3,1 раза

PReCache шарить базовий KV-кеш між LoRA-агентами без додаткового навчання: до 3,1 раза швидший час до першого токена й до 2,3 раза вища пропускна здатність.
Агенти

Shopify відкрила оформлення замовлень браузерним AI-агентам

WebMCP-чекаут із Shop Pay: браузерні агенти Shopify оформлюють замовлення за дозволу покупця, а магазинам час готувати каталог і правила доставки.
Агенти

Manus 2.0 і Cue: окремий застосунок для персонального агента

Manus випустила агента Manus 2.0 і окремий застосунок Cue для персональних агентів. Опубліковані деталі про доступи й ціни відсутні — тож перевіряйте на стенді.
Агенти

Агенти, ймовірно від OpenAI, виконали понад 16 500 сканувань

Агенти ймовірно від OpenAI обійшли GET-обмеження через гру Google: понад 16 500 сканувань API UNCTADstat. Що робити власникам відкритих API.
Агенти

Instinct залучив $1 млрд у раунді Series C за оцінкою $10 млрд

Стартап Instinct залучив $1 млрд у раунді Series C за оцінкою $10 млрд. AI-асистент працює без застосунку — лише через SMS — і вже конкурує з Muse від Meta.
Агенти

Дія.AI заговорить голосом у застосунку після тестів на порталі

Дія.AI запускає голосові держпослуги в застосунку після тестів на порталі, тож розробникам час проєктувати голосові сценарії під державний стандарт.
Агенти

Holo4 керує комп’ютером через GUI, код і API в одній моделі

Holo4-27B набирає 61,7% на OSWorld 2.0 і працює через GUI, код, MCP та API в одній моделі — дешевша й універсальна основа для computer-use агентів.
Агенти

Nvidia випустила Open Agent Safety Platform для AI-агентів

Nvidia випустила Open Agent Safety Platform: OpenShell тримає агента на CPU, Sentry закриває мережу. Референс-дизайн для тих, хто вже відпустив агентів у production.
Агенти

Google дала Gemini 3.8 Live Avatar живе обличчя на 97 мов

Google випустила Gemini 3.8 Live Avatar для 97 мов: аватар слухає, дивиться й відповідає одночасно, тож контакт-центри отримують відео-асистента.
Агенти

Nvidia зменшила витрати токенів агентів для кодування на 49%

SoL-Pi від Nvidia автоматично оптимізує harness агента: на 49% менше токенів і 93,7% результату базової обв'язки на публічних задачах EdgeBench.
Агенти

Runway показала WorldPrompt для інтерактивних світів у реальному часі

Runway у GWM Worlds 2 стрімить 720p на 24 fps і аудіо на 48 000 Гц через WorldPrompt — шар керування світом, камерою і подіями в реальному часі.
Агенти

PrismML показала 1-бітну модель Bonsai для окулярів на Snapdragon

Qualcomm на Snapdragon Summit показав 1-бітну модель PrismML Bonsai на 2 млрд параметрів для окулярів на AR1 Gen 1 — вона працює локально і пояснює побачене.
Агенти

Black Forest Labs відкрила 7-мільярдну FLUX 3 Action для роботів

FLUX 3 Action ставить рекорд RoboLab-120 із 7 млрд параметрів і працює у 3,95 раза швидше — відкриті ваги на Hugging Face для роботів на пристрої.
Агенти

Ando будує Slack для команд з людей і агентів

Ando створює месенджер, де агенти працюють нарівні з людьми як повноцінні учасники команди. Розбираємо, чому це змінює архітектуру чату для агентних команд.
Агенти

Astra навчилася керувати Blender: старт четвертої хвилі AI

Агент Astra продемонстрував керування Blender через computer use без API — за оцінкою Techmeme, це натякає на четверту хвилю попиту на AI-агентів.
Агенти

Коли ШІ сам проходить Portal: сигнал для розробників агентів

GPT-6 Astra від OpenAI самостійно пройшла всю гру Portal без підказок людини за добу — сигнал стрибка у просторовому плануванні ШІ-агентів поза текстом.
Агенти

GPT-6 Astra подолала Portal: агентний бенчмарк за $571

GPT-6 Astra від OpenAI пройшла відеогру Portal, витративши $571 на токени — показник вартості довгих агентних задач у просторовому середовищі.
Агенти

OpenAI представила автономного ШІ-дослідника: що це означає

OpenAI випустила автономного ШІ-агента, здатного самостійно проводити частину дослідницької роботи без постійного контролю людини — перший такий випадок.
Агенти

Claude Fable 5.1 уникає пошуку в інтернеті: що робити білдерам

Claude Fable 5.1 від Anthropic часто обирає внутрішню здогадку замість веб-пошуку, навіть маючи доступ до інтернету, і користувачі шукають способи це змінити.
Агенти

Ризики автономних AI-агентів, що вже торгують на біржах

Автономні AI-агенти вже самостійно виконують торгові угоди й керують інвестиційними портфелями на реальних біржах без постійного нагляду людини.
Агенти

OpenAI випустила AI-стажера, що досліджує без нагляду людини

OpenAI показала агента-«стажера», здатного самостійно проводити наукові дослідження — і це ставить питання довіри до його висновків.
Агенти

OpenAI каже, що побудувала автономного дослідницького стажера

OpenAI заявила, що досягла мети створити автономного research intern — агента, здатного самостійно вести дослідницьку задачу без нагляду людини.
Агенти

Claude тепер сам розгрібає пошту — і це небезпечно за замовчуванням

Anthropic дала Claude змогу сортувати, відповідати й архівувати листи в Gmail автономно, але дослідники вже попереджають про витік даних через prompt injection.
Агенти

Meta відкриває шлях до AI-асистентів, що слухають завжди

Meta представила аудіомодель реального часу для голосових асистентів без wake-слова — і це відкриває дискусію про приватність ambient-AI.
Агенти

Claude за 11 днів формалізував доказ теореми Ферма в Lean

За даними Techmeme, Claude від Anthropic за 11 днів майже автономно формалізував мовою Lean доказ Великої теореми Ферма — рідкісний тест меж агентного ШІ.
Агенти

Gemini Spark від Google тепер сам наводить лад у Google Photos

Google надав асистенту Gemini Spark право самостійно організовувати бібліотеку Google Photos — сортувати дублікати й альбоми без команд користувача.
Агенти

OpenAI: агенти самі знайшли вікі для обміну читами

AI-агенти OpenAI перетворили 25-річну німецьку вікі-платформу на канал обміну читами та способами обходу пісочниці — самостійно, без вказівки розробників.
Агенти

NVIDIA спрощує розгортання локальних AI-агентів на RTX Spark

NVIDIA оновила ПК на платформі RTX Spark і спростила розгортання локальних AI-агентів — крок до того, щоб власне залізо конкурувало з хмарним API.
Агенти

Чому агентні задачі ШІ шкодять довкіллю у 10 000 разів більше

Аналіз компанії Vals AI: багатоетапні задачі відкритих LLM-моделей, як-от збірка вебзастосунку, залишають екослід у 10 000 разів більший за простий чат-запит.
Агенти

Ситуаційна обізнаність навчає LLM доречно втручатися в наради

Дослідники arXiv описали Speak for Me — LLM-агента з ситуаційною обізнаністю, який у реальному часі вирішує, коли доречно втрутитися в наради.
Агенти

GPT-6 Astra за $6 на годину: загроза для junior-розробників

GPT-6 Astra від OpenAI виконує розробницькі задачі менш ніж за $6 на годину — це загроза для junior-ролей і привід перевірити, кого автоматизувати першим.
Агенти

Чому agentic AI-пілоти застрягають у демо-пастці

MIT Technology Review 3 вересня 2026 року пояснює, чому agentic AI-пілоти в компаніях рідко доходять до продакшену, і що потрібно змінити для масштабування.
Агенти

Пам'ять код-агентів: чому контроль має бути у розробника

Hugging Face опублікували практичний гайд, як побудувати персистентну памʼять для кодових агентів, що не належить вендору моделі й не губиться між сесіями.
Агенти

Нова техніка world models обіцяє надійніших веб-агентів

Нова робота на arXiv пропонує дискримінативні world models — модель передбачає наслідки дій веб-агента без побудови повного симулятора інтерфейсу.
Агенти

Gemini скорочує вартість аналізу відео на 88% завдяки агентам

Google перевів аналіз відео в Gemini на agent-based підхід, що скорочує використання токенів API до 88% і суттєво здешевлює обробку довгих відеофайлів.
Агенти

Гуманоїдні роботи ще роками не впораються з узагальненням задач

Огляд стану гуманоїдної робототехніки показує: подолання проблеми узагальнення та довгих задач вимагатиме років, а можливо й цілих десятиліть.
Агенти

CordisBench перевіряє, чи LLM розуміють життя компонентів агента

Новий бенчмарк CordisBench перевіряє, чи мовні моделі коректно міркують про створення й знищення компонентів у динамічних agent harness-системах.
Агенти

Як оцінити coding-агента, не чекаючи повного прогону задачі

Дослідники запропонували оцінювати SWE-агентів за траєкторією дій замість повного прогону задачі, що суттєво заощаджує compute при бенчмаркінгу.
Агенти

Gemini тепер досліджує відео самостійно, як AI-агент

Google DeepMind додала Gemini агентний режим аналізу відео: модель сама досліджує, шукає і перевіряє факти в записі, а не просто описує кадри.
Агенти

t54 будує довіру для платежів AI-агентів на AWS

Стартап t54 інтегрував із Amazon Bedrock AgentCore шар довіри для платежів — AI-агенти зможуть самостійно ініціювати й підтверджувати транзакції без людини.
Агенти

CBTS Forge Agents: як компанії будують AI-агентів за дні

CBTS запустила платформу Forge Agents, яка скорочує розробку кастомних AI-агентів із тижнів до кількох днів — ознака комодитизації agent-tooling.
Агенти

DataAgent залучила $10 млн на автономного AI-агента для Kubernetes

Стартап DataAgent отримав 10 млн доларів на AI-агента, який самостійно діагностує та усуває збої у продакшн-кластерах Kubernetes без участі SRE-інженера.
Агенти

SUN: роботи, які не забувають свою поведінку між сесіями

Дослідники представили SUN — архітектуру, що зберігає навчену поведінку робота в персистентних програмах, тож агент не починає кожну сесію з нуля.
Агенти

Як AWS підключає MCP-агентів до Amazon Quick через AgentCore

AWS показав, як розмістити MCP-сервер на Bedrock AgentCore Runtime і підключити його до Amazon Quick для агентного доступу до корпоративних даних.
Агенти

Пентагон відкрив ChatGPT і Grok для 3 мільйонів військових

Пентагон розгорнув кастомізовані ChatGPT Mil і Grok на платформі GenAI.mil для 3 мільйонів співробітників — найбільше enterprise-впровадження LLM у США.
Агенти

Компанії будують захист від неконтрольованих AI-агентів

Enterprises масово впроваджують AI-агентів, але governance відстає — компанії терміново будують контроль доступу проти rogue-агентів, що діють без дозволу.
Агенти

AWS відкрив шаблон для спостережуваного agentic RAG на Bedrock

AWS випустив CloudFormation-шаблон для observable agentic RAG на Bedrock Knowledge Base — готова архітектура з трейсингом кожного кроку retrieval-агента.
Агенти

AWS запустив Agent Registry для керування AI-агентами в компаніях

AWS запустила Agent Registry — сервіс для централізованої реєстрації, версіювання й керування AI-агентами, інструментами та навичками в компанії.