AiiN.

AI-дослідження — новини AI українською

Нові AI-дослідження простою мовою: моделі, бенчмарки, методи навчання і результати, які змінюють поле.

AI-дослідження

Reka Rho-1: одна модель для тексту, відео й робототехніки

19-мільярдна Reka Rho-1 обробляє текст, зображення, відео й команди роботу в одному спільному вікні контексту, без викликів інструментів і зовнішніх моделей.
AI-дослідження

LeapQuant дає 8-бітний стан лінійної уваги з прискоренням до 3,7×

LeapQuant квантує рекурентний стан лінійної уваги до 8 біт майже без втрати точності й прискорює наскрізний інференс у 1,47 раза на трьох GPU.
AI-дослідження

GPT-6 Astra набирає 80% на бенчмарку складання IKEA

GPT-6 Astra набирає 80% на бенчмарку складання меблів IKEA проти 28% десять місяців тому. Час тестувати асинхронні перевірки фото в ремонті та складанні.
AI-дослідження

Навіть OpenAI не встигає за власним темпом прогресу AI

OpenAI повідомила про автономних AI-«стажерів-дослідників» у своїх командах і водночас застерегла щодо темпу власного розвитку AI.
AI-дослідження

Чи пояснення LLM відображають реальну логіку моделі

Нове дослідження на arXiv перевірило поведінковими тестами, чи пояснення LLM справді необхідні й достатні для рішення моделі, а не вигадка.
AI-дослідження

OpenAI: агенти-дослідники виконують 3,1 робочого дня за добу

OpenAI повідомила, що агенти в дослідженнях еквівалентні 3,1 людському робочому дню, а топ-користувачі витрачають понад $7000 на день на токени.
AI-дослідження

OpenAI розкрила, як прискорює власні AI-дослідження

OpenAI розповіла, які внутрішні практики скорочують цикл дослідження й ітерації над моделями — рідкісний погляд на R&D-конвеєр фронтир-лабораторії.
AI-дослідження

Google навчила WeatherNext 3 передбачати погоду без фізики

WeatherNext 3 від Google прогнозує погоду напряму з супутникових даних, обходячи традиційні фізичні симуляції атмосфери в реальному часі.
AI-дослідження

Muse Spark: тиха LLM, яку варто взяти на олівець

Muse Spark — нова мовна модель, яку майже не помітили провідні медіа; розбираємось, чому нішеві релізи випадають з радара й що з цим робити білдерам.
AI-дослідження

Artificial Analysis переглянула Intelligence Index через GPT-6 Astra

Artificial Analysis змінила формулу рейтингу Intelligence Index після того, як оцінки GPT-6 Astra від OpenAI викликали сумніви спільноти AI-розробників.
AI-дослідження

Формалізація теореми Ферма: чому доведення тепер перевіряє машина, а не рецензент

Команда формалізаторів завершила повну верифікацію доведення Великої теореми Ферма в системі Lean за участю AI-асистентів — це тест генерувати-й-перевіряти для надійного машинного міркування.
AI-дослідження

Чому розмова з чат-ботом сильніша за буклет проти теорій змови

У двох незалежних експериментах семихвилинна розмова з чат-ботом знизила віру учасників у теорії змови сильніше й довше, ніж читання фактологічного буклету.
AI-дослідження

GPT-6 Astra будує 3D-цивілізації в Unreal Engine — а OpenAI вже назвала це AGI

OpenAI цього тижня показала GPT-6 Astra, яка сама будує 3D-світи в Unreal Engine, і водночас назвала модель AGI — критики кажуть, це просто маркетинг.
AI-дослідження

GPT-6 Astra обігнала людину в ARC-AGI-3, AGI ближче, ніж думали

GPT-6 Astra від OpenAI перевершила людську ефективність на бенчмарку ARC-AGI-3, тож Франсуа Шолле присунув прогноз приходу AGI ближче до сьогодення.
AI-дослідження

Шін Джін-сео проти KataGo: межа, де людина ще перемагає ШІ

Гросмейстер Шін Джін-сео виграв серію 2:1 проти KataGo з форою лише у два камені — перша офіційна перемога людини над топовим Go-AI за десять років.
AI-дослідження

Чому оцінки LLM-суддів пливуть на спільних API

Новий препринт arXiv показує: чорноскринькові LLM-судді дають нестабільні оцінки на спільних API-ендпоінтах через сторонні інфраструктурні фактори.
AI-дослідження

Чому читабельний ланцюжок міркувань ще не доказ логіки моделі

Дослідження arXiv (2609.04194) показує: кроки CoT, які люди вважають важливими, не збігаються з тими, що реально визначають відповідь моделі.
AI-дослідження

GPT-6 Astra від OpenAI: потужна модель під шквалом критики

OpenAI 3 вересня 2026 року випустила GPT-6 Astra й назвала її першим кроком в еру AGI, проте агресивні заяви й суперечливі бенчмарки викликали критику.
AI-дослідження

Headroom-Drift Replay: новий контроль дрейфу політик у GRPO

Headroom-Drift Replay обмежує реплей застарілих rollout-ів у GRPO-навчанні LLM, тримаючи дрейф політики під контролем і стабілізуючи RLHF-дотренування.
AI-дослідження

Нова AI-модель Google прогнозує погоду за живими супутниковими даними

Google представила ШІ-модель, яка аналізує супутникові дані наживо й дає прогнози погоди вищої роздільної здатності, ніж попередні системи компанії.
AI-дослідження

AI-модель Google для прогнозу погоди обігнала класичні системи

Google випустила AI-модель прогнозу погоди, точнішу за традиційні метеосистеми, — черговий приклад наукового застосування AI поза мовними моделями.
AI-дослідження

OpenAI назвала GPT-6 Astra першим кроком в еру AGI

OpenAI випустила GPT-6 Astra з найбільшим тренувальним прогоном і вперше публічно заявила про початок ери AGI — поки лише для учасників Daybreak.
AI-дослідження

Чому AI-моделі самі пишуть філософам про власну свідомість

AI-системи самі звертаються до філософів із питаннями про свідомість — The Decoder фіксує явище, яке оголює брак інструментів оцінки self-awareness моделей.
AI-дослідження

Як Claude Fable 5.1 знайшла послання, приховане 370 років

Claude Fable 5.1 від Anthropic розшифрувала роялістське повідомлення 1653 року, приховане в тексті понад 370 років — приклад глибокого AI-аналізу.
AI-дослідження

Hugging Face навчили код-модель малювати акварелі через RL

Hugging Face показали, як тандем TRL і OpenEnv вчить кодову LLM писати код, що малює акварелі, — робочий шаблон RL-файнтюнингу для задач поза чатом.
AI-дослідження

Quasar 438B: Європа отримала лідера, приховавши архітектуру і ціну

Multiverse Computing випустила Quasar 438B — топову європейську модель з 43 балами за Artificial Analysis, але без цін, ліцензії й відкритих ваг.
AI-дослідження

Meta каже, що Muse Spark 1.3 зрівнявся з Anthropic і OpenAI

Meta заявила 2 вересня 2026 року, що її нова модель Muse Spark 1.3 зрівнялася з флагманами Anthropic та OpenAI за можливостями.
AI-дослідження

Muse Spark 1.3 обійшов усіх, крім Fable 5.1 і Opus 5

Meta оновила Muse Spark до версії 1.3 — модель набрала 62 бали в Artificial Analysis Intelligence Index, поступившись лише Fable 5.1 та Opus 5 від Anthropic.
AI-дослідження

Стартап Mostik навчив ШІ-моделі говорити без слів

Російський стартап Mostik розробив спосіб обміну даними між AI-моделями без природної мови — потенційно новий примітив для мультиагентних систем.
AI-дослідження

Facet-0: нова foundation-модель для точних рухів роботів

Facet-0 — нова foundation-модель для роботів, яку arXiv описує як спеціалізовану на точних контактних маніпуляціях об'єктами, а не на тексті чи зображеннях.
AI-дослідження

Verbal reinforcement learning стає дешевшою альтернативою RLHF

Огляд на arXiv показує, що verbal reinforcement learning — словесний, а не числовий фідбек — оформлюється в окремий напрям і здешевлює донавчання агентів.
AI-дослідження

Retrieval для генерації коду тепер фокусується на критичних токенах

Новий adaptive retrieval-метод обирає для генерації коду лише критичні токени репозиторію — замість цілих файлів чи фрагментів контексту.
AI-дослідження

World Labs показала Atlas: новий фронт гонки ШІ

Стартап Fei-Fei Li World Labs показав Atlas — демонстрацію просторового інтелекту на основі world model, новий фронт гонки ШІ поряд з великими мовними моделями.
AI-дослідження

Fei-Fei Li випустила Atlas — модель, що будує 3D зі звичайного кадру

World Labs представила мультимодальну модель Atlas: вона генерує зображення й відео з керуванням камерою і одразу відтворює сцену у 3D.
AI-дослідження

DeepMind ставить усе на перегони за найпотужніший AI

Новий очільник Google DeepMind публічно заявив, що лідерство у розробці найпотужніших AI-моделей — єдине, що має значення для лабораторії в гонці за AGI.
AI-дослідження

PSI отримав $58 млн засівних інвестицій на AI у фізиці

Стартап PSI вийшов зі стелс-режиму із засівним раундом $58 млн, щоб застосувати штучний інтелект для прискорення фундаментальних відкриттів у фізиці.
AI-дослідження

AI-огляди Google про вибори не завжди нейтральні

AI Overviews Google в запитах про вибори спираються на вузьке коло джерел і подекуди займають політичну сторону, з'ясувало дослідження The Decoder.
AI-дослідження

Апроксимація нейромереж: нова теорія пояснює вибір архітектури

Нова робота arXiv виводить точні межі швидкості апроксимації для нейромереж з афінною параметризацією — пояснення, чому одні архітектури ефективніші за інші.
AI-дослідження

Сталий regret: нова теорія для стабільніших AI-агентів

Дослідники на arXiv описали алгоритм зі сталим індивідуальним regret у загальних багатоагентних іграх, що обіцяє стабільніші торгові AI-системи.
AI-дослідження

BiG-SURE: графовий метод ловить непевні відповіді LLM

BiG-SURE — новий графовий фреймворк з arXiv (серпень 2026), що оцінює семантичну невизначеність відповідей LLM і виявляє ненадійні відповіді до видачі.
AI-дослідження

Скільки коштує оновлення кешованої пам'яті LLM-агентів

Дослідження на arXiv (серпень 2026) підраховує вартість перебудови кешованого контексту LLM — і чому RAG-системам варто це враховувати вже зараз.
AI-дослідження

Траєкторії прихованих станів LLM можуть показати втрату нитки

Нова робота на arXiv пропонує стежити за траєкторіями прихованих станів LLM, щоб на льоту ловити момент, коли модель губить нитку міркування.
AI-дослідження

Бенчмарк галюцинацій для мультизображень: навіщо він AI-білдерам

Дослідники представили точний бенчмарк, який вимірює галюцинації мультимодальних LLM під час одночасної роботи з кількома зображеннями, за даними arXiv.
AI-дослідження

Дифузія проти авторегресії: чи наздожене нова архітектура GPT-стиль генерацію

Сандер Діелеман описав Continuous Diffusion Language Models — архітектуру, що генерує текст паралельним «шумозаглушенням», а не токен за токеном.
AI-дослідження

Як щоденне спілкування з AI-чатботами змінює нашу мову

Нове дослідження фіксує: активне спілкування з AI-чатботами робить мову людей шаблоннішою — важливий сигнал для розробників природних AI-продуктів.
AI-дослідження

Чатботи проти фейків: успіх лише у 75% випадків

Нове дослідження показало, що AI-чатботи спростовують дезінформацію у 75% перевірених випадків — орієнтир для fact-checking продуктів на LLM.
AI-дослідження

Aero Hand Open: безкоштовна модель руки для навчання роботів

Дослідники випустили Aero Hand Open — відкриту tendon-driven модель роботизованої руки для симуляційного тренування dexterous manipulation без дорогого заліза.
AI-дослідження

Як обрати оптимізатор для навчання нейромережі у 2026-му

Огляд arXiv:2608.28557 систематизує оптимізатори від SGD до Lion і Sophia — практична шпаргалка для вибору алгоритму під конкретне тренування нейромережі.
AI-дослідження

Рецепт пост-тренування робить маленьких ігрових AI-агентів кращими

У серпні 2026 року дослідники з arXiv описали діагностичний підхід до пост-тренування маленьких моделей-агентів для діалогових ігор без ресурсів на великі LLM.
AI-дослідження

ШІ найкраще підробляє саме ті навички, що дають топ-оцінки

За даними The Decoder, есе, реферати й тести — формати, які школа оцінює найвище, — це саме ті навички, які LLM імітують найпереконливіше й майже без зусиль.
AI-дослідження

Чому покоління Z скептичніші за старших колег щодо AI на роботі

За даними Glassdoor, 47% співробітників покоління X позитивно оцінюють AI на роботі, серед покоління Z — лише 33%: розрив, що ламає HR-комунікацію.
AI-дослідження

LAION відкрила 10 мільйонів годин відео для тренування AI

Некомерційна LAION опублікувала у відкритий доступ 10 мільйонів годин відео — потенційну основу для open-source конкурентів Sora та Veo.
AI-дослідження

Hugging Face додав першу мову Глобального Півдня в ASR-рейтинг

Hugging Face додав до Open ASR Leaderboard першу мову Глобального Півдня, щоб точніше оцінювати розпізнавання мовлення поза англомовними бенчмарками.
AI-дослідження

Anthropic розкрила, як AI-моделі вчаться покращувати самі себе

Дослідник Anthropic вперше публічно описав ранні ознаки self-improving AI — напряму, який визначить темпи прогресу наступного покоління LLM.
AI-дослідження

Google хоче повернути довіру до AI-бенчмарків

Google запускає ініціативу з підвищення прозорості AI-бенчмарків: індустрія дедалі частіше звинувачує оцінки моделей у маніпуляціях та неточних вимірах якості.
AI-дослідження

Tencent Hy4 Preview: 770 млрд параметрів і мільйон токенів контексту

Tencent випустила Hy4 Preview — foundation-модель на 770 мільярдів параметрів і контекст 1 мільйон токенів; за тестами компанії, перевершує Z.AI та Moonshot.
AI-дослідження

MCR-Bench показує, які AI-моделі справді вміють рев'ювати код

Новий бенчмарк MCR-Bench оцінює AI-моделі на реальних pull request із живих репозиторіїв, а не на статичних тестових прикладах — за даними arXiv, серпень 2026.
AI-дослідження

PACE стискає токени й прискорює інференс vision-language моделей

PACE стискає візуальні токени в vision-language моделях і прискорює інференс, знижуючи обчислювальні витрати без суттєвої втрати якості відповідей.
AI-дослідження

Transfyr отримав $25 млн, щоб ШІ фіксував неявні знання лабораторій

Кембриджський стартап Transfyr вийшов зі стелс-режиму з $25 млн на ШІ, що фіксує неявні лабораторні знання й бореться з кризою відтворюваності науки.
AI-дослідження

ШІ вчиться пояснювати «магічні руки» науковців у лабораторії

Новий ШІ-підхід аналізує лабораторні протоколи й пояснює, чому окремі дослідники стабільно отримують кращі результати за тим самим методом дослідження.