16 сентября 2026

btc = 75 570.00$ -2 359.08 (-3.04 %)

usd = 84.24 -0.10 (-0.12 %)

eur = 97.30 -0.46 (-0.47 %)

cny = 12.55 0.02 (0.15 %)

moex = 2 326.45 пт. -10.65 (-0.46 %)

btc = 75 570.00$ -2 359.08 (-3.04 %)

usd = 84.24 -0.10 (-0.12 %)

Учёные из Tinkoff Research открыли алгоритм, ускоряющий обучение ИИ в 20 раз

1 минута на чтение
Учёные из Tinkoff Research открыли алгоритм, ускоряющий обучение ИИ в 20 раз

Читайте в Telegram

|

Новый метод SAC-RND, открытый учёными из лаборатории исследований ИИ Tinkoff Research, обучает роботов в 20 раз быстрее и на 10% качественнее всех существующих аналогов, сообщили «Коду Дурова» в пресс-службе Тинькофф. Такие результаты показало тестирование метода на робототехнических симуляторах.

В Тинькофф отметили, что оптимизация обучения ИИ позволит ускорить развитие всех областей, в которых используются ИИ-агенты, например робототехники.

Также SAC-RND может повысить безопасность беспилотных автомобилей, упростить логистические цепочки, ускорить доставку и работу складов, оптимизировать процессы горения на энергетических объектах и сократить выбросы вредных веществ в окружающую среду.

Более того, открытие приближает учёных к созданию универсального робота, способного в одиночку выполнять любые задачи, подчеркнули в компании.

Объясняя суть открытия, в Тинькофф рассказали, что ранее использование случайных нейросетей (алгоритмов для последовательного и автоматического принятия решений, RND) считалось неподходящим для офлайн-обучения роботов с подкреплением. Однако учёные из Tinkoff Research обнаружили недостатки в проведённых ранее экспериментах и полученных в ходе них выводах.

К примеру, они исправили глубины используемых нейросетей (случайной и основной), сделав их эквивалентными — именно использование неправильных размеров сетей привело научное сообщество к ошибочному выводу, что метод RND не умеет дискриминировать (классифицировать) данные.

Кроме того, в Tinkoff Research оптимизировали метод — роботы научились приходить к эффективным решениям благодаря использованию механизма слияния, основанного на модуляции сигналов и их линейном отображении. В предыдущих работах на тему RND сигналы не подвергались дополнительной обработке.

Учёные из Tinkoff Research открыли алгоритм, ускоряющий обучение ИИ в 20 раз
Выше — визуализация принятия решения роботами, обученными с помощью разных алгоритмов. Рисунки сверху — предыдущие методы, основанные на RND, рисунки снизу — метод SAC-RND. Стрелки на изображении должны вести робота в одну точку — они указывают направление к правильному действию.

Результаты исследования были представлены на одной из крупнейших мировых ИИ-конференций — ICML в Гонолулу (Гавайи).

Материал обновлен|
Обсудить
Блоги 922
билайн
Softline
SpeShu.AI
OTP Bank
Слетать.ру
Т-Банк
StudyAI
ВКонтакте
ВТБ
Газпромбанк

Кодик

Привет!

Я — Кодик, твой персональный ИИ-агент для поиска информации по «Код.ру» на базе Yandex AI Studio. Я могу быстро найти на сайте нужную тему, порекомендовать похожие материалы или объяснить сложный термин — и в целом поделиться знаниями о науке и технологиях. Задай вопрос или начни с одного из предложенных вариантов.