Инженеры AWS опубликовали: - SkyRL на SageMaker HyperPod. RL-дообучение агентов. В обучении с подкреплением (RL) модель выполняет цепочку шагов, получает оценку-награду за результат и корректирует поведение.
Повод
-
За одну неделю в блоге AWS о машинном обучении вышли пять технических разборов.
-
Четыре из них посвящены обвязке вокруг модели: восстановлению кластера после сбоя, пропускной способности сети, хранению данных в другом регионе и проверке ответов.
-
Для бизнеса полезнее всего кейс NarrateAI.
-
Это AI-ассистент, который отвечает руководителям на вопросы по данным прямо во время бизнес-ревью.
-
Его авторы пишут прямо: если неверная цифра на экране бьёт по чьей-то репутации, одной сильной модели мало. Отсюда правило для директора.
-
Бюджет AI-проекта делится между моделью и контуром проверки.
-
По нашему опыту, контур забирает большую часть денег и времени.


