Depository of News

ИИ не сможет стать разумным, пока не сможет использовать ошибку как источник новых знаний

newsdepo.com · world

<img src="https://habrastorage.org/getpro/habr/upload_files/7d8/5d7/e76/7d85d7e76ff299ea502c4701eb1f6ae9.png" /><p>ИИ исправляет ошибку, а человек вписывает ее в свой опыт и что это говорит об ограничениях современных ИИ </p><p>Современные ИИ используют разные формы обратной связи: функцию потерь (loss), вознаграждение и ошибку предсказания вознаграждения (reward prediction error) в обучении с подкреплением (RL), а также человеческие оценки (RLHF). Но на фундаментальном уровне все эти сигналы работают в рамках одной и той же схеме числовой оптимизации. Независимо от того, называется ли сигнал «потерей» или «вознаграждением», он служит входом для алгоритма, который изменяет параметры модели так, чтобы лучше достигать заранее заданной цели. Система не переживает качественного перехода в состояние "удовлетворения" или мук совести за совершенную ошибку, после того как она обнаружена, как человек, она лишь становится эффективнее в оптимизации внешне заданной функции. </p> <a href="https://habr.com/ru/articles/1077878/?utm_source=habrahabr&amp;utm_medium=rss&amp;utm_campaign=1077878#habracut">Читать далее</a>

Read full article →