Год выпуска: 2022
Описание
Модификация GPT-3, обученная генерировать ответы, которые соответствуют запросам пользователя. Модель также генерирует меньше токсичного и неправдивого контента. Улучшения были достигнуты с помощью метода RLHF (Reinforcement from Learning Human Feedback), который позволяет учитывать человеческую оценку ответов модели при её обучении
Примеры использования:
Нововведения
Ответы модели более согласованы с запросом пользователя. Модель выдаёт меньше токсичного и неправдивого контента
Количество параметров: 175B
Предприниматель требовал компенсацию за использование изображений, которые он сделал с помощью нейросети, но суд отказал
Выбираете между зеленой совой, карточками и «умными» чат-ботами? Мы собрали стратегию самостоятельного и осмысленного изучения иностранного языка — от первых…
В открытом письме к американским властям сотрудники ведущих ИИ-платформ призвали создать механизмы, которые позволят притормозить разработку ИИ