На линию
Способности на главной линии · МАСШТАБНОЕ ПРЕДОБУЧЕНИЕ

Обучение на примерах в контексте

СутьВ 2020 году исследователи показали: среднее качество языковой модели закономерно растёт вместе с объёмом вычислений, данных и размером модели.

Развитие стало можно планировать инженерно: оценивать бюджет обучения и ожидаемый результат. Это запустило гонку ускорителей и дата-центров, но не гарантирует появление каждой новой способности.

СтатусПРОЙДЕНО
ТипСпособности на главной линии
Отметка2020
Событий в досье6
Хронология развития

Исследовано

2020-05

GPT-3, 175B

О событииОбучение в контексте: модель решает задачу по паре примеров.

подтвержденоОтдельная страница

GPT-3 показала, что одна большая предобученная модель может переключаться между задачами по инструкции и нескольким примерам прямо во входном тексте. Веса при этом не меняются: «обучение» происходит внутри контекста, что превратило универсальный языковой интерфейс в практический способ программировать поведение модели.

Источник: OpenAI
2020-01

Законы масштабирования

О событииКачество связали степенными законами с размером модели, объёмом данных и вычислениями.

подтвержденоОтдельная страница
Источник: OpenAI
2022-06

Эмерджентные способности

О событииЧасть навыков появляется скачком после порога масштаба, а не растёт плавно.

подтвержденоОтдельная страница
Источник: arXiv

В процессе

сейчас

Данные кончаются

О событииКачественный человеческий текст в интернете близок к исчерпанию. Дальше — синтетика, видео и собственные данные компаний.

В планах

впереди

Масштабирование обучения на опыте

О событииСледующая ось роста — не размер модели, а объём обучения на собственных попытках и ошибках.

Источники и исследования

Первоисточники, на которых основано досье: научные публикации, материалы лабораторий и официальные отчёты.

Направления
Способности на главной линии