Кто такой Джон Шульман (John Schulman): биография
Американский исследователь обучения с подкреплением, сооснователь OpenAI и Thinking Machines Lab, соавтор алгоритмов GAE, TRPO и PPO, участник команды постобучения ChatGPT.
Исследователь обучения с подкреплением и сооснователь лабораторий ИИ
Джон Шульман — американский специалист по машинному обучению, известный как сооснователь OpenAI и сооснователь и главный научный сотрудник Thinking Machines Lab. Его исследовательская деятельность сосредоточена на обучении с подкреплением, робототехнике и методах постобучения моделей на основе обратной связи человека.
Он изучал физику в Калифорнийском технологическом институте (Caltech) и получил докторскую степень по компьютерным наукам в Калифорнийском университете в Беркли под руководством Питера Аббила. В Беркли он разрабатывал алгоритмы, позволяющие агенту выбирать действия на основе вознаграждения.
Научные алгоритмы: GAE, TRPO и PPO
Шульман является соавтором трёх широко используемых алгоритмов обучения с подкреплением: Generalized Advantage Estimation (GAE), Trust Region Policy Optimization (TRPO) и Proximal Policy Optimization (PPO). PPO получил распространение благодаря сравнительно простой реализации и устойчивости, однако его результат зависит от конкретной среды, функции вознаграждения и качества данных.
Роль в создании OpenAI и ChatGPT
В 2015 году Шульман стал одним из сооснователей OpenAI. В компании он руководил исследованиями в области обучения с подкреплением и участвовал в развитии методов, где модели дообучаются на человеческих предпочтениях. Согласно его официальному профилю, он руководил созданием ChatGPT и в 2022–2024 годах совместно возглавлял команду постобучения моделей для ChatGPT и API. При этом технические отчёты, включая InstructGPT, перечисляют широкий круг авторов, что отражает коллективный характер работы.
Переход в Anthropic и основание Thinking Machines Lab
В августе 2024 года Шульман покинул OpenAI и присоединился к команде Alignment Science в Anthropic. Этот этап оказался коротким: в феврале 2025 года он вошёл в состав команды Thinking Machines Lab, основанной бывшим техническим директором OpenAI Мирой Мурати. На официальном сайте лаборатории он указан как главный научный сотрудник и участник команды основателей.
Thinking Machines Lab заявляет, что разрабатывает более понятные и настраиваемые системы ИИ и публикует часть методов. Эти цели представляют собой программные заявления; их реализация оценивается по конкретным продуктам и исследованиям.
Текущая научная деятельность
На сегодняшний день Шульман руководит научным направлением Thinking Machines Lab и продолжает публиковать материалы по дообучению и взаимодействию человека с моделями. Его текущая должность подтверждается одновременно личной страницей исследователя и публичным списком команды лаборатории. Указывать OpenAI или Anthropic как его текущую компанию на июль 2026 года некорректно.
Источники
Популярные вопросы о Джон
Джон Шульман является сооснователем и главным научным сотрудником Thinking Machines Lab, основанной в феврале 2025 года.
Согласно его официальному профилю, он руководил созданием ChatGPT и совместно возглавлял постобучение моделей для ChatGPT и API в 2022–2024 годах. Проект был результатом работы большой команды.
Proximal Policy Optimization (PPO) — семейство алгоритмов обучения с подкреплением, одним из соавторов которых является Шульман. PPO обновляет стратегию ограниченными шагами для более устойчивого обучения, но не гарантирует безопасность или оптимальность результата.