Соучредитель стартапа OpenAI Илья Суцкевер сообщил, что компания сталкивается с дефицитом данных для дальнейшего совершенствования искусственного интеллекта.
Об этом сообщило издание noworries.news.
По его словам, современные модели, в частности GPT-4, уже исчерпали большую часть доступной в интернете текстовой информации. Поиск новых релевантных источников становится все сложнее.
Особое внимание Суцкевер обратил на качество данных, отметив, что большинство открытых ресурсов уже вовлечены в процесс обучения. Создание же новых высококачественных наборов данных требует значительных усилий и ресурсов.
Одним из возможных вариантов решения этой проблемы, по словам Суцкевера, является использование синтетических данных, которые могут генерировать сами модели ИИ. Однако этот подход имеет свои ограничения: он не подходит для всех задач и может вызывать проблемы с предвзятостью моделей и снижением точности результатов.
Эксперты отмечают, что в ближайшие годы отрасль искусственного интеллекта может изменить подходы к обучению моделей, сосредотачиваясь на совершенствовании алгоритмов и повышении эффективности работы с уже имеющимися данными. Это станет новой вехой развития ИИ, которая потребует тесного взаимодействия между исследователями, бизнесом и регуляторами.