OpenAI не волнуют права?
The New York Times сообщает, что в 2021 году компания OpenAI столкнулась с нехваткой данных для обучения GPT-4 и решила использовать текстовую версию более миллиона часов видео с YouTube.
Для этой цели OpenAI разработала нейросеть под названием Whisper. Несмотря на то, что компания осознавала сомнительность данного подхода с юридической точки зрения, они решили его применить.
Недавно WSJ сообщил, что разработчики LLM исчерпали доступные данные в интернете, которые можно использовать для обучения искусственного интеллекта. :D
Получается, что теперь им приходится прибегать к использованию синтетических наборов данных или брать любую доступную им информацию вне зависимости от наличия разрешения на использование этих данных.
Вот такая история...
Отношение пожительных и отрицательных голосов: 2/0