Зачем ИИ-компании скупают книги и срезают с них корешки? 📚
Качественных открытых данных для обучения моделей становится все меньше. Разработчикам приходится искать новые источники: покупать книги и оцифровывать их целыми партиями.
Полностью заменить недостающее синтетическим контентом тоже не получится. Если поколение за поколением обучать модели на материалах, созданных ИИ, может возникнуть model collapse — и качество ответов начнет снижаться.
На этом фоне собственные данные компаний становятся все ценнее. Как их хранить и использовать в работе с ИИ, расскажем 8 октября на конференции Selectel ТехноДень. Регистрируйтесь по ссылке ➡ slc.tl/2vkhf