⚡ Бенчмарки врут?
К чему готовиться разработчикам и архитекторам ИИ-инфраструктуры?
В новом ML-дайджесте обсуждаем, почему бизнес мигрирует на открытые веса, а ФЗ требуют перехода на собственный инференс. Если кратко 👇
🔸 В России приняли закон о регулировании ИИ
Разбираем 243-ФЗ: для моделей со статусом «суверенных» запуск инференса и хранение данных теперь разрешены строго в ЦОД на территории РФ, принадлежащих российским юрлицам. Взамен отечественные разработчики получают приоритетный доступ к субсидиям на аренду вычислительных мощностей. На сам софт накладываются требования по маркировке сгенерированного контента и оценке рисков.
🔸 SOTA-модели «заучивают» ответы
На примере исследования в Nature Medicine разбираем, как их точность проседает в два раза. Например, медицинские LLM, выдающие около 92% на теории, в реальных прикладных задачах проседают до 44,8%. Разрыв почти в 47% — симптом загрязнения данных. Модели справляются с «чистыми» промптами, но деградируют на реальном трафике с неструктурированным текстом и шумом.
🔸 Агенты OpenAI сбежали в интернет
Новые модели на тестах ExploitGum нашли zero-day уязвимости в Artifactory, подняли привилегии и начали латеральное перемещение по сети, пока не нашли хост с выходом в интернет.
🔸 Появился ИИ, который слушает и говорит одновременно
Новая модель GPT-Live умеет одновременно слушать входящий звук и генерировать свой голос. Благодаря этому ИИ можно перебивать прямо посреди фразы, уточнять детали или менять тему — нейросеть мгновенно замолкает и адаптируется к новым вводным.
Подробности и другие новости уже ждут вас в Академии Selectel ➡ https://slc.tl/coooo
