
Hosted by Mikhail · RU

Продолжаем разговор с Александром Резановым про генеративный искусственный интеллект. Александр - ML Engineer, специализирующийся на генеративном компьютерном зрении и сегодня поговорим про видео. Что проще генерировать, картинки или текст? Может ли беговая дорожка обыграть в шахматы чемпиона мира? Почему все модели неверны? Как машины могут ехать, если колёса крутятся в разные стороны? Как померить "волтность" модели и что это вообще такое? Зачем изучать старые архитектуры нейросетей, если сейчас миром правят трансформеры? Как задача генерации видео делает модели умнее? Как индустрия для взрослых в очередной раз двигает прогресс? Когда модели будут генерировать полноценные фильмы? Обо всём этом в выпуске!Ссылки выпуска:Статья про VizDoom (https://worldmodels.github.io)Genie 2 от Deepmind (https://deepmind.google/discover/blog/genie-2-a-large-scale-foundation-world-model/)Muse от Microsoft, появилось в феврале 2025 на ту же тему (https://www.microsoft.com/en-us/research/blog/introducing-muse-our-first-generative-ai-model-designed-for-gameplay-ideation/)Буду благодарен за обратную связь!Подписывайтесь на телеграм-канал "Стать специалистом по машинному обучению" (https://t.me/toBeAnMLspecialist)Обо мне (https://t.me/toBeAnMLspecialist/935)Мой телеграм для связи (https://t.me/kmsint)Также со мной можно связаться по электронной почте: kms101@yandex.ruЯ сделал бесплатный курс по созданию телеграм-ботов на Python и aiogram на Степике (https://stepik.org/120924). Присоединяйтесь, если хотите научиться разрабатывать телеграм-ботов!Также в соавторстве с крутыми разработчиками я пишу курс по продвинутой разработке телеграм-ботов с элементами микросервисной архитектуры (https://stepik.org/a/153850?utm_source=mlpodcast&utm_campaign=ep_70).Выразить благодарность можно добрым словом и/или донатом (https://www.tinkoff.ru/rm/kryzhanovskiy.mikhail11/NkwE718878/)

Встречайте специальный выпуск нового сезона со специальным гостем - Николаем Додоновым. Николай профессиональный психолог, член ассоциации когнитивно-поведенческой психологии, автор популярных книг по психологии, привычкам и эффективности управления делами. В подкасте мы поговорим о том как страхи могут управлять нами и мешать в достижении целей. В том числе финансовых. Обсудим почему одинаковый уровень хард-скиллов не гарантирует одинаковый уровень дохода. Откуда берутся страхи и всегда ли они оправданы. Что такое модель отношений и как она влияет на принятие нами решений. Почему нам может быть тревожно, когда всё хорошо. Как мы сами себе создаём проблемы с заработком. Как разрубить классический гордиев узел отсутствия опыта для работы, без которого не получить работу для опыта. Почему важно не просто писать код, решающий конкретную задачу, но и понимать, как решение этой задачи влияет на общую систему, в целом. Почему мы часто всё понимаем, но ничего не делаем. Почему кажется, что знаний всегда недостаточно. Почему сравнивать себя с другими и даже с самим собой - это не самый эффективный путь понять свою ценность. Поехали!Ссылки выпуска:Телеграм-канал Николая (https://t.me/n_dodonov)Новая книга Николая "Майндхакинг. Как мозг принимает решения и заставляет нас действовать в режиме НЕ-ТВОЯ-ЖИЗНЬ" (https://www.labirint.ru/books/918435/)Буду благодарен за обратную связь!Подписывайтесь на телеграм-канал "Стать специалистом по машинному обучению" (https://t.me/toBeAnMLspecialist)Мой телеграм для связи (https://t.me/kmsint)Также со мной можно связаться по электронной почте: kms101@yandex.ruЯ сделал бесплатный курс по созданию телеграм-ботов на Python и aiogram на Степике (https://stepik.org/120924). Присоединяйтесь, если хотите научиться разрабатывать телеграм-ботов!Также в соавторстве с крутыми разработчиками я пишу курс по продвинутой разработке телеграм-ботов с элементами микросервисной архитектуры (https://stepik.org/a/153850?utm_source=mlpodcast&utm_campaign=ep_69).Выразить благодарность можно добрым словом и/или донатом (https://www.tinkoff.ru/rm/kryzhanovskiy.mikhail11/NkwE718878/)

В гостях Дмитрий Берестнев - Chief Data Scientist/Head of ML музыкального сервиса Zvuk.com. Будем разговаривать про музыкальные рекомендации и немного затронем генерацию музыкальных треков. Как понять, что хочет пользователь, если он и сам не знает чего хочет? Как отличить негативный локальный фидбэк от негативного глобального? Какие признаки можно извлечь из музыкальных произведений? Надо ли распознавать тексты песен и что такое смысловой вектор? Как сверточные нейронные сети, которые работают с изображениями, применяют к музыке? Для чего заваривают плейлисты? Существует ли сезонность пользователя? Что произошло такого, что низкокачественный jukebox превратился в достойный suno? Можно ли генерировать музыку на лету, на основании предпочтений пользователей? Когда мы будем слушать полноценные новые альбомы от ушедших исполнителей? Как послушать сказку голосом любого персонажа? Обо всём этом в выпуске!Ссылки выпуска:Курс по обработке звука на huggingface (https://huggingface.co/learn/audio-course/ru/chapter0/introduction)Курс по рекомендательным системам (https://ods.ai/tracks/mts-recsys-df2020) и его продолжение (https://ods.ai/tracks/recsys-course2021?ysclid=m60q0k5fnh456599369)Соревнования по рекомендательным системам:https://www.kaggle.com/competitions/otto-recommender-system/overviewhttps://www.kaggle.com/competitions/h-and-m-personalized-fashion-recommendationshttps://www.recsyschallenge.com/2023/Буду благодарен за обратную связь!Подписывайтесь на телеграм-канал "Стать специалистом по машинному обучению" (https://t.me/toBeAnMLspecialist)Мой телеграм для связи (https://t.me/kmsint)Также со мной можно связаться по электронной почте: kms101@yandex.ruЯ сделал бесплатный курс по созданию телеграм-ботов на Python и aiogram на Степике (https://stepik.org/120924). Присоединяйтесь, если хотите научиться разрабатывать телеграм-ботов!Также в соавторстве с крутыми разработчиками я пишу курс по продвинутой разработке телеграм-ботов с элементами микросервисной архитектуры (https://stepik.org/a/153850?utm_source=mlpodcast&utm_campaign=ep_68).Выразить благодарность можно добрым словом и/или донатом (https://www.tinkoff.ru/rm/kryzhanovskiy.mikhail11/NkwE718878/)

В гостях выпуска Сергей Николенко - доктор физико-математических наук, старший научный сотрудник ПОМИ РАН, доцент ФМКН СПбГУ, Head of AI компании Synthesis AI, исследователь в области машинного обучения, в частности глубокого обучения, теоретической информатики и анализа алгоритмов, автор более 200 публикаций в этих и других областях информатики и математики, автор нескольких книг, в том числе бестселлера "Глубокое обучение" (Питер, 2018) и монографии "Synthetic Data for Deep Learning" (Springer, 2021). Почему математики в машинном обучении много, а машинное обучение в математике приходится искать? Могут ли программы перебирать другие программы для решения задач перебором? Почему до сих пор не автоматизировали поиск решений для задач тысячелетия? Решают ли большие языковые модели олимпиадные задачи по математике лучше олимпийцев? Как победить LLM на математической олимпиаде, подсунув ей задачи по геометрии? Можно ли автоматизировать учёного? Что лучшие математики современности думают о модели o1? Могут ли нейросети выводить физические законы? Как понять, что AGI уже здесь? А что делать, если уже здесь? Как написать системный промпт к очередной LLM так, чтобы она не захотела уничтожить человечество? На кого учиться, если кругом все делают роботы? Обо всем этом в выпуске!Ссылки выпуска:Страница Сергея, список публикаций и google scholar:https://logic.pdmi.ras.ru/~sergey/https://logic.pdmi.ras.ru/~sergey/papers.htmlhttps://scholar.google.com/citations?user=_lk95cEAAAAJКурс по машинному обучению 2023-2024 (сейчас последний семестр): https://logic.pdmi.ras.ru/~sergey/teaching/mlspsu2023.htmlКурс по машинному обучению 2024-2025 (сейчас первый семестр): https://logic.pdmi.ras.ru/~sergey/teaching/mlspsu2024.htmlЗаписи семинара, на котором мы с Сергеем познакомились:Мечтаем ли мы об AGI (https://www.youtube.com/watch?v=6E8JUchlKSg)Что происходит в AI сегодня (https://www.youtube.com/watch?v=FGNphH7nw9w)Буду благодарен за обратную связь!Подписывайтесь на телеграм-канал "Стать специалистом по машинному обучению" (https://t.me/toBeAnMLspecialist)Мой телеграм для связи (https://t.me/kmsint)Также со мной можно связаться по электронной почте: kms101@yandex.ruЯ сделал бесплатный курс по созданию телеграм-ботов на Python и aiogram на Степике (https://stepik.org/120924). Присоединяйтесь, если хотите научиться разрабатывать телеграм-ботов!Также в соавторстве с крутыми разработчиками я пишу курс по продвинутой разработке телеграм-ботов с элементами микросервисной архитектуры (https://stepik.org/a/153850?utm_source=mlpodcast&utm_campaign=ep_67).Выразить благодарность можно добрым словом и/или донатом (https://www.tinkoff.ru/rm/kryzhanovskiy.mikhail11/NkwE718878/)