Обложка канала

Клуб CDO. Страница 32

1243 @cdo_club

Сообщество профессионалов в области работы с данными и ИИ

  • Клуб CDO

    Microsoft тоже плотно работает над созданием платформы для конфиденциальных вычислений в Azure. www.microsoft.com/en-us/r…he-cloud
    Confidential Containers: Verifiably secure computation in the cloud - Microsoft Research

    For many organizations, trusting their data to the cloud requires having a complete understanding of and control over the environment in which that data resides and how it’s being processed. Microsoft understands this, and we are committed to building a trustworthy cloud—one in which security, privacy, and transparency are built into its core. A key […]

    Microsoft Research
  • Клуб CDO

    Очень детальная и техническая статья про обеспечение качества при разметки данных medium.com/toloka/…c361cad7
  • Клуб CDO

    5 Setmore Alternatives that Use Big Data to Manage Appointments

    Companies can use these data-driven scheduling tools that are great alternatives to using the Setmore application.

    SmartData Collective
  • Реклама

  • Клуб CDO

    Поздравляю всем с первым днем последнего месяца лета. Начнем его с Web 3.0 :) www.comnews.ru/content…y-web-30
    О дивный новый Web 3.0

    Грядет эра Web 3.0, которая приведет к децентрализации общества и организаций, участники которых одновременно станут и собственниками, и сотрудниками, и клиентами. Вызов для участников процесса - объединение цифрового и реального мира для концепции Web 3.0. И если она приживется, то властелинами мира станут Марк Цукерберг, Джек Дорси, Павел Дуров и Владимир Кириенко.

    www.comnews.ru
  • Клуб CDO

  • Клуб CDO

    Дайджест статей 31/07/2022 Глубокое погружение в Data Quality https://habr.com/ru/company/vk/blog/674876/ Разметка данных в машинном обучении: процесс, разновидности и рекомендации https://habr.com/ru/post/678524/ Кто такой ML-инженер? https://habr.com/ru/post/678594/ Защита и обработка персональных данных в Латинской Америке на примере Бразилии и Аргентины habr.com/ru/comp…g/679148 Как собрать платформу обработки данных «своими руками»? https://habr.com/ru/company/itsumma/blog/679516/ Инжиниринг признаков в предварительной обработке данных https://habr.com/ru/company/otus/blog/679554/
    Глубокое погружение в Data Quality

    Забота о качестве данных часто кажется малопривлекательной, но, по иронии, именно на нее мы тратим большую часть времени. Возможно, Data Quality — важнейший компонент пайплайна данных, ведь дашборд и...

    Хабр
  • Клуб CDO

    Что такое сознание? Каким образом наш мозг осуществляет процесс мышления? Чем он кодируется? Можно ли поставить знак равенства между понятиями «я» и «мой мозг»? Где находится душа? Какую роль в мышлении играет интуиция? Существуют ли телепатия и ясновидение? Об этом и многом другом — наш разговор с нейробиологом, академиком Константином Анохиным. Фото: Архив Константина Анохина @kommersant
  • Клуб CDO

    Пятничное
  • Клуб CDO

    Data Engineering Best Practices: How Netflix Keeps Its Data Infrastructure Cost-Effective

    Netflix is unquestionably the largest video provider in the world, delivering the most streams to the most customers from the largest video…

    Medium
  • Клуб CDO

    И опять про персонализацию и Netflix :) Netflix конечно добилась больших успехов в персонализации, но вот что интересно, понятие "система рекомендаций" как то по умолчанию подразумевает какую то большую систему, которая переваривает кучу данных и выдает следующий офер. Но по факту персонализация - это широкое понятие, которое реализует всеобъемлющее улучшение клиентского опыта за счет использования частных рекомендательных систем для разных шагов Customer Journey. Поэтому данное описание думаю надо понимать как пример одной из деталей всей темы персонализации в Netflix. Тем не менее есть интересная информация по фичах и подходах к ранжированию фильмов. https://habr.com/ru/post/677396/
    Глубокое погружение в рекомендательную систему Netflix

    Как Netflix добился 80 процентов от всего своего стримингового времени благодаря персонализации Photo by Thibault Penin on Unsplash Перевод не дословный. Некоторые куски я дополнила примерами и...

    Хабр
  • Клуб CDO

    Прекрасный доклад Игоря Пивоварова про AGI и текущую ситуацию с ним. - что такое обучение, понимание, интеллект (спойлер, это разные вещи), психика - структура тестов на AGI и их краткое описание - подходы к моделированию интеллекта, языковые модели - конечно про последнее достижения сверх-больших ML моделей и RL - общая теория интеллекта - принцип свободной энергии и предиктивное кодирование https://youtu.be/uo66n1mFJO4
    AGI – обзор текущего состояния | Игорь Пивоваров на OpenTalks.AI-2022

    В докладе дан обзор разных подходов к построению Сильного ИИ (AGI). Когнитивные архитектуры, языковые модели, мультимодальные модели, модели поведения, в том числе на базе обучения с подкреплением… И наметки общей теории интеллекта, из которой можно вывести всё остальное) И, наконец, некоторые соображения по поводу интеллекта/мышления/сознания/психики и как они связаны. Доклад в рамках 4-й пленарной сессии открытой конференции по искусственному интеллекту OpenTalks.AI-2022. --------------------------------------------------------------------------------------------------------------------------------------------------------------- Сайт конференции OpenTalks.AI: https://opentalks.ai/ Альманах "Искусственный интеллект": https://aireport.ru/ Телеграм-чат OpenTalks.AI – присоединяйтесь к комьюнити осмысленных людей из мира ИИ! https://t.me/joinchat/Si8SIUMImaVtW_u7 Ежедневный дайджест новостей искусственного интеллекта: https://t.me/joinchat/UqFWakgph4Xi396y #OpenTalksAI #МФТИ #ИскусственныйИнтеллект #AGI #ArtificialGeneralIntelligence #MachineLearning #DeepLearning #ArtificialIntelligence #OpenTalks #AI #ИИ #NLP #NaturalLanguageProcessing

    YouTube
  • Клуб CDO

    Интересное наблюдение про стоимость инфраструктуры для построения платформ управления данными. Все сейчас идут в облако, мотивирую тем, что использование облачной инфраструктуры проще, быстрее и удобнее. Но когда мы сталкиваемся со стоимостью, не все так однозначно оказывается. Автор этой статьи описывает особенности ценообразования облачных платформ: чем более высокоуровневые сервисы мы покупаем, тем дороже они стоят. И нет, это не означает, что надо возвращаться к on-premise решения, но надо внимательно следить за уровнем абстракции вашей инфраструктуры и правильно балансировать между удобством и стоимостью. blog.dataminded.com/why-ris…8b371f28
    Why rising cloud costs are the silent killers of data platforms

    Building data platforms in the cloud is changing. Gone are the days that you would manually set up a few EC2 instances and run some modest…

    Medium
  • Клуб CDO

    Квантовые и нейроморфные вычисления Управление исследований и инноваций провело семинар с участием экспертов из Российского квантового центра и Сколтеха о применении квантовых вычислений и нейроморфных процессоров в бизнесе. Предлагаем вашему вниманию краткое содержание докладов и ответы спикеров на вопросы аудитории #кванты

    27_07_Материалы_семинара_кванты_и_нейроморфы.pdf

    application/pdf
  • Клуб CDO

    Интересные материалы по теме квантовых вычислений и нейроморфных процессоров
  • Клуб CDO

    Эту статью я уже отмечал тут в одном из дайджестов, но хочу еще раз ее вынести сюда уже в виде отдельного поста. Статья интересна не только размышлениями на тему Data Governance, но интересными рассуждениями на тему перевода основных терминов этой предметной области. https://habr.com/ru/post/581430/
    Разрыв между производством и потреблением данных

    Марк Гровер CEO компании Stemma. Автор оригинальной статьи Дмитрий Дорофеев Автор перевода Вступительное слово переводчика: Разрыв между смыслом оригинала и перевода Думаю, многие согласятся, что...

    Хабр
  • Реклама

  • Клуб CDO

    Задача конфиденциальности данных поставщика

    Виктор Стрелков, директор по разработке oneFactor, выступил на конференции Intel® Experience Day 2021 с кейсом «Использование технологии…

    Medium
  • Клуб CDO

    Статья от компании oneFactor об их опыте тестирования системы Intel SGX 2.0 oneFactor – разработчик платформы SmartMachine для конфиденциального совместного машинного обучения на глобальном графе клиентских связей, которая дает возможность быстро создавать максимально точные сервисы. Судя по статье, в основном платформа используется для предоставления сервиса скоринга для банков. На рынке информации о сервисе и решении крайне мало, но могу предположить, что суть сервиса в том, что для скоринга используются данные мобильного оператора, а для того, что бы провести обучение модели оценки заемщика для банка, используются данные банка о том кто из клиентов является хорошим или плохим заемщиком. Для этого и нужен защищенный анклав, тк банки свои данные для таких целей передают крайне не охотно, так же как и данные мобильного оператора трудно куда то передать вовне. Статья в общем то не об этом, а о тестировании производительности, но тем не менее. https://habr.com/ru/company/intel/blog/560598/
    Как в oneFactor ускорили безопасное обучение ML-алгоритмов в 19 раз с помощью Intel Xeon Gen3 и SGX 2.0

    Эксперты компании oneFactor протестировали процессоры Intel Xeon Ice Lake с технологией Intel SGX 2.0 для оценки ускорения процесса машинного обучения на собственной платформе SmartMachine по...

    Хабр
  • Клуб CDO

    Привет :) . Выложили видео с митапа: https://www.youtube.com/watch?v=FnfNnn-EZok :) ... Весьма близко к моей второй лекции про Data Vault/Anchor Modeling, но по английски, в полтора раза больше материала, и в конце есть упоминания нашего нового продукта, youta.app
    Data Modeling Meetup Munich: From Data Vault to Anchor Modeling with Nikolai Golov

    The Data Vault approach gives the data modelers a lot of options to choose from: how many satellites to create, how to connect hubs with links, what historicity to use, which field to use as a business key. Such flexibilites leaves a lot of options for inoptimal modeling decisions. I want to illustrate some choices (I call them issues) with risks and possible solutions from other modeling techniques, like Anchor Modeling. All issues are based on the years of evolving the Data Vault and Anchor Modeling data warehouses of 100+ TB in such databases as Vertica and Snowflake. Speaker: Nikolai Golov is Head of Data Engineering of ManyChat (SaaS startup with offices in San Francisco and Yerevan), and a lecturer at Harbour Space University in Barcelona (data storage course). He studies modern data modeling techniques, like Data Vault and Anchor Modeling, and their applicability to big data volumes (tens and hundreds of TB). He also, as a consultant, helps companies to launch their own analytical/data platform. Recorded at the Data Modeling Meetup Munich (DM3), 2022-07-18 https://www.meetup.com/Data-Modeling-DM3

    YouTube