Половина ИИ-проектов в финансовой сфере к 2024 году будет отложена или отменена
🚧 Главными барьерами для ИИ в финансовом секторе аналитики Gartner называют:
💰высокие первоначальные затраты на создание масштабируемой инфраструктуры собственными силами;
👥 чрезмерную зависимость от сторонних разработчиков.
Подробности – на cdo2day.ru
Еще одна новость от нашей команды SberDevices. Мы публикуем RuCoLA (Russian Corpus of Linguistic Acceptability) — датасет русскоязычных предложений, размеченных по бинарной шкале приемлемости.
Это совместный труд команды исследователей и NLP-разработчиков из SberDevices, ABBYY, Yandex Research, Huawei Noah’s Ark Lab и Факультета компьютерных наук ВШЭ.
Датасет предназначен для оценки качества NLP моделей, а подробнее можно почитать в статье: https://habr.com/ru/post/667336/
В последние годы в области NLP произошла настоящая революция: огромные нейросети, предобученные на сотнях гигабайт текстов, бьют все известные рекорды качества. Но обладают ли такие нейросети чутьём...
Отличный канал Романа Нестера, основателя компании Segmento и процессора ВШЭ, на тему data-driven стартапов, интервью с основателями, рынка данных и тд.
www.youtube.com/channel…Y-FRQb7Q
Fundamentals of Data Visualization
По ссылке нижу доступна пред-финальная бесплатная версия книги Fundamentals of Data Visualization, которая готовиться к публикации издательством O’Reilly Media, Inc.
https://clauswilke.com/dataviz/
Тренды в искусственном интеллекте в 2022 году по версии СB Insights
🦹♂️Синтетические данные обеспечивают приватность
🖥Чипы для ИИ – рынок достиг $67 млрд и растет. Развиваются 3D чипы и вычисления в памяти
🎮ИИ используют для защиты виртуальных миров от токсичного контента
🤖Технологии обнаружения дипфейков соревнуются с ИИ, создающим фейковый контент
👩💻Дополненный кодинг – ИИ увеличит эффективность за счет достраивания кода и автоматического тестирования
🧠Мультимодальный ИИ – модели научатся работать с разными типами контента одновременно
💰Коммерческие платформы машинного обучения полного цикла станут доступной опцией для компаний, которые хотят внедрить ИИ но не знают как
Дайджест статей 04/06/2022
Сегодня что то вот прям одна статья по теме из всего объема информационных потоков попалась, зато какая 🙂
Introducing the Data Product Development Canvas (Version 1.0)
www.datasciencecentral.com/introdu…sion-1-0
К Кодексу этики в сфере ИИ присоединились новые участники
К Кодексу этики присоединились 19 представителей нижегородского научного и бизнес-сообщества, в их числе — международный кластер информационных технологий Нижегородской области, «Глобус-ИТ», «ПКФ «Кварц», IntelliVision, «Лаборатория компьютерного зрения», «ЭрТоп Диджитал», ННГУ им. Н.И.Лобачевского, Княгининский университет, АНО «Центр искусственного интеллекта «Горький» и другие.
Подписание прошло 2 июня во время конференции «ЦИПР-2022» с использованием мобильной подписи 🏷«Госключ».
Также документ планируют поддержать 20 федеральных ведомств, компании из Ханты-Мансийска, Иннополиса и Дальнего Востока.
🔗Источник: http://government.ru/news/45609/
***
В конце мая сообщалось о формировании Комиссии по реализации Кодекса этики в сфере ИИ. В нее вошли представители Яндекса, МТС, МГИМО, «Сколтеха», Университета ИТМО, МГТУ им. Н.Э.Баумана и фонда «Сколково».
📃Кодекс этики в сфере искусственного интеллекта
Извлекать ценность из больших данных способны сегодня компании с самым разным уровнем развития технологий. Благодаря работе с Big Data бизнес может снизить расходы, укрепить свое положение на рынке и увеличить конкурентные преимущества. Разбираем актуальные кейсы в совместном проекте с МТС Бизнес.
https://bit.ly/3x6CuqL
Очередная рекомендация книги.
Вадим Подольный опубликовал книгу "Архитектура высоконагруженных систем". Вадим с 2000 года работает в области разработки программного обеспечения промышленных распределенных высоконагруженных систем управления. За 20 лет Вадим принял участие во многих крупных инфраструктурных проектах, связанных с технологической независимостью ключевых отраслей промышленности. Книга дает представление о том, как проектируют высоконагруженные распределенные системы управления.
Книга доступна бесплатно по ссылке, но донаты на поддержку проекта крайне приветствуются.
podolny.ru/book_do…download
BigLake unifies data warehouses and data lakes into a consistent format for faster data analytics across Google Cloud and open source formats and engines.
11 Enterprise AI Trends to Know
- Buy, don’t build
- Explainable use case AI
- Improve complex decision-making
- The rise of structured data
- Governing AI
www.dataversity.net/11-ente…-to-know
⚡️Проект Data Literacy на русском языке и Qlik СНГ делятся книгой-путеводителем по грамотной работе с данными от наших давних друзей “DataYoga”
«ДАТА ЙОГА: грамотная работа с данными»
Электронная версия книги уже доступна бесплатно.
О чем книга:
Путеводитель собирает в единую систему базовые знания по работе с дизайном и созданию современных информационных продуктов, в том числе дашбордов. Что вы найдете в книге:
• Практические темы, разобранные по пути проектирования дашборда
• Лучшие практики, советы и мнения экспертов визуализации данных
• Playbook: подборка практических заданий, игр и разминок для лучшего понимания
Форматы книги: 1.1 июня (сегодня!): электронный релиз на Calameo: здесь книгу можно прочитать и полистать в онлайн формате 2.15 июня: откроем раздел на сайте https://dataliteracy.ru/, где можно будет скачать pdf-версию книги
3.Конец 2022 – начало 2023 года: выход печатной версии книги (если будет спрос больше 1.000 участников, то напечатаем книгу раньше)
Читать >>>
Спешите сделать предзаказ на новую книгу "Идеальная работа. Программирование без прикрас" Мартина Роберта.
Роберт Сесил Мартин — Дядя Боб — автор бестселлеров в области разработки ПО. Мартин занимается разработкой ПО с 1970, а с 1990 стал международным консультантом в этой области. Организовал встречу группы, которая создала гибкую методологию разработки на базе экстремального программирования.
Все книги серии просто must read для всех, что имеет дело с программированием и программным кодом.
www.piter.com/collect…-prikras
Друзья, небольшой анонс!
Завтра в 19.00, в онлайне, мы с Ромой Нестером (профессор ВШЭ, основатель Сегменто) откроем совместным воркшопом летнюю школу data-driven маркетинга и управления продуктом от магистратуры ВШЭ. Поговорим про экономику данных: кто сколько зарабатывает, какие данные сколько стоят, к чему это всё идет. Будет интересно, регистрация здесь.
Программа готовит профессионалов, обладающих компетенциями в области информатики, интеллектуального анализа больших данных (data mining), коммуникационных исследований и применения инновационных…
Сейчас законодатели обратили внимание на алгоритмы автоматизированного принятия решений и вводят новые законы, ужесточающие требования к работе таких алгоритмов. Понятно, что чем больше решений у нас принимаются в полностью автоматическом режиме (это включает и рекомендательные системы), тем больше рисков мы имеем в плане возможных ошибок и их последствий. Не так давно публиковал тут новость про то, что в EU ввели ряд ограничений на алгоритмы рекомендательных систем и в России у нас так же идет обсуждение похожих вещей.
В статье "Responsible Data Management" рассматриваются практики ответственного управления данными, которые предусматривают встраивание практик контроля легальных и этических вопросов в весь жизненный цикл управления данными.
Особое внимание уделяется практикам избежания "предвзятости" в принятия решений, которые могут появляться из-за их наличия в исходных данных. Это всем известные и широко обсуждаемые примеры, когда алгоритмы при принятии решения учитывают, например, цвет кожи человека.
В общем, что бы таких неприятностей не было в ваших системах, надо особое внимание уделять этим моментам на этапе сбора и обеспечения качества данных.
cacm.acm.org/magazin…fulltext
Perspectives on the role and responsibility of the data-management research community in designing, developing, using, and overseeing automated decision systems.