30 Dec 2025, 06:37 UTC348 views11 reactionsread 8 August 2026 Дорогие коллеги! Поздравляем с наступающим Новым годом! 🍊
Пусть следующий год принесёт меньше инцидентов в работе с данными, больше предсказуемости и измеримой ценности от данных. Желаем крепкого здоровья, сильных команд, быстрых релизов и качественных дашбордов, которым доверяют. 🪄
Спасибо, что вы с нами — в 2026 продолжим делиться практиками, кейсами и инструментами. Ну а мы уходим на новогодние каникулы. ❤️
Есл…
🎄7❤2☃1🔥1
23 Dec 2025, 13:23 UTC357 views5 reactionsread 8 August 2026 Поиск в каталоге данных - 🔎 по ключевым словам или 🔍 семантический
Одна из самых главных задач каталога данных в организации - поиск. Сегодня поговорим про две технологии, которые могу использоваться при работе поиска.
📌 Поиск по ключевым словам (или лексический поиск) - это поиск, основанный на нахождении совпадений между словами (или частями слов) в запросе пользователя и словами в документах базы данных.
Принци…
👍2🔥2❤1
16 Dec 2025, 08:01 UTC545 views9 reactions20 Starsread 8 August 2026 🗺 Data Atlas под капотом: как это работает и где мы уже наступили на грабли
В прошлом посте писали про бизнес-ценность Data Atlas — навигатора в океане данных. В этом разберём техническую сторону: как он устроен, как его вписать в ландшафт дата-платформы, и на какие грабли мы уже наступили.
Не ещё один каталог, а слой понимания
Data Atlas не заменяет каталог данных, а сидит поверх него и документации. В контуре уч…
🔥4👍3❤2
9 Dec 2025, 11:18 UTC296 views21 reactions1 Starread 8 August 2026 🗺 Data Atlas → как перестать заставлять людей описывать данные вручную
В работе с данными есть парадокс, который многим до боли знаком. Мы инвестируем в платформы, каталоги, витрины, AI — а люди всё равно тратят часы на поиск, расспросы и переписки «а где взять вот этот атрибут?».
Мы решили посмотреть на эту проблему честно — глазами бизнес-пользователя, аналитика и администратора данных. И так родился Data Atlas —…
❤8🔥7👍6
2 Dec 2025, 13:02 UTC323 views8 reactions1 Starread 8 August 2026 🌻 Принципы FAIR в управлении данными
Принципы FAIR - это стандарт, который объясняет, какими должны быть данные и метаданные, чтобы их было легко находить, получать, «понимать» машинам и безопасно переиспользовать.
FAIR - это четыре принципа, каждый из которых отвечает за свой аспект управления данными:
✅ F — Findable (Находимые)
Данные и метаданные должны быть легко обнаружимы как людьми, так и машинами. Это знач…
👍4❤2✍1🔥1
25 Nov 2025, 06:43 UTC270 views6 reactionsread 8 August 2026 🎁 Кастомные атрибуты в Каталоге данных: зачем, как и по каким правилам
🤨 Что это?
Кастомные атрибуты — это дополнительные метаданные сверх стандартных в Каталоге данных (название, тип, владелец), которые добавляют бизнес-контекст: критичность, связь с продуктом, уровень качества, категория персональных данных, срок хранения, статус монетизации и прочее
🤔 Зачем они нужны?
⦁ Быстрый поиск и навигация (фильтры по крит…
👍2🔥2❤1👌1
18 Nov 2025, 13:18 UTC263 views3 reactionsread 8 August 2026 ⚙️ Общий процесс организации классификации неструктурированных данных
Разобрались, что такое коллекции и зачем они нужны. Теперь самый важный вопрос: как это всё реализовать?
🔸 Этап 1: Определение (один раз, в начале)
Перед тем как автоматизировать классификацию, нужно понять, с чем вы работаете. Сначала инвентаризируем: где хранятся документы (S3, локальная FS...), сколько их, кто загружает, как часто обновляются…
❤1👍1🔥1
11 Nov 2025, 13:11 UTC318 views8 reactionsread 8 August 2026 📦 Организуем логические коллекции неструктурированных данных
Представьте: в компании 22000 файлов - 10000 pdf, 5000 xlsx, 7000 docx. Все они лежат в S3, каждый назван по-своему. Как из этого хаоса создать управляемую структуру? Ответ: через коллекции.
Что такое коллекция?
Коллекция - это логический контейнер в каталоге данных, который группирует множество физических файлов в один управляемый объект. Похоже на то, …
❤4👍2🔥2
5 Nov 2025, 13:05 UTC315 views7 reactionsread 8 August 2026 🗂 Неструктурированные данные: поворот в управлении информацией
Когда мы говорим о каталоге данных, первое, что приходит на ум - таблицы с четкой структурой, где каждый столбец имеет определенный тип. Но в реальности большая часть информации компании хранится совсем в другом виде: PDF-документы, договоры, технические отчеты, фотографии, записи звонков, логи систем. (по данным Informatica)
Если в структурированных да…
❤3👍2👏1🔥1
28 Oct 2025, 06:45 UTC290 views8 reactionsread 8 August 2026 🎃🎃🎃 Почему 90% AI-проектов проваливаются?
Сегодня компании стремятся внедрять искусственный интеллект в бизнес-процессы, но, зачастую, всплывает одна большая проблема: большинство проектов не доживают до продакшна. Причина — не "сырые" алгоритмы и плохие модели, а неготовность данных для масштабного использования.
‼️В чем разница между "просто данными" и AI-ready-data?
AI-ready data — это данные, специально подгот…
❤4🎃2👍1🔥1
21 Oct 2025, 10:31 UTC429 views11 reactionsread 8 August 2026 📊 Дата-контракт vs Юридический договор: в чем разница?
Два документа — одна цель: безопасная передача данных. Разбираемся, как они работают вместе 👇
🔧 Дата-контракт = техническая инструкция
Это соглашение между теми, кто дает данные, и теми, кто их получает. Он описывает:
Структуру данных (форматы, типы полей, метаданные)
Требования к качеству + автопроверки
SLA: доступность и частота обновлений
Правила версио…
👍7🔥2❤1👎1
14 Oct 2025, 13:14 UTC337 views8 reactionsread 8 August 2026 📰 Немного новостей...
20 регуляторов подписали декларацию по AI Governance
В Сеуле на Global Privacy Assembly 15-19 сентября 2025 года 20 органов защиты данных из различных стран подписали совместное заявление о создании надежных систем управления данными для ИИ.
Участники: Австралия, Бельгия, Болгария, Канада, Хорватия, Финляндия, Франция, Германия, Гонконг, Ирландия, Италия, Корея, Нидерланды, Новая Зеландия, Люкс…
❤3👍2👏1💯1🔥1
Showing the 12 most recent of 20 posts we hold for @yetanothermeta. View and reaction counts are the latest single reading for each post, not a live figure, and a recent post is still accumulating both. A view count marked ≈ was rounded by Telegram before we ever saw it — t.me prints views in full below 1,000 and to three significant figures above, so ≈1,200,000 means somewhere between 1,150,000 and 1,249,999. Unmarked counts are exact. Text is reproduced from the public post preview and truncated for length.