Показанные сообщения отсортированы по дате запроса ("predictive coding"). Сортировать по релевантности Показать все сообщения
Показанные сообщения отсортированы по дате запроса ("predictive coding"). Сортировать по релевантности Показать все сообщения

пятница, 29 августа 2025 г.

Важнейшая роль э-раскрытия информации (eDiscovery) в современной деловой деятельности

Данная заметка Дика Вейсингера (Dick Weisinger – на фото) была опубликована 25 июля 2025 года на блоге компании Formtek.

Мой комментарий: Электронное раскрытие (э-раскрытие, англоязычный термин e-discovery) - это элемент процессуального права англосаксонских стран, представляющий собой процедуру обязательного выявления и раскрытия сторонами гражданского спора всех (именно – всех!) относящихся к рассматриваемому делу электронных документов и информации. Термин также применяется в отношении раскрытия информации перед регуляторами или правоохранительными органами в случае расследования. Электронное раскрытие является частью общей процедуры раскрытия (discovery), охватывающей все документы и информацию, находящиеся в распоряжении и под контролем организации.


Электронное раскрытие информации (э-раскрытие – e-Discovery) стало незаменимым инструментом для деловых организаций, работающих сегодня в условиях сложного нормативно-правового ландшафта. Процесс выявления, сбора и предоставления сохраняемой в электронном виде информации (ESI – термин американского права, перекочевавший также в международные стандарты ИСО/МЭК; по сути – это просто хранимая организацией электронная информация – Н.Х.), в ходе судебных разбирательств и расследований помогает организациям смягчать риски, обеспечивать соблюдение законодательно-нормативных требований и принимать обоснованные решения. В условиях стремительного роста объёмов данных и ужесточения законодательно-нормативных требований, эффективные решения для э-раскрытия уже не являются чем-то необязательным - они стали стратегической необходимостью.

Мой комментарий: Если уж говорить всю правду, то э-раскрытие – процесс сложный и дорогостоящий, создающий большие риски и требующий привлечения высококвалифицированных специалистов. Были случаи, когда выполнение требований в отношении э-раскрытия разоряло компании (либо использовалось для шантажа противостоящей стороной в судебном споре). Э-раскрытие прямо не связано с основной деловой деятельностью, так что странно говорить о каком-то «обоснованном принятии решений». 

В то же время наличие обязательного всестороннего э-раскрытия в англосаксонском праве избавляет соответствующие страны от необходимости широко использовать популярные у нас криптографические механизмы вроде усиленных электронных подписей – противника в судебном споре можно легко «размазать» объёмами принудительно раскрываемой информации и тем, что в ней можно «откопать» (при этом речь идёт о любой зафиксированной информации, а не только о той, которую кто-либо считает «документами»). Кроме того, появление э-раскрытия в своё время резко повысило статус и зарплату отвечавших за это специалистов, в числе которых было немало специалистов по управлению документами.


Как э-раскрытие улучшает процесс принятия решений

В основе э-раскрытия лежит надлежащее управление данными, обеспечивающее доступность, точность и практическую ценность информации. Централизованные хранилища данных, автоматическая классификация и расширенные возможности поиска позволяют компаниям быстро отыскивать важные доказательства в ходе судебных разбирательств или расследований. Например, во время слияний или поглощений инструменты э-раскрытия могут использоваться для анализа электронных документов приобретаемой компании для выявления имеющихся у неё обязательств или пробелов в соблюдении законодательно-нормативных требований, напрямую влияя на условия и оценку сделки. Фирма IBM отмечает, что стратегическое управление структурированными данными сокращает до 50%, задержку при принятии решений, что подтверждает ценность э-раскрытия для оперативной деятельности.

Оптимизация управления данными для э-раскрытия


Чтобы максимизировать эффективность э-раскрытия, коммерческим организациям следует:

  • Внедрить облачное архивирование для консолидации электронных писем, сообщений в чатах и файлов, - в форматах, поддерживающих возможность поиска;

  • Внедрить аналитику на основе искусственного интеллекта для автоматизации экспертизы документов и выявления привилегированного или конфиденциального контента (т.е. контента, который по закону можно не раскрывать противостоящей стороне – Н.Х.);

  • Проводить обучение сотрудников политикам хранения данных для предотвращения рисков порчи доказательств (порчей доказательств по большей части признается преждевременное их уничтожение, и если компанию на этом поймают, то проигрыш ею судебного спора практически гарантирован; а в худшем случае виновные рискуют надолго отправиться в тюрьму – Н.Х.).

Применение в реальных условиях

Одна глобальная розничная сеть использовала программное обеспечение для э-раскрытия, чтобы быстро отреагировать на запрос данных, поступивший на основании положений Закона штата Калифорния (США) о защите неприкосновенности частной жизни потребителей (California Consumer Privacy Act, CCPA), - избежав в результате штрафов за счет точного выявления данных клиентов в более чем 20 системах. 

Аналогичным образом, одна компания из списка Fortune 500 сократила судебные издержки на 40% после внедрения «предсказательного кодирования» (predictive coding) с целью приоритизации относящихся к делу документов. 

Эти примеры демонстрируют, каким образом интеграция э-раскрытия с управлением данными преобразует исполнение законодательно-нормативных требований посредством действий после инцидентов - в стратегию действий «на опережение».

По мере эволюции законов о защите персональных данных и роста числа судебных разбирательств по трудовым спорам, инвестиции в надежные средства и инструменты э-раскрытия будут оставаться крайне важными для обеспечения жизнеспособности организации и получения ею конкурентных преимуществ.

Дик Вейсингер (Dick Weisinger)

Источник: блог компании Formtek
https://formtek.com/blog/the-critical-role-of-ediscovery-in-modern-business-operations/ 


четверг, 3 августа 2023 г.

Передовые практики хранения и извлечения данных в рамках процесса э-раскрытия, часть 2

(Окончание, начало см. https://rusrim.blogspot.com/2023/08/1.html )

Передовые практики управления хранением данных в интересах э-раскрытия

Разработайте всеобъемлющую политику стратегического управления информацией.

  • Опишите подход организации к управлению данными, включая хранение, отслеживание сроков хранения и выполнение действий (уничтожение, передача) по их истечении;

  • Регулярно пересматривайте и обновляйте политику, чтобы обеспечить её соответствие меняющимся законодательно-нормативным и деловым требованиям;

  • Привлекайте к процессу разработки и пересмотра политики заинтересованные стороны из различных отделов (департаментов), таких как ИТ, юридический отдел и служба управления документами.

Организуйте электронную информацию в рамках структурированной системы хранения.

  • Используйте согласованные правила наименования файлов, структуры папок, тегирование с помощью метаданных и категоризацию;

  • Создайте карту данных, детализирующую местоположение электронной информации, её типы и владельцев в организации.

Используйте решения для централизованного хранения.

  • Сетевые системы хранения данных (Network-attached storage, NAS) и/или облачные хранилища могут помочь консолидировать электронную информацию в одном месте, способствуя её доступности, совместной работе с неё и эффективному управлению;

  • Оцените преимущества и риски локального хранения по сравнению с хранением в облаке.
Внедрите методы устранения избыточности и сжатия данных
  • Устранение избыточности (deduplication) данных устраняет избыточные копии электронной информации ( https://www.gartner.com/en/documents/3980741 ), в то время, как методы сжатия данных уменьшают размеры файлов, экономя место для хранения и ускоряя извлечение данных;

  • При выборе методов устранения избыточности и сжатия данных рассмотрите возможные компромиссы между эффективностью хранения и временем обработки данных.
Защитите электронную информацию от несанкционированного доступа, утечек и иных угроз безопасности.
  • Внедрите шифрование, контроль и управление доступом и другие меры безопасности для защиты электронной информации на протяжении всего её жизненного цикла ( https://www.ibm.com/reports/data-breach );

  • Регулярно тестируйте и обновляйте меры безопасности, с тем, чтобы опережать эволюционирующие угрозы.
Периодически проверяйте и проводите аудит систем хранения.
  • Выявляйте потенциальные проблемы, проявления неэффективности и области для улучшения;

  • Используйте инструменты мониторинга и аналитики для лучшего понимания  эффективности систем хранения и оптимизации процессов.
Планируйте масштабирование.
  • Регулярно оценивайте емкость хранилища и планируйте его расширение по мере необходимости;

  • Оценивайте и внедряйте новые и нарождающиеся технологий хранения с целью повышения производительности и масштабируемости.
Разработайте для данных перечень с указанием сроков хранения и действий, выполняемых по их истечении
  • Определите конкретные сроки хранения и уничтожения/передачи электронной информации;

  • Регулярно пересматривайте и обновляйте перечень;

  • Внедрите автоматизированные процессы уничтожения данных для сведения к минимуму риска человеческих ошибок.
 
Обучите сотрудников передовым практикам хранения в интересах э-раскрытия
  • Обеспечьте, чтобы обучение охватывало политику стратегического управления информацией организации, перечни с указанием сроков хранения и действий по их истечении, а также процедуры защищённого хранения;

  • Обеспечьте проведение непрерывного (пере)обучения, чтобы поддерживать знания сотрудников и их знакомство с текущим состоянием процессов управления хранением.
Используйте специализированное программное обеспечение и инструменты для э-раскрытия
  • Примером может служить программное обеспечение для отображения данных, «предсказательного кодирования» (predictive coding) и для аналитики данных;

  • Подобные инструменты помогут повысить эффективность, сократить ручные трудозатраты и свести к минимуму ошибки в процессе э-раскрытия.
Выводы

Оптимизация хранения в контексте э-раскрытия имеет критически-важное значение ( https://www.exterro.com/blog/defensible-disposition-convergence-ig-compliance-e-discovery ) для обеспечения беспрепятственного и эффективного хода судебного процесса. Следуя рекомендациям по передовой практике, изложенным в данном руководстве, организации могут создать более оптимизированный рабочий процесс для сохранения в течение установленных сроков и извлечения данных, одновременно обеспечивая исполнение законодательно-нормативных требований.

Внедрение всесторонней политики стратегического управления информацией, структурированных систем хранения, решений для централизованного хранения, а также использование возможностей программного обеспечения и инструментов для э-раскрытия - это лишь некоторые из шагов, которые можно предпринять для оптимизации управления хранением. Благодаря хорошо продуманной и хорошо реализованной стратегии хранения в контексте э-раскрытия, организации могут сократить расходы, повысить эффективность и минимизировать риски, связанные с обработкой электронной информации.

Джейн Томпсон (Jane Thompson)

Источник: блог профессиональной ассоциации ACEDS
https://aceds.org/best-practices-for-e-discovery-data-retention-and-retrieval/


четверг, 20 апреля 2023 г.

Варианты использования искусственного интеллекта в сфере э-раскрытия, о которых Вы могли не знать

Данная заметка была опубликована 8 марта 2023 года на сайте компании KLDiscovery.

Термин «искусственный интеллект» (ИИ) стал весьма модным не только тогда, когда речь заходит о технологиях в целом, но и когда речь идёт об э-раскрытии.

Мой комментарий: Электронное раскрытие (э-раскрытие, англоязычный термин e-discovery) - это элемент процессуального права англосаксонских стран, представляющий собой процедуру обязательного выявления и раскрытия сторонами гражданского спора всех (именно – всех!) относящихся к рассматриваемому делу электронных документов и информации. Термин также применяется в отношении раскрытия информации перед регуляторами или правоохранительными органами в случае расследования. Электронное раскрытие является частью общей процедуры раскрытия (discovery), охватывающей все документы и информацию, находящиеся в распоряжении и под контролем организации.

Это заставляет многих юристов задуматься о том, как понять, какие ИИ-технологии были проверены и практически применены в процессах э-раскрытия, а какие являются спекулятивными и непроверенными. Хорошей новостью является то, что существует ряд практических применений ИИ-технологий, которые за ряд лет доказали свою эффективность в качестве средства оптимизации потоков рабочих процессов э-раскрытия.


Предсказательное кодирование (predictive coding)

Большинство коллег, когда они думают об применении искусственного интеллекта в рабочих процессах э-раскрытия, обычно вспоминают о предсказательном кодировании», то есть о применении технологии машинного обучения для ранжирования и категоризации документов на этапе проверки и отбора (review) электронной информации. Предсказательное кодирование - широко известное применение ИИ-технологии для целей э-раскрытия, одобренное судами более десяти лет тому назад, а отраслью - и ещё раньше. Если Вы принимали участие в ряде проектов э-раскрытия, то, скорее всего, в какой-то момент Вы уже использовали предсказательное кодирование.

Мой комментарий: У меня на блоге есть ряд постов, в которых упоминалось «предсказательное кодирование», см. подборку
http://rusrim.blogspot.com/search?q=%22predictive+coding%22

Другие варианты использования искусственного интеллекта для э-раскрытия

Однако предсказательное кодирование - не единственное проверенное практикой применение ИИ-технологий, доступное в настоящее время специалистам в области э-раскрытия. Есть несколько других вариантов применения ИИ, которые Вы можете использовать для оптимизации рабочих процессов э-раскрытия, в том числе:

Выявление «почти-дубликатов» (near-duplicate identification)

Многие документы могут быть похожими по содержанию и формату, не являясь при этом точными дубликатами - например, различные редакции одного и того же документа, или же представление документа в ином формате, например, в формате PDF (когда контент может быть тем же самым, но значение хеша, используемое в процессах удаления дубликатов, будет уже другим). Технология искусственного интеллекта может быть использована для автоматического группирования документов с похожим текстом, позволяя тем самым быстрее анализировать большие объёмы документов.

Выявление цепочек сообщений в электронной почте

Каждое электронное письмо представляет собой «снимок» обсуждения, имевшего место до этого момента, а это означает, что части этого обсуждения будут появляться неоднократно. Технология искусственного интеллекта Вам позволяет собирать вместе входящие в цепочку (thread) сообщения электронной почты, чтобы выявить наиболее полные версии электронной переписки и просматривать ход обсуждения более интуитивным образом, чем в традиционных рабочих процессах проверки и отбора.

Определение языка

Во многие проекты э-раскрытия вовлечены международные ответственные хранители документов и информации, а это означает, что коллекции документов часто включают материалы на нескольких языках. В некоторых документах используется несколько языков в самом документе. Технология искусственного интеллекта даёт Вашей группе возможность поддерживать многоязычные данные и повышать эффективность проверки и отбора за счет автоматического определения основного и вспомогательных языков во всех документах в вашем наборе данных, - тем самым давая Вам возможность направлять эти документы группам проверки и отбора, которые лучше всего способны сделать данную работу с материалами на этих языках.

Автоматическое цензурирование (redaction)

В связи с ужесточением законодательства о защите персональных данных, выявление и удаление персональных данных (personally identifiable information, PII) становится важной, как никогда ранее, задачей, - при этом остаётся также неизменной потребность в выявлении и удалении привилегированной и конфиденциальной информации. Ручное цензурирование является чрезвычайно трудоёмким и дорогостоящим. ИИ-технология может помочь автоматизировать цензурирование, с возможностью анализа результатов и «отката» некорректно применённых исправлений, тем самым помогая упростить известный своей трудоёмкостью процесс.

Обработка естественного языка (Natural Language Processing, NLP)

Каждая коллекция документов характеризуется уникальным набором мест, событий, ключевых людей и организаций, названий продуктов и других важных для дела характеристик. Обработка естественного языка (NLP) - это ИИ-технология работы с текстами на естественном языке, который позволяет Вам получить представление о Вашей коллекции документов, анализируя её на предмет выявления категорий объектов, а затем визуально группируя документы, ссылающиеся на одни и те же объекты, что даёт Вам возможность быстро локализовать и извлечь нужную информацию или же отфильтровать ненужные материалы.

Автоматизация рабочих процессов проверки и отбора


Рабочие процессы проверки и отбора часто сложны, требуют выполнения многочисленных шагов, а требования в отношении проверки и отбора раскрываемых электронных материалов для каждого случая часто уникальны. В результате управление рабочими процессами проверки и отбора может превратиться в работу на полный рабочий день, чтобы обеспечить маршрутизацию документов нужной группе проверки в нужное время, - при этом неизбежны частые ошибки. Технология искусственного интеллекта способна автоматизировать создание настраиваемых рабочих процессов для поддержки маршрутизации и распространения документов. Её применение упрощает проверку и отбор документов, обеспечивая максимальную точность и защитимость в суде и одновременно поддерживая выполнение уникальных требований, характерных для каждого судебного дела.

Перечисленные варианты использования являются доступными уже сегодня способами практического применением ИИ-технологий. Известность этих ИИ-технологий связана не с ажиотажем или спекулятивными рассуждениями; за ряд лет они доказали свою эффективность для оптимизации э-раскрытия в рамках многих проектов и судебных дел, особенно на этапе проверки и отбора подлежащих э-раскрытию материалов, который исторически был самым дорогостоящим этапом жизненного цикла э-раскрытия. Если Вы ещё не пользуетесь этими проверенными ИИ-возможностями, подумайте о том, чтобы добавить их с целью оптимизации Ваших рабочих процессов.

Чтобы узнать больше о продукте Nebula AI компании KLDiscovery и встроенных в него функциональных возможностях для э-раскрытия на основе ИИ, позволяющих юридическим подразделениям классифицировать миллионы документов с минимальным вмешательством человека, снижая тем самым затраты и обеспечивая, что важные документы не будут упущены. - посетите веб-сайт компании по адресу ( https://www.kldiscovery.com/solutions/ediscovery-analytics ).

Мой комментарий:
Стоит отметить, что практически все варианты использования ИИ для целей э-раскрытия в равной степени применимы и для целей управления документами.

Источник: сайт компании KLDiscovery
https://www.kldiscovery.com/blog/ai-use-cases-for-ediscovery

понедельник, 5 сентября 2022 г.

Как федеральные органы исполнительной власти США могут интегрировать искусственный интеллект в управление документами

Статья директора по решениям и операциям государственного сектора компании Everlaw Анджелы Ковач (Angela Kovach – на фото) была опубликована 3 августа 2022 года на американском сайте Federal Computer Week (FCW, http://fcw.com/ ).

Федеральные органы исполнительной власти в своих планах управления документами должны принимать во внимание новые формы электронных документов (такие, например, как записи встреч в Zoom).

За последние два года способы общения между людьми сильно эволюционировали и стали более разнообразными. Прошли те времена, когда электронная почта и телефонные звонки были для многих основными формами общения. Как в личной жизни, так и в профессиональной деятельности люди всё больше полагаются на приложения для обмена сообщениями, социальные сети и видеоконференции.

Между тем, многие федеральные органы только начинают заниматься оцифровкой своих бумажных документов. Меморандум M-19-21 (см. https://www.archives.gov/files/records-mgmt/policy/m-19-21-transition-to-federal-records.pdf ) обязывает все федеральные органы исполнительной власти полностью перейти на работу с электронными документами к декабрю 2022 года. К проблемам федеральных органов, связанным с управлением их фондами бумажных документов, добавились этим новые нарождающиеся источники данных, что привело к серьезным последствиям. Например, многие федеральные органы исполнительной власти запаздывают ( https://fcw.com/digital-government/2022/03/lawmakers-want-answers-foia-backlogs/363314/ ) с ответами на запросы на основании Закона о свободе доступа к государственной информации (Freedom of Information Act, FOIA), и Конгресс будет применять санкции в отношении некоторые из этих органов власти за их неспособность своевременно ответить на эти базовые запросы.


В моих данных есть данные!

В то время, как многие федеральные органы исполнительной власти только сейчас начинают решать свои проблемы с бумажными документами, ландшафт данных быстро смещается в сторону новых носителей информации и форматов - от мгновенных сообщений и протоколов Zoom-совещаний до средств видеонаблюдения и видео с носимых видеокамер – что ещё больше усложняет положение дел на переднем крае цифровых данных. Федеральные органы обязаны захватывать, управлять и анализировать информацию из этих новых источников, одновременно «откапываясь» из-под десятилетних «отложений» бумажных документов. Это тяжкая задача, однако её выполнение необходимо для того, чтобы справляться с потоками FOIA-запросов, соответствовать требованиям Конгресса как надзорного органа и эффективно действовать в случае судебных разбирательств.

Облачные решения обеспечивают необходимые для выполнения этого гибкость и масштабируемость, давая федеральным органам возможность в полной мере использовать такие инструменты, как искусственный интеллект, которые могут помочь с осмыслением их данных и эффективным использованием средств налогоплательщиков. Так каким же образом федеральные органы власти могут подойти к решению вопроса о том, как им извлекать ценную информации как из бумажных, так и из электронных ресурсов, чтобы выполнять свои обязательства?

С чего начинать?

Искусственный интеллект может упростить управление бумажными документами и дать ценную аналитическую информацию, - в том числе определить, какие документы следует сохранить, а что можно выбросить, - а также помочь с осмыслением данных в электронных документах. Однако технология искусственного интеллекта лишь настолько хороша, насколько она была обучена. Для эффективной работы ей требуется участие человека. Федеральные органы должны выявить, где находятся соответствующие данные, выбрать подходящую технологию искусственного интеллекта, способную работать с различными типами данных, обучить инструмент на правильных данных, а затем проверить качество получаемых результатов. Даже самые мощные ИИ-инструменты, существующие на сегодняшний день, требуют тщательного управления для обеспечения их корректной работы.

Этот процесс может включать пересмотр требований и стратегий органа власти по сбору документов и информации, с тем, чтобы принять во внимание новые типы данных. Например, федеральным органам следует разработать план хранения данных для электронных документов, основываясь на политиках управления информацией, политиках в отношении отдельных устройств, а на законодательстве. Это помогает обеспечить сохранность надлежащих документов таким образом, чтобы технологии вроде ИИ могли их использовать для получения аналитических выводов.

Обратитесь за помощью к другим органам власти и организациям

Одним из решений этой большой и сложной задачи может стать поиск технологического или консультирующего партнёра (или даже сотрудничество с другим федеральным органом), имеющего опыт внедрения эффективных ИИ-решений для управления данными. Процесс закупок и внедрения ИИ может быть очень непростым, и многие федеральные органы вместе решают эту проблему. Они могут обращаться друг к другу за поддержкой и обучением

Партнеры должны быть в состоянии идти в ногу с потребностями органа власти и снабжать его пригодными для работы в определённой временной перспективе решениями, с тем, чтобы органы власти могли избежать повторного прохождения циклов закупок, перехода и освоения. Одним из полезных шагов будет разработка на этапе изучения рынка критериев оценки, используемых для выбора поставщиков, которые отдают приоритет инновациям и интеграции и имеют в прошлом хорошие показатели по сравнению с другими поставщиками. Поскольку процесс закупок в федеральном секторе, как правило, тянется довольно долго, важно всё продумать в долгосрочной перспективе и найти партнёра, который сможет в предстоящие годы обеспечить масштабирование решений в соответствии с ростом потребностей органа власти.

«Бантики и рюшечки» должны рассматриваться в последнюю очередь

После того, как федеральный орган пройдёт эти первые два этапа, он может начать миграцию бумажных и изначально-электронных документов в озеро данных, в котором те можно будет хранить, сортировать и вести по ним поиск единым образом. На этом этапе органы власти должны приступить к оценке инструментов и процессов, которые сделают процесс поиска и извлечения простым и точным. Метаданные являются ключевым по важности фактором, который делает эту информацию доступной для поиска. Например, в PDF-файлах, содержащих отсканированные графические образы, нет легко сортируемых метаданных, поэтому поиск по ним столь же медленный и неэффективный, как и поиск по бумажным документам.

После того, как данные будут картографированы и сохранены, федеральные органы могут начать применять инструменты ИИ, чтобы извлекать из них аналитические выводы и отвечать на запросы на основе Закона о свободе доступа к государственной информации, реагировать на надзор Конгресса и на судебные процессы. Вот как могут сыграть некоторые ключевые ИИ-инструменты:

  • Визуализация данных - это взгляд с высоты птичьего полета на всё озеро данных. Инструменты, поддерживающие интерактивное визуальное отображение, могут помочь быстро отсортировать огромные объёмы данных и быстро выдать аналитические результаты, касающиеся таких вещей, как типы дел, ответственные хранители, стороны диалога, и многое другое.

  • «Предсказательное кодирования» (predictive coding) позволяет сортировать и маркировать документы намного быстрее, чем это может сделать человек. Технология предсказательного кодирования расширяет возможности органа власти, извлекая уроки из решений, которые люди принимали для выделения относящихся к рассматриваемому вопросу данных, и не требуя постоянных затрат ресурсов на ручной анализ.

  • Кластеризация группирует документы по концептуальному сходству и позволяет получать аналитические выводы без участия пользователя. Например, запросы на основе Закона о свободе доступа к государственной информации, подаваемые в Иммиграционную и таможенную службу (Immigration and Customs Enforcement, ICE), как правило, касаются близких тем (пересечение границы, задержание на границе и т.д.). Идентификация кластеров данных об этих ключевых словах уменьшает количество документов, которые ICE необходимо будет просмотреть при подготовке ответа на запрос, а также гарантирует, что орган власти не упустят никакой относящейся к вопросу информации.

Передовой край данных может показаться пугающим, но если федеральные органы будут продвигаться вперёд шаг за шагом, станет возможным работоспособное на перспективу управление данными. Преимущества этого многочисленны: они помогают государственным органам соответствовать законодательно-нормативным требованиям, более эффективно использовать деньги налогоплательщиков и выполнять свои обязанности по обслуживанию граждан.

Анджела Ковач (Angela Kovach)

Источник: сайт FCW.com
https://fcw.com/comment/2022/08/how-federal-agencies-can-integrate-artificial-intelligence-records-management/375012/

пятница, 26 июля 2019 г.

Интересные доклады на конференции iPRES-2019


Как я уже рассказывала в одном из предыдущих постов, авторитетная 16-я международная конференция по обеспечению долговременной сохранности электронных объектов iPRES 2019 пройдёт в Амстердаме 16-20 сентября 2019 года. Её предварительная программа выложена здесь: https://ipres2019.org/site/wp-content/uploads/2019/06/iPRES2019_Programme.pdf .

Пока что программа сформирована не до конца. Из тех сессий, что уже назначены, моё внимание привлекли следующие (но есть ещё очень много других, также достаточно интересных докладов и круглых столов):

1. Обучающие семинары
  • Сара Дей Томсон (Sara Day Thomson, британская Коалиция по электронной сохранности DPC), Кейлин Смит (Caylin Smith, Британская библиотека) и Патриция Фалькао (Patricia Falcao, галерея Тейт (Tate) в Лондоне) «Обеспечение сохранности сложных электронных объектов» (Preserving Complex Digital Objects).

  • Герман Уффен (Herman Uffen, консультационная фирма BMC), Уолтер Свейджмейкерс (Walter Swagemakers, киноархив EYE Film Museum в Амстердаме) и Эрнст ван Вельзен (Ernst Van Velzen, EYE Film Museum) «Модель затрат для анализа и контроля над расходами при обеспечении долговременной доступности электронных материалов, для использования в качестве инструмента для принятия стратегических решений» (A cost model for analysing and controlling the cost of long-term digital accessibility as a strategic decision-making tool).

  • Брент Вест (Brent West, Университет Иллинойса, США) и Джоан Качмарек (Университет Иллинойса) «Машинное обучение применительно к большим текстам: Руководство по использованию инструментария прогнозирующего кодирования для обработки больших наборов данных архивных материалов» (Machine Learning For Big Text: A Tutorial On Using Predictive Coding Tools To Process Large Archival Datasets).

  • Кристофер Ли (Christopher Lee, Университет Северной Каролины, США) и Кэм Вудс (Kam Woods, Университет Северной Каролины) «Анализ, экспертиза ценности и отбор на постоянное хранение и на уничтожение электронной почты: Руководство» (Reviews, Appraisal, and Triage of Mail: A Tutorial).
2. Ключевые доклады
  • Мишель Касвелл (Michelle Caswell, Калифорнийский университет в Лос-Анджелесе (UCLA), США) «Чья электронная сохранность? Определение наших точек зрения с целью перераспределения ресурсов» (Whose Digital Preservation? Locating Our Standpoints to Reallocate Resources).
3. Круглые столы и хакатоны
  • Хакатон  «Чтение Матрицы. Хакатон, связывающий цифровую судебно-криминалистическую экспертизу и обеспечение доступа пользователей» (Reading the Matrix. A Hackathon linking digital forensics to user access). Участвуют Сет Андерсон (Seth Anderson, Библиотека Йельского университета), Алекс Чассанова (Alex Chassanoff, институт Educopia), Итан Гейтс (Ethan Gates, Библиотека Йельского университета).

  • Круглый стол «Облачный атлас: Навигация в облаке в интересах обеспечения электронной сохранности» (Cloud Atlas: Navigating the Cloud for Digital Preservation). Ведущая Андреа Геталс (Andrea Goethals, Национальная библиотека Новой Зеландии), участники Мария Претцеллис (Maria Praetzellis, «Интернет-архив»), Рослинн Росс (Roslynn Ross, архивно-библиотечная служба Канады) и Николас Тейлор (Nicholas Taylor, Библиотки Стэнфордского университета).

  • Круглый стол «Достижение критической массы знаний, поддерживающих обеспечение долговременной сохранности электронных материалов в ядерной области» (Achieving Criticality of Preservation Knowledge: Sustaining Digital Preservation in the Nuclear Field). Ведущий Уильям Килбрайд (William Kilbride, британская Коалиция по электронной сохранности DPC). Участники Элизабет Ката (Elizabeth Kata, МАГАТЭ), Дженни Митчам (Jenny Mitcham, DPC), Филип Грейторекс (Philip Greatorex, компания Sellafield Ltd.) и Джим Мой (Jim Moye, компания J and A Preservation).

  • Круглый стол «Люди и процессы в сфере электронной сохранности: Как международные организации используют внутренние знания в поддержку электронных документов» (The People and Processes of Digital Preservation: International organizations leveraging internal wisdom to build support for digital records). Участники Джин Крамер-Смит (Jeanne Kramer-Smyth, Всемирный Банк), Монсеррат Канела (Montserrat Canela, Управления Верховного комиссара ООН по делам беженцев) и Инеке Дезерно (Ineke Deserno, НАТО).
4. Доклады
  • Ана ван Мееген Сильва (Ana van Meegen Silva, Амстердамский городской архив) «Решение в виде единого хранилища не всем подходит: На пути к распределенному и коллективному подходу к обеспечению сервисов электронной сохранности в Амстердамском городском архиве» (One repository solution doesn’t fit all. Towards a distributed and collaborative approach to digital preservation services at the Amsterdam City Archives).

  • Дэвид Джаретта (David Giaretta, компания PTAB Ltd), Джон Гаррет (John Garrett, компания Garrett Software), Марк Конрад (Mark Conrad, Национальные Архивы США), Элд Зирау (Eld Zierau, датская Королевская и университетская библиотека в Копенгагене), Терри Лонгстрет (Terry Longstreth, Вашингтонская академия наук), Джон Стивен Хьюз (John Steven Hughes, JPL), Матиас Хеммье (Matthias Hemmje) и Феликс Энгель (Felix Engel) из  Университет дистанционного обучения в г. Хаген) «Новости о работе над проектом 3-й версии стандарта OAIS» (OAIS Version 3 Draft Updates):
Источник: сайт конференции iPRES 2019
https://ipres2019.org/
https://ipres2019.org/site/wp-content/uploads/2019/06/iPRES2019_Programme.pdf

среда, 22 августа 2018 г.

Доклады на предстоящей конференции iPres 2018 по электронной сохранности


В сети выложен подробный перечень докладов (см. https://osf.io/u5w3q/wiki/home/ ) на очередной 15-й международной конференция по обеспечению долговременной сохранности электронных объектов iPres 2018 ( https://ipres2018.org/ ), которая в этом году пройдёт в городах Бостоне и Кембридже, штат Массачусетс, США, с 24 по 27 сентября.

Конференция iPRES является одной из ключевых по данной тематике в мировом масштабе, и всегда отличается разнообразной программой.

Ниже приведены названия тех докладов, которые меня в наибольшей степени заинтересовали.

24 сентября 2018 года
  • Сессия 101: Кристофер Пром (Christopher John Prom) и Триша Паттерсон (Tricia Patterson) «Архивация электронной почты: Стратегии, инструменты, методы» (Archiving Email: Strategies, Tools, Techniques);

  • Сессия 107 (семинар): Шейла Мориссей (Sheila Morrissey), Эми Кирхгоф (Amy Kirchhoff), Стивен Абрамс (Stephen Abrams), Карен Карьяни (Karen Cariani), Виней Черуку (Vinay Cheruku), Юэн Кокрен (Euan Cochrane), Мишель Линдлар (Michelle Lindlar) и Марсель Рас (Marcel Ras) «Активное курирование архивов и управление обеспечением долговременной сохранности в больших масштабах» (Active Archive Curation and Preservation Management at Scale);
25 сентября 2018 года
  • Сессия 203.3: Мэтью Эддис (Matthew Addis), Джастин Симпсон (Justin Simpson), Джонатан Тилбери (Jonathan Tilbury), Джек О’Салливен (Jack O'Sullivan) и Пол Стоукс (Paul Stokes) «Интероперабельность в электронной сохранности посредством реестров действий по обеспечению долговременной сохранности» (Digital preservation interoperability through preservation actions registries);

  • Сессия 203.4: Мишель Линдлар (Michelle Lindlar) и Франциска Шваб (Franziska Schwab) «Вся эта работа … для чего? Отдача на инвестиции в процесс сертификации доверенного архива – Пример из практики» (All that work … for what? Return on investment for trustworthy archive certification processes – a case study);

  • Сессия 208.3: Майкл Дэй (Michael Day), Морин Пеннок (Maureen Pennock), Кейлин Смит (Caylin Smith), Айан Кук (Ian Cooke) и Джереми Дженкинс (Jeremy Jenkins) «Планирование обеспечения долговременной сохранности появляющихс форматов в Британской библиотеке» (Preservation planning for emerging formats at the British Library);

  • Сессия 209.1: Роберта Ситтель (Roberta Sittel), Скотт Мафесон (Scott Matheson), Карла Гребнер (Carla Graebner), Синтия Эткин (Cynthia Etkin), Дэвид Уоллс (David Walls) и Мег Филип (Meg Phillip) «Основанные на политике коллективные подходы к обеспечению сохранности электронной государственной информации» (Policy-based collaborative approaches to preserving electronic government information);

  • Сессия 209.2: Дайна Хендель (Dinah Handel), Элис Прель (Alice Prael) и Джесс Вайт (Jess Whyte) «Централизуйте её! Создание инфраструктуры, поддерживающей электронную сохранность» (Centralize it! : Creating infrastructure to support digital preservation);
26 сентября 2018 года
  • Сессия 304.2: Алекс Грин (Alex Green), Марк Белл (Mark Bell), Джон Шеридан (John Sheridan), Джон Колломоссе (John Collomosse), Ту Бьюи (Tu Bui), Алан Браун (Alan Brown), Джеми Фосетт (Jamie Fawcett), Оливье Ферё (Olivier Thereaux) и Джени Теннисон (Tennison) «Применение блокчейна для укрепления доверия к государственным электронным архивам» (Using blockchain to engender trust in public digital archives);

  • Сессия 305.1: (круглый стол): «Подведение итогов деятельности в области электронной сохранности после 15 лет работы: Что сработало, что нет, что предстоит» (Taking Stock of Digital Preservation after 15 Years: What Worked, What Didn't, What's Coming), модератор Кейт Виттенберг (Kate Wittenberg);

  • Сессия 305.2: Сабина Шримпф (Sabine Schrimpf) и Ивонн Тюнна (Yvonne Tunnat) «15-летие немецкого проекта NESTOR (Network of Expertise in Long-Term Storage of Digital Resources - Сеть обмена опытом в области долговременного хранения электронных ресурсов)» (15 years of nestor: German Network of Expertise in Digital Preservation);

  • Сессия 308.1: Натан Толман (Nathan Tallman) и Лорен Вёрк (Lauren Work) «Подходы к проведению экспертизы ценности: Формулирование критериев для отбора электронного контента на сохранение» (Approaching Appraisal: Framing criteria for selecting digital content for preservation);

  • Сессия 308.2: Кейт Дое (Kate Dohe) и Дэвид Дурден (David Durden) «Определение затрат на хранение: На пути к созданию эффективных моделей затрат для электронной сохранности» (Determining the Cost of Keeping It: Towards effective cost-modeling for digital preservation);

  • Сессия 309.2: Карин Бреденберг (Karin Bredenberg), Кульдар Аас (Kuldar Aas), Дэвид Андерсон (David Anderson) и Джейм Камински (Jaime Kaminski) «Архивная интероперабельность в интересах устойчивого в длительной перспективе единого цифрового рынка» (Archival interoperability for a long-term sustainable Digital Single Market);

  • Сессия 310.1: Кэтрин Хугаард (Kathrine Hougaard), Эдсен Йохансен (Edsen Johansen) и Ким Чу Норёксе (Kim Schou Nørøxe) «Концепция организации электронной сохранности в небольших архивах» (A concept for organizing digital preservation for small archives);

  • Сессия 310.5: Ху Дьенхуэй (Jiahui Hu), Фан Ань (An Fang), Чьень Чин (Qing Qian), Ян Ченьлиу (Chenliu Yang) и Фань Юньмань (Yunman Fan) «Стратегии обеспечения долговременной сохранности электронных медицинских ресурсов» (Preservation strategies for medical digital resources);
27 сентября 2018 года
  • Сессия 401.4: Джоан Качмарек (Joanne Kaczmarek) и Брент Вест (Brent West) «Обработка электронной почты, управляемой по методу Capstone, с использованием предсказательного кодирования: Первые впечатления» (Processing Capstone Email Using Predictive Coding: First Impressions)
Источник: сайт OSFHome
https://osf.io/u5w3q/wiki/home/

вторник, 1 ноября 2016 г.

Наиболее яркие моменты конференции iPRES 2016, часть 2


(Окончание, начало см. http://rusrim.blogspot.ru/2016/10/ipres-2016-1.html )

Фото: мы со Стивом выступаем с нашим докладом (автор: @shirapeltzman )

Утром во вторник 4 октября вместе со Стивом Макки (Steve Mackey) из компании Arkivum мы выступили на сессии «Обеспечение сохранности научно-исследовательских данных» (Research Data Preservation)  -  очень приятно, что данной теме была посвящена целая сессия. Я рассказала о наших усилиях, в рамках проекта «Закрытия брешей в электронной сохранности»., по установлению связи хранилищ с системой Archivematica (Archivematica обеспечивает создание архивных информационных AIP-пакетов – Н.Х.), сосредоточив внимание, в частности, на «длинном хвосте» файловых форматов, используемых для хранения научных данных, и необходимости решения этого вопроса совместными усилиями всего сообщества.

Мой комментарий: В отношении научных данных, термин «длинный хвост» (long tail) применяется к многочисленным, но сравнительно небольшим по объёму наборам данных, которые часто «живут» на обычных персональных компьютерах, и, соответственно, не охватываются дисциплиной и мерами по обеспечению сохранности, которые имеются в крупных хранилищах. Относительно файловых форматов, тот же термин ссылается на многочисленные редкие, устаревшие и проприетарные форматы, в каждом из которых хранится сравнительно небольшое число файлов.

Замечательно было получить возможность выступить в переполненном зале, следствием чего стал ряд очень полезных дискуссий во время обеденного перерыва и на вечернем приёме для участников конференции.

Для меня одной из наиболее интересных на конференции стала сессия, посвященная инструментам и методам приема электронных материалов на хранение (ingest). На подобных мероприятиях меня всегда больше привлекают сессии, на которых основное внимание уделяется практическим инструментам и опыту работы из первых рук, а не теоретические доклады, так что это был очевидный выбор.

Сначала выступил Бруно Феррейра (Bruno Ferreira, компания KEEP SOLUTIONS, Португалия) об инструментальном наборе для обеспечения долговременной сохранности баз данных (Database Preservation Toolkit, подробнее об этом позже). После него был доклад «Изучение на разных уровнях электронного наследия Фридриха Киттлера: Инструменты в арсенал будущего архивиста», с которым выступили Юрген Энге (Jurgen Enge) и Хайнц Вернер Крамски (Heinz Werner Kramski) из Университета искусств и дизайна в Базеле.

Крайне любопытно было видеть, как они решали задачу обеспечения сохранности объёмного, разнородного и сложного электронно-цифрового наследия, преодолевая возникающие перед ними проблемы и препятствия. Выступающие также подчеркнули, что оборудование само по себе является важным свидетельством в своей физической форме, показывая, например, насколько часто Фридрих Киттлер использовал кнопку перезагрузки на своем ПК!

Фото: Делегаты конференции отдыхают на террасе.

Следующие два доклада были посвящены обеспечению сохранности электронной почты - у меня пока небольшой опыт в этой области, но я уверена, что в будущем мне предстоит этим заняться. Клаус Йенсен (Claus Jensen) из Королевской библиотеки Дании представил решение для приема на хранение электронной почты. Этот подход показался мне очень практичным, и было видно, что проектная группа хорошо продумала свои требования и усвоила уроки, полученные при испытаниях первоначального прототипа, прежде чем приступать ко второй итерации. Буду с интересом следить за этим проектом и с удовольствием прочитаю подробности в опубликованном докладе.

Затем выступил Брент Вест (Brent West) из университета штата Иллинойс с интересным интерактивным докладом об обработке сохраняемой по методу Capstone электронной почты с помощью предсказательного кодирования (Processing Capstone Email using Predictive Coding). Разговор был сфокусирован на проблемах принятия решений в рамках экспертизы ценности и оценки конфиденциальности сообщений электронной почты; а также о том, как может помочь поддерживаемый технологиями процесс анализа (technology assisted review), позволяющий программному обеспечению обучаться на примере уже принятых человеком решений с тем, чтобы впоследствии уменьшить объём ручного труда и сделать его более целенаправленным. Опять же, у меня было ощущение, что в будущем такого рода опыт может оказаться для меня очень полезным, если мне придётся столкнулся с задачей сохранения больших объёмов электронной почты.

Фото: Очень дорогой джин с тоником!

Организованная консорциумом BitCurator ( http://www.bitcurator.net/ ) во вторник вечеринка BitCurator Mixer предоставила хорошую возможность пообщаться с другими пользователями программного обеспечения BitCurator (применяется, в частности, для целей электронной судебной экспертизы – Н.Х.). Признаюсь, я пока не ещё не стала настоящим пользователем этого решения, но, получив теперь на свой рабочий стол новый компьютер для приема электронных материалов на хранение, его установка, освоение и тестирование – теперь для меня лишь вопрос времени. Здорово было поговорить с опытными пользователями и получить ряд советов относительно установки решения и поиска примеров рабочих процессов. Однако большего всего в моей памяти застряла цена на джин-тоник в том баре!

В среду во второй половине дня я приняла участие в семинаре под названием OSS4PRES 2.0: «Наведение мостов и заполнения пробелов» (Building Bridges and Filling Gaps) - по существу, продолжение семинара на тему «Использование инструментов с открытым кодом для выполнения требований  к электронной сохранности» (Using Open-Source Tools to Fulfill Digital Preservation Requirements), о котором я рассказывала в своём посте о прошлогодней конференции iPRES ( https://digital-archiving.blogspot.co.uk/2015/11/ipres-workshop-report-using-open-source.html ).

Это был один из тех семинаров, где от нас требовалось реально поработать (что всегда вызывает шок после обеда!). Участники разделились на три группы, каждая из которых обсуждала свою тему. Одна группа анализировала пробелы в составе инструментария с открытым исходным кодом, используемого для обеспечения электронной сохранности, которые нам следовало бы заполнить (либо путем расширения возможностей существующих инструментов, либо путем создания новых).

Вторая группа работала над проектом рекомендаций для поставщиков инструментов с открытым исходным кодом. Та группа, в которую попала я, обдумывала создание сообществом платформы для обмена рабочими процессами в области электронной сохранности. Мне кажется, что все это может вылиться создание действительно ценного ресурса для специалистов-практиков, которые хотят видеть, как их коллеги применяют эти инструменты.

К концу дня все группы сформулировали много идей и план действий. Работу по данным направлениям предполагается продолжить вне рамок семинара. Замечательно поучаствовать в семинаре, который не просто является «говорильней», но способен вывести на конкретные результаты.

Фото: Мой ноутбук напряжённо трудится на семинаре по обеспечению сохранности баз данных

В четверг утром 6 октября я присутствовала еще одно очень полезном практическом семинаре под названием «Стандарты и инструменты для обеспечения сохранности реляционных баз данных» (Relational Database Preservation Standards and Tools) . Участникам было предложено опробовать пакет SIARD Suite and Database Preservation Toolkit на своих ноутбуках. Ценность и отдача от этого семинара были ясны, и действительно возникло понимание того, как мы могли бы использовать эти инструменты для создания на основе реляционных баз данных их версий для целей долговременной сохранности.

Инструменты, поддерживающие работу с целым рядом широко используемых систем управления реляционными базами данных, позволяют экспортировать данные в формат SIARD 2. Этот формат по сути дела представляет собой zip-файл, содержащий соответствующую информацию в формате XML. Он удобнее, чем формат CSV (при  помощи которого я сохраняла базы данных в прошлом), поскольку содержит как сами данные, так и информацию об их структуре, и позволяет добавлять метаданные о том, как данные извлекались, Это возможности кажутся особенно полезными для создания «снимков» активно функционирующих баз данных для сохранения в рамках регулярно выполняемого цикла. Я определенно вижу для себя возможности для использования этих инструментов в будущем.

Фото: За рамками мероприятия пересеклись iPRES 2016 и «Швейцарская игрушка 2016» (Swisse Toy 2016 )

В конце сессии прошла полезная дискуссия о том, как эти инструменты будут на самом деле вписываться в более широкий рабочий процесс обеспечения сохранности; и можно ли будет интегрировать их в системы обеспечения долговременной сохранности (такие, как, например, Archivematica) и сконфигурировать как автоматический путь миграции для баз данных, созданных в Microsoft Access. Ответ на этот вопрос был утвердительным, но последующее обсуждение заставило предположить, что это, возможно, будет не лучший подход. Разработчики инструментов не считают полную автоматизацию наилучшим подходом. Как правило, нужен человеческий глаз для принятия решения о том, какие части базы данных должны быть сохранены, чтобы соответственно адаптировать процесс экспорта в формат SIARD 2.

В последний вечер конференции было замечательно поучаствовать в швейцарской ежегодной ярмарке игрушек, которое проходила на той же  площадке, что и конференция. Это была отличная возможность закупить подарки для семьи перед возвращением в Великобританию.

Дженни Митчем (Jenny Mitcham)

Источник: блог «Digital Archiving at the University of York»
http://digital-archiving.blogspot.ru/2016/10/some-highlights-from-ipres-2016.html

среда, 3 августа 2016 г.

США: Почему «предсказательное кодирование» пока не оправдало надежд в сфере э-раскрытия?


Данная заметка Дэрина Тига (Daryn Teague) была опубликована 20 июля 2016 года на блоге компании LexisNexis (это, в частности, крупнейший поставщик справочно-правовых систем). Автор занимается поддержкой линии программных продуктов для поддержки ведения судебных исков в технологическом центре им. Рейли компании LexisNexis (LexisNexis Raleigh Technology Center).

Мой комментарий: Напомню, что э-раскрытие (e-discovery) – это неотъемлемый элемент судебных процессов США. Стороны в обязательном порядке и под страхом жестких санкций обязаны отыскать и передать другой стороне все имеющиеся в их распоряжении и относящие к судебному спору документы и информацию. В связи с колоссальными объёмами электронных материалов ручной отбор подлежащих раскрытию документов и информации стал запредельно трудоемким и дорогостоящим. В связи с этим стороны обязаны договориться между собой о том, по каким признакам и ключевым словам будет проводиться поиск. В последние годы были предложены её более продвинутые решения, известные как метод «предсказательного кодирования» (predictive coding) – в этом случае используются системы, которые обучаются на согласованных сторонами эталонных выборках, а затем уже в автоматическом режиме отбирают похожие материалы из исходного массива. Есть, конечно, риск, что по тем или иным причинам (неоптимальная обучающая выборка, несовершенное владение технологиями и т.п. – даже в случае добросовестного применения метода) некоторые относящиеся к делу документы раскрыты не будут…

На прошлой неделе Налоговый суд США (U.S. Tax Court) отказал налоговой службе (Internal Revenue Service) в принятии решения о принуждении коммерческой компании к раскрытию электронной документированной информации, которая не была представлена при э-раскрытии на основе взаимно-согласованного использования «предсказательного кодирования». Это решение принято спустя два года после того, как тот же суд санкционировал применение «предсказательного кодирования» в рамках судебного спора (Dynamo Holdings, Ltd. vs. Commissioner, 143 T.C. No. 9 (2014)), и оно служит важным напоминанием со стороны суда о том, что «предсказательное кодирование» является допустимым способом э-раскрытия в судах США, и таковым оно и останется.

«Предсказательное кодирование» использует мощь методов и технологий машинного обучения для того, чтобы «натренировать» компьютер распознавать и идентифицировать в ходе анализа те документы, которые потенциально подпадают под э-раскрытие. Программное обеспечение «учится» классифицировать документы на опыте юристов-людей, отслеживая, как те принимают свои решения; а затем использует алгоритмы для предсказания того, как юристы моги бы классифицировать каждый документ в обрабатываемом массиве. Первоначальные пробные результаты затем анализируются с целью выявления имеющихся ошибок и точной подстройки алгоритмов – таким образом, очевидно, складывается гораздо более эффективный подход для анализа большого количества документов на относимость к делу.

«Предсказательное кодирование» впервые было допущено к применению в судебном процессе американским федеральным судьей-магистратом Нью-Йорка (Magistrate Judge – в федеральных судах США, младшие судьи, обладающие ограниченными полномочиями – Н.Х.) Эндрю Пеком (Andrew Peck) в 2011 году, и с тех пор постепенно расширяется признание данного метода судами США в качестве альтернативы дорогостоящему и непроизводительному ручному отбору документов. Однако, как отмечают такие эксперты отрасли, как Крейг Болл (Craig Ball). «предсказательное кодирование» пока не сумело в такой степени закрепиться в сфере судопроизводства, как это многие прогнозировали после широко разрекламированной поддержки его судьёй Пеком.

Почему же, имея поддержку судебного сообщества и экономические соображения в свою пользу, «предсказательное кодирование» не оправдало возлагавшихся на него надежд в сфере э-раскрытия?

«Ведущие связанную с судебными исками работу команды имеют доступ к поразительно продвинутым программным продуктам, основанным на технологиях машинного обучения, - но они не обязательно используют их так, как можно было бы ожидать. Самое большое препятствие, с моей точки зрения, связано с распространением использования таких инструментов», - говорит д-р Майкл Этген (Michael Etgen), старший архитектор LexisNexis по вопросам интерфейса и удобства использования. «Адвокаты и их сотрудники говорят об использовании предсказательного кодирования в ходе э-раскрытия, однако практике мы видим, что они применяют этот метод в очень ограниченном числе случаев и обстоятельств, а не во всей своей работе.»

Этген считает, что связывавшиеся с предсказательным кодированием надежды пока что не сбылись в связи с тремя основными факторами:
  • Отсутствие мотивации. «Вы должны понимать, что с помощью таких технологий, как предсказательное кодирование, юридические команды смогут анализировать куда большие объёмы документов, делать это быстрее, чем когда-либо прежде, расходуя при этом меньше ресурсов», - объясняет он. «Затраты на анализ и отбор документов на сегодняшний день составляют львиную долю затрат на э-раскрытие, а выживание некоторых организаций зависит от сохранения расценок на их услуги по анализу документов. Такие организации на самом деле не ищут новых и уникальных способов применения технологий для совершенствования своего бизнеса».

  • Угроза потери рабочих мест. «Сейчас, в период перехода глобальной экономики в электронно-цифровую эпоху, боязнь потерять рабочие места в нашем мире распространена повсеместно, и отрасль э-раскрытия здесь не является исключением», - говорит Этген. «Масштабные проекты анализа и отбора документов часто выполняют нанятые по контракту люди, которых просят выделить специфический контент, читая документ за документом. Эти люди, а также координирующие их работу и обеспечивающие получение от неё осмысленных результатов профессионалы, чувствуют, что их работа оказывается под угрозой со стороны систем машинного обучения, которые могут сделать то же самое быстрее и надежнее, чем они».

  • Сложность приложений. «Я также говорил со многими участниками судебных процессов, которые некомфортно себя чувствуют из-за того, что не могут понять, что же происходит внутри «черного ящика», который обычно представляли собой программные инструменты «предсказательного кодирования» первого поколения», - рассказывает Этген. «Представьте себе на минуту, что Вам нужно стоять перед судьей и отстаивать результаты работы программного приложения, в то время, как в действительности Вы не имеете ни малейшего понятия о том, что и как это приложение делает».
Этген отмечает, что отсутствие финансовых стимулов для более эффективной и производительной работы является тем элементом общей ситуации, который, вероятно, со временем будет устранен за счет действия рыночных механизмов. Он, однако, считает, что другие два вопроса, замедляющих внедрение предсказательного кодирования, решаются прямо сейчас.

«Что касается угрозы потери рабочих мест, то имеется достаточно свидетельств тому, что наилучшие результаты мы получаем, когда соединяем человеческое «прикосновение» и технологическую мощь машинного обучения, а не тогда, когда используем что-то одно», -  подчеркнул он. «Нет никаких оснований опасаться технологий, поскольку всегда будет требоваться участие и надзор человека для того, чтобы работа была выполнена как следует». (Есть, правда, одна «мелочь» - для «надзора» за работой экскаватора нужен всего один человек вместо сотен землекопов :)  Спрос на «машинистов экскаватора», вполне возможно, вырастет, а вот «землекопы», как массовая профессия, могут уйти в небытие… – Н.Х.).

Наконец, ответом на чрезмерную сложность имеющихся на рынке программных приложений, по словам Эткена, является разработка следующего поколения инструментов для э-раскрытия, где технические элементы будут интегрированы с элементами, обеспечивающими удобство работы пользователей. В последние месяцы он сфокусировал своё внимание на пользовательском интерфейсе для решения Lexis DiscoveryIQ - новой корпоративной программной платформы от компании LexisNexis, где совершенно иной подход к тому, как и когда предсказательное кодирование используется в деловых процессах.

«Мы преодолеваем один из барьеров для более широкого внедрения предсказательного кодирования путем обеспечения большей прозрачности того, как технология машинного обучения работает в решении Lexis DiscoveryIQ», - говорит Этген. «Упрощая и делая более интуитивно-понятным использование юристами следующего поколения инструментов для предсказательного кодирования, мы прокладываем путь для того, чтобы эти инструменты более полно оправдали возлагаемые на них надежды в сфере э-раскрытия».

Дэрин Тиг (Daryn Teague)

Мой комментарий: «Предсказательное кодирования» - это лишь один из вариантов использования автоматической/автоматизированной классификации документов и информации. Аналогичные инструменты можно использовать в процессе принятия решений в отношении сроков хранения, наличия защищаемой конфиденциальной и секретной информации, рассекречивания. Вообще мир идёт к тому, что всё чаще значимые решения, затрагивающие права и интересы человека, будут приниматься автоматически (пусть даже законодательство пока это и не разрешает). Нам, специалистам по работе с информацией, обязательно нужно отслеживать ситуацию – и вовремя осваивать новые технологии самим, чтобы не оказаться замененными «умными машинами» :)

Источник: блог компании LexisNexis
http://businessoflawblog.com/2016/07/why-hasnt-predictive-coding-fulfilled-its-promise-in-ediscovery/

четверг, 25 июня 2015 г.

28 положений наилучшей практики полномасштабного управления информацией, часть 3


(Окончание, предыдущую часть см. http://rusrim.blogspot.ru/2015/06/28-2.html )

Спустя несколько дней после публикации «28 положений наилучшей практики полномасштабного управления информацией» один из коллег задал Роберту Смолвуду на форуме специалистов по управлению документами и информацией следующий вопрос:
Хорошо подмечено, Боб. Спасибо тебе за то, что написал и выложил этот материал.  Можешь ли ты привести какие-нибудь примеры метрик, о которых ты упоминал в пункте 12?

Спасибо,

Гэри Линк (Gary Link)
Г. Питтсбург, США
30 апреля 2015
Напомню, о чём был 12-й пункт:
12. Требуются подходящие метрики для количественной оценки соответствия и эффективности Вашей программы управления информацией. Вам необходим объективный метод оценки положения дел, что означает цифры и метрики. Очень важно выбрать несколько осмысленных количественных мер ещё до развёртывания программы управления информацией.
Вот что ответил Роберт Смолвуд:
На Ваш вопрос, Гэри, перечислю несколько общих метрик, что первыми приходят в голову, с оговоркой, что наиболее подходящие метрики - это те, которые Ваша организация сама разрабатывает и считает наиболее актуальными в Вашей ситуации:
  • Выделите весь дублирующийся неструктурированный контент на общих дисках, в системах хранения типа SAN и NAS, и сократите объёмы хранения и соответствующие затраты на 20% в течение одного года. (Примечание: в среднем, как показывают результаты обследования организаций с использованием программного обеспечения для анализа файлов, дублетный контент составляет, как правило, 40-70% и очень редко - менее 40%).

  • Выявите не имеющий владельца «осиротевший» контент из выведенных из эксплуатации приложений либо принадлежавший уволившимся сотрудникам; а затем проанализируйте его, классифицируйте и к концу года удалите все материалы, не имеющие статуса документов. Цель заключается в сокращении объёмов хранения и расходов на 10% по сравнению с предыдущим финансовым годом. К концу года внедрите новые системы и процессы для отслеживания, классификации и управления «осиротевшим» контентом.

  • Сократите затраты на проведение юристами анализа материалов в ходе э-раскрытия на 20% по сравнению с предыдущим финансовым годом, используя технологию «предсказательного кодирования» (predictive coding).

  • В течение года проведите силами третьей стороны тестирование сети на защищенность от вторжений (intrusion test) с тем, чтобы выявить слабые места в Вашей сетевой инфраструктуре и системах.

  • Примите меры по устранению уязвимостей сети и систем, установите все необходимые обновления, связанные с безопасностью, и сократите количество попыток хакерских вторжений на 25% по сравнению с предыдущим годом.

  • В 2015 финансовом году проведите обучение 100 сотрудников, работающих в целевой сфере, по вопросам полномасштабного управления информацией и управления документами.

  • В течение года выявите всю персональную информацию (PII), защищаемые медицинские данные (PHI) и данные кредитных карт (PCI) и обеспечьте их защищённость с помощью технологий шифрования и цензурирования. В течение года внедрите постоянно действующий процесс, обеспечивающий защищённость персональных данных.

  • В течение года проведите обучение 100 сотрудников, работающих в целевой сфере, по вопросам защиты персональных данных.

  • В течение года внедрите программу полномасштабного управления данными с помощью программного обеспечения для управления мастер-данными (MDM) и устраните дубликаты структурированных данных. Целевая задачей является 20% сокращение требуемых ресурсов и расходов на хранение структурированных данных в сравнении с предыдущим финансовым годом.

  • В течение года проведите аудит полномасштабного управления информационными технологиями, используя руководства и инструменты ISO 38500 и COBIT5. К концу года сформируйте рекомендации по улучшению управления информационными технологиями.

  • В течение года проведите тестирование плана восстановления деловой деятельности после катастроф, выполняя в течение недели основные операции с использованием альтернативного источника энергии.

  • В течение года проведите пересмотр и аудит программы управления важнейшими документами организации. Подготовьте рекомендации по совершенствованию и расширению этой программы.
Уверен, что есть ещё десятки других метрик. Всё это должно стимулировать формирование осмысленных метких для планируемых программ полномасштабного управления информацией.

Роберт Смолвуд (Robert Smallwood)
Г. Сан-Диего, Калифорния, США
Источник: блог на сайте LinkedIn
https://www.linkedin.com/pulse/best-practices-information-governance-robert-f-smallwood?trk=mp-reader-card

среда, 23 июля 2014 г.

«Большие данные» представляют собой для права проблему эпического масштаба


Данная заметка Лиан Мезрани (Leanne Mezrani) была опубликована 3 июля 2014 года в ведущем австралийском юридическом еженедельном издании Lawyers Weekly.

Американский судья, эксперт по вопросам раскрытия электронной информации в ходе судебного разбирательства (eDiscovery - э-раскрытие), на недавнем круглом столе заявил, что необходимо срочно использовать возможности полномасштабного управления информацией (information governance) для того, чтобы взять под контроль проблему «больших данных» в сфере права.

Члены судейского корпуса и представители высшего руководства компаний-разработчиков программного обеспечения обсудили связанные с «большими данными» проблемы на круглом столе, организованном 16 июня 2014 года в Сиднее, Австралия, компаниями-поставщиками технологических решений Nuix и e.law.

Один из докладчиков, судья американского окружного суда Эндрю Пек (на фото вверху, вместе с судьей Маргарет Бизли – судья Пек известен в США как новатор, поддерживающий внедрение практики предсказательного кодирования –Н.Х.), обратил внимание на «колоссальные расходы» на э-раскрытие в электронную эпоху, которые в ходе крупных дел могут достигать миллионов долларов. По его словам, «[В э-раскрытие] в рамках дел одного и того же масштаба вовлекаются все большие и большие объемы данных, и через пять лет, если люди не приведут свои электронные активы в порядок, выполнять его станет просто невозможно».

Комментарии Пека прозвучали в ответ на вопрос о серьезности связанных с большими данными проблем, поставленный модератором круглого стола, президентом Апелляционного суда австралийского штата Новый Южный Уэльс судьёй Маргарет Бизли.

Пек добавил, что электронная почта является одним из главных виновников стремительного нарастания объёмов данных. «То, что раньше было предметом телефонного разговора, беседы в «курилке» или просто общения на ходу в коридоре, в настоящее время передается с использованием сообщения по электронной почте, ответа на него, ответа, рассылаемого всем адресатам сообщения и т.д.».

Его взгляды созвучны мнению бывшего партнера в фирме TressCox Альфонсо Грилло (Alfonso Grillo), недавно открывшего собственный бутик. В интервью нашему изданию, данном 3 июня, Грилло отметил, что расходы на оплату услуг многочисленных юристов, анализирующих массивы электронной переписки, в конечном итоге перекладываются на потребителей.

Слева направо: Джейсон Бэрон (Jason Baron, компания Drinker Biddle & Reath LLP), судья американского окружного суда Эндрю Пек (Andrew Peck), судья Маргарет Бизли (Margaret Beazley), Эллисон Стенфилд (Allison Stanfield, e.law) и Стивен Стюарт (Stephen Stewart, компания Nuix).

В работе круглого стола также приняли участие Джейсон Бэрон, консультант группы по э-раскрытию вашингтонской фирмы Drinker Biddle & Reath LLP (до этого Бэрон ряд лет работал директором Национальных Архивов США по вопросам судебных разбирательств – Н.Х.) и сопредседатель Инициативы по полномасштабному управлению информацией (Information Governance Initiative, http://www.iginitiative.comмеждисциплинарный консорциум и идейно-аналитический центр, способствующий распространению практик и технологий управления информацией – Н.Х.); генеральный директор компании e.law Эллисон Стенфилд и директор по технологиям компании Nuix Стивен Стюарт.

Полномасштабное управление информацией

Все выступавшие согласились с тем, что полномасштабное управление информацией является ключом к обузданию «больших данных».

Консультационная фирма Gartner определяет полномасштабное управление информацией как спецификации прав на принятие решений и системы подотчетности, обеспечивающих надлежащее поведение в процессе оценки, создания, хранения, использования, архивации и уничтожения информации.

«Это не просто управление документами на стероидах», - подчеркнул Бэрон. «Мы можем сэкономить огромное количество долларов в ходе судебных процессов за счет применения более умных методов и большего использования аналитики вместо традиционных методов поиска [при э-раскрытии]». Он добавил, что в конечном счете фирмы могут выделиться на общем фоне и получить конкурентное преимущество за счет отдачи для клиентов, получаемой благодаря снижению издержек на э-раскрытие.

Также в ходе круглого стола обсуждались преимущества и проблемы использования предсказательного кодирования (predictive coding) в качестве инструмента управления информацией.

Лиан Мезрани (Leanne Mezrani)

Источник: сайт Lawyers Weekly
http://www.lawyersweekly.com.au/news/big-data-an-epic-problem-in-law

понедельник, 29 апреля 2013 г.

США: Программа конференции MER 2013, часть II


(Продолжение, начало см. http://rusrim.blogspot.ru/2013/04/mer-2013-i.html )

На второй день конференции, 21 мая 2013 года, запланированы следующие доклады:
  • Черил Педерсон (Cheryl Pederson, фирма Cargill), Кэрол Стейнбрук (Carol Stainbrook, фирма Cohasset Associates, Inc.) «Стратегическое планирование – Дальнейшее продвижение на «поле битвы» по управлению сохраняемой в электронном виде информацией» (Strategic Planning – Advancing Success on the Battlefield of Managing Electronically-Stored Information). См. также http://www.merconference.com/details/session.php?id=15 ;

  • Том Рединг (Tom Reding, EMC), Брайан Тюммлер (Brian Tuemmler, фирма Nuix) и Марсия Цвиринк (Marcia Zweerink , фирма Cohasset Associates, Inc.) «Управление электронными документами с использованием аналитики – Шесть шагов к успеху» (Managing Your e-Records With Analytics - Six Steps to Success). См. также http://www.merconference.com/details/session.php?id=16 ;

  • Кеннет Витерс (Kenneth Withers , конференция Sedona) «Судебная практика по вопросам управления электронными документами: Ежегодная сводка новостей, последних тенденций и проблем для конференции MER» (ERM Case Law: The Annual MER Update of The Latest News, Trends, & Issues). См. также http://www.merconference.com/details/session.php?id=17 ;

  • Тереза Драбенштадт (Teresa Drabenstadt, фирма CUNA Mutual), Даррен Ли (Darren Lee, фирма Proofpoint) «Пример из практики: Присуждаемый ассоциацией ARMA International «Кобальтовый приз» за достижения в надлежащем управлении документами и информацией в масштабах организации был получен благодаря тому, что защитимое уничтожение документов позволило улучшить управление информацией в целом» (Case Study: Winning the 2012 Cobalt Award by Enabling Defensible Disposition to Achieve Better Information Governance). См. также http://www.merconference.com/details/session.php?id=18 ;

    Дополнительные сведения об этом опыте можно найти в презентации (см. http://www.rimeducation.com/pdf/M11S14.pdf ). По ходу проекта выяснилось, что 80% документов и информации, имевшихся у компании, следовало уничтожить. Обязательному сохранению подлежали только 5% данных, а ещё 15% могли быть сохранены, исходя из собственных интересов компании. Уничтожение ненужной информации позволило снизить правовые риски и сократить расходы на хранение информации.

  • Сью Джеррити (Sue Gerrity, фирма TRW Automotive), Тамир Сигал (Tamir Sigal) и Басам Заркоут (Bassam Zarkout) из фирмы RSD «Пример из практики: Как сделать реальностью управление корпоративной информацией в глобальном масштабе» (Case Study: The Journey: Bringing Global Enterprise Information Governance to Reality). См. также http://www.merconference.com/details/session.php?id=19 ;

  • Джейсон Бэрон (Jason R. Baron , Национальные Архивы США), Эндрю Пек (Andrew Peck, судья федерального окружного суда Южного Нью-Йорка) «Использование предсказательного кодирования и передовых технологий поиска: Беседа с судьёй Эндрю Пеком о складывающейся судебной практике» (Predictive Coding & Advanced Search Techniques: A Conversation with Judge Andrew Peck about Emerging Case Law). См. также http://www.merconference.com/details/session.php?id=20 ;

  • Гейб Мартинес (Gabe Martinez, Cisco) «Пример из практики: Удивительный путь, пройденный компанией Cisco в плане улучшения управления документами – от хаоса до получения в 2011 году «Кобальтового приза» ассоциации ARMA International» (Case Study: Cisco’s Incredible Journey of Records Management Improvement From Chaos to Winning the 2011 Cobalt Award). См. также http://www.merconference.com/details/session.php?id=21 ;

  • Дик Фишер (Richard (Dick) Fisher, фирма Cohasset Associates, Inc.), Бад Портер-Рот (Bud Porter-Roth, фирма Porter-Roth Associates, Inc.) «Облачные вычисления – Модное словечко или новая парадигма управления электронными документами?» (Cloud Computing – Buzz Word or New ERM Paradigm?). См. также http://www.merconference.com/details/session.php?id=22 ;

  • Ричард Кесслер (Richard Kessler, UBS), Брюс Радке (Bruce Radke , фирма Vedder Price P.C.), Стивен Стейн (Steven Stein, KPMG) «Пример из практики: Грамотное применение запретов на уничтожение документов и информации и создание соответствующих программ менеджмента в целях защитимого уничтожения унаследованных данных» (Case Study: Taming Legal Holds and Creating Programs for Legal Hold Management to Effectuate Defensible Legacy Data Disposition). См. также http://www.merconference.com/details/session.php?id=23 ;

  • Марк Куртис (Mark Curtis, фирма Proctor & Gamble) «Пример из практики: Вывод на новый уровень программы управления документами, уже получившей в 2010 году «Кобальтовый приз»: Трансформация управления документами и информацией в фирме «Проктор энд Гэмбл» (Case Study: Taking the 2010 Cobalt Award Winning Program to the Next Level: RIM's Transformation at P&G). См. также http://www.merconference.com/details/session.php?id=24 ;

  • Рон Хеджес (Ron Hedges, фирма Ronald J. Hedges LLC), Джесси Уилкинс (Jesse Wilkins, ассоциация AIIM International) «Практическое применение правил «что делать» и «чего не делать» при использовании социальных сетей: Новости 2013 года» (Implementing the Do's and Don'ts of Managing Social Media – 2013 Update). См. также http://www.merconference.com/details/session.php?id=25 ;

  • Джейсон Бэрон (Jason R. Baron) и Сюзан Салливен (Susan Sullivan) из Национальных Архивов США), Кон Леонг (Kon Leong, фирма ZL Technologies) «Пример из практики: Как справится с «гориллой» электронной почты в комнате – От теории к реальности» (Case Study: Taming the Email Gorilla in the Room - From Concept to Reality). См. также http://www.merconference.com/details/session.php?id=26 ;

  • Джон Крыса (John Krysa, фирма Millican & Associates, Inc., ранее член высшего руководства ФБР)  «Пример из практики: ФБР осваивает [современные технологии]: Как уходят в прошлое старые парадигмы, практика и традиции управления документами и информацией» (Case Study: The FBI Gets It: How Old RIM Paradigms, Practices, and Traditions are Being Retired). См. также http://www.merconference.com/details/session.php?id=27 ;

  • Тим Краучер (Tim Croucher, фирма Auritas LLC) «Жизненный цикл информации в ERP-системах и знакомство с процессом контролируемого уничтожения в SAP» (Information Life Cycle in ERP Systems and Introduction to Controlled Disposition in SAP). См. также http://www.merconference.com/details/session.php?id=28 ;

  • Джеймс Уотсон (James Watson, фирма Doculabs, Inc.) «Подготовка убедительного делового обоснования для деятельности по управлению документами и информацией: Ключевые элементы для проведения убедительного анализа экономической эффективности» (Making the Successful ERM Business Case: The Keys for Constructing Persuasive Cost Benefit Analyses). См. также http://www.merconference.com/details/session.php?id=29 .
В третий день конференции, 21 мая 2013 года, будет только один доклад (помимо ключевого) – но зато очень интересный:
  • Рэндольф Кан (Randolph A. Kahn, фирма Kahn Consulting, Inc.), Джонатан Редгрейв (Jonathan Redgrave, фирма Redgrave LLP) «Прыжок через бездонную пропасть: 5 способов изменить свою карьеру» (Leaping Over Infinite Dead Space: 5 Things to Change Your Career Path), См. также http://www.merconference.com/details/session.php?id=31 .
(Окончание следует, см. http://rusrim.blogspot.ru/2013/05/mer-2013-iii.html )

Источник: сайт конференции MER-2013
http://www.merconference.com/details/schedule.php/?pk_campaign=tw-schedule

четверг, 4 апреля 2013 г.

Международная организация по стандартизации может стандартизовать процессы поиска, выемки и представления электронных документов в случае судебных разбирательств и расследований (e-Discovery)


По материалам двух статей Ивена Кобленца (Evan Koblentz – на фото), опубликованных на сайте Law Technology News 7 и 11 февраля 2013 года.

Мой комментарий: Пока ещё нет устоявшегося русского эквивалента англоязычному термину e-discovery. Имеющиеся переводы или слишком длинные (как в заголовке данного поста), или не вполне раскрывают содержание этого ёмкого термина. В данном материале я буду для краткости использовать «компромиссный» вариант перевода – «электронное раскрытие», «э-раскрытие».

Члены Международной организации по стандартизации, – учреждения с 66-летней историей, занимающегося самыми разными вопросами - от банковских операций и до размеров обуви, членами которого являются сейчас 162 страны, - формируют новую рабочую группу по разработке стандартов для процессов э-ракрытия.

Эти стандарты, если они будут приняты, определят процедуры, которые желательно будет соблюдать при обработке электронных данных технологическим компаниям, поставщикам услуг э-раскрытия и их клиентам. «Данный международный стандарт содержит рекомендации относительно тех мер, охватывающих процессы от первоначального создания [сохраняемой в электронном виде информации – американский правовой термин «electronically stored information», ESI – Н.Х.] и до её окончательного уничтожения либо передачи на архивное хранение, которые организация может использовать для снижения рисков и расходов на случай, если действительно придётся выполнять э-раскрытие», говорится в подготовленном комитетом проекте стандарта.

Как пояснил специалист компании Hitachi Data Systems, представитель США в подкомитете и со-редактор проекта стандарта Эрик Хиббард (Eric Hibbard), если соответствующие продукты и услуги будут сертифицированы на соответствие требованиям ISO, то организации и её юристам будет легче принимать решение о закупках, и судьи будут уверены в том, что раскрытие электронных данных следует единым методикам.

Создаваемая группа по э-раскрытию войдёт в состав технического подкомитета ИСО, занимающегося вопросами компьютерной безопасности (В данный момент проектом э-раскрытия занимается рабочая группа WG4 «Меры и услуги по обеспечению безопасности» технического подкомитета SC27 «Методы обеспечения ИТ-безопасности» Объединенного технического комитета JTC1 «Информационные технологии» – Н.Х.). Это связано с тем, что данный комитет уже стандартизировал ряд вопросов электронной судебной экспертизы (digital forensics), таких, как идентификация, сбор и обеспечение сохранности электронных доказательств, и, соответственно, он имеет опыт работы по правовым вопросам. А вот в другие технические комитеты ИСО э-раскрытие не вписывается, добавил Хиббард.

«Мы не пытаемся навязывать юристам и судьям какие-либо требования. Цель нашей работы не в этом,  а в том, чтобы помочь им разобраться в ряде действительно туманных технологических вопросов», подчеркивает Хиббард

Помимо описания того, как должны функционировать сервисы и программное обеспечение для э-раскрытия, стандарт будет затрагивать вопросы аудита продуктов. Он будет опираться на давно зарекомендовавшие себя процедуры контроля качества из стандарта  ISO 9001, используемого, согласно данным недавнего опроса,  более чем миллионом компаний по всему миру. Оказывающие услуги по э-раскрытию компании могли бы проходить сертификацию и рекламировать свою продукцию как соответствующую ISO 9001. Как сообщил Хиббард, стандарт также будет ссылаться на существующие документы ИСО, касающиеся электронной судебной экспертизы.

В подкомитет по компьютерной безопасности, в котором работает Хиббард, входит 37 корпоративных членов, включая компании Booz Allen & Hamilton  Inc, EMC, Hewlett-Packard, Microsoft и Symantec, которые серьёзно занимаются вопросами э-раскрытия. Поскольку при формировании подкомитета не предполагалось затрагивать вопросы э-раскрытия, его корпоративным членам, возможно, придется изменить состав своих представителей в связи с расширением сферы деятельности подкомитета. Больше других э-раскрытием занимаются HP и Symantec, которые владеют соответственно такими фирмами как Autonomy и Clearwell Systems.

Поддержка и сомнения

Ряд опрошенных «Новостями правовых технологий» (Law Technology News) экспертов в области э-раскрытия заявили о поддержке деятельности Хиббарда, выразив одновременно определенные сомнения и колебания.

Том Барнетт (Tom Barnett), лидер по вопросам практической реализации э-раскрытия в компании Stroz Friedberg, поддерживает идею создания такой рабочей группы. «Думаю, для отрасли было бы полезно отделить тех, кто действительно серьезно относится к процессам и контролю качества, от всех прочих», говорит он. «Э-раскрытие стало многомиллиардной отраслью, но в каком-то смысле отрасль функционирует словно только зарождающееся направление деятельности, и в ней не внедрено такого рода стандартов. Это сделало возможным существование на практике широкого спектра стандартов качества э-раскрытия – а иногда, и вообще отсутствие каких-либо стандартов»

«По-моему, это замечательно», считает специализирующийся на э-раскрытии юрист компании Symantec Фил Фавро (Phil Favro). «Я думаю, что оправданы все усилия, способные привести к созданию трансграничных стандартов э-раскрытия, и что разработка таких стандартов международным органом с привлечением ключевым игроков отрасли – перспективный путь, который, надеюсь, позволит преодолеть непонимание, существующее между различными странами».

Тем не менее многие сторонники стандарта осторожны в своем оптимизме. Ральф Лоузи (Ralph Losey), ведущий блог «Команда э-раскрытия» (e-Discovery Team, http://e-discoveryteam.com/ ), отметил, что стандарт будет полезен, если команда Хиббарда сумеет обойти вопросы права: «Я твёрдо убеждён в полезности сотрудничества ИТ-специалистов с юристами», сказал он, но язвительно заметил, ссылаясь на Star Trek: «Я не хочу видеть капитана Кирка в инженерной комнате, и не хочу, чтобы Скотти командовал на мостике».

Проблемы и дальнейшие шаги

Отраслевые консультанты Джордж Соча (George Socha), известный по своей работе над эталонной моделью э-раскрытия (Electronic Discovery Reference Model), и Карл Шинеман (Karl Schieneman) из фирмы Review Less оба согласились с тем, что стандарт может оказаться полезным, но не скрывали свои сомнения в том, не является ли его разработка преждевременной.

«Наша область выиграет от хорошо проработанных стандартов, поскольку текущее положение дел далеко не удовлетворительное. Тем не менее, сфера э-раскрытия быстро изменяется – а ведь мы говорим о судебных процессах, которые предполагают противоборство сторон», говорит Соча. «Это означает, как я подозреваю, то, что в ближайшем будущем никто не сможет предложить всеохватывающие стандарты э-раскрытия, следование которых будет гарантировать участнику судебного спора успешную защиту своих позиций, вроде возможности заявить «Мы использовали услуги поставщика, соответствующего стандарту XYZ, так что к нам не может быть никаких претензий».

Похожие мыски высказал и Шинеман. «Очевидно, что трансграничное э-раскрытие становится всё более актуальной проблемой. Однако при стандартизации нужно понимать, какие именно процессы необходимо стандартизировать. Нужно знать, какие подходы работают. Сейчас основной задачей является экспериментирование». «Предсказательное кодирование (predictive coding), облачные вычисления, использование в работе собственных устройств сотрудников (bring-your-own-device, BYOD), социальные сети - при использовании всех этих подходом имеется масса проблем. Эти формы данных постоянно меняются», отметил Шинеман. «Поэтому, с моей точки зрения, иметь международный комитет, который попытался бы решить эти вопросы – дело хорошее, но более серьёзной задачей является опробование различных подходов, чтобы определить, какие из них работают».

Перед голосованием в подкомитете создание рабочей группы казалось формальностью, поскольку требовалось лишь пять голосов в поддержку проекта. Помимо поддержки со стороны американской делегации (которая всем желающим предоставляет возможность принять участие в обсуждении проекта и подать свои замечания и предложения через комитет INCITS), свою поддержку проекту обещали делегации Италии, Японии, Южной Африки и Великобритании. В случае успешного голосования предполагалось – где-то к концу мая 2013 года - сделать руководителем проекта британского специалиста по электронной судебной экспертизе Ангуса Маршалла (Angus Marshall), к июлю подготовить проект документа и к августу 2013 года провести его обсуждение. Но всё оказалось не так просто…

Как сообщил Хиббард, согласно правилам ИСО, чтобы начать разработку стандарта, нужно, чтобы пять стран заявили о своём участии и назначили контактных лиц. Однако только три делегации действительно так поступили - США, Великобритании и Таиланда, Ожидалась поддержка Италии, Японии и Южной Африке, которая не материализовалась, - вероятно, потому, что делегаты не сумели убедить своих национальные органы по стандартизации. Представители Японии и Австралии выразили озабоченность тем, что проект слишком сильно основывается на американском праве; а представители Канады не голосовали.

Хиббард пояснил, что есть три пути, по которым проект все еще может двигаться вперед, и в двух случаях проект останется в рамках международного сообщества. Один из таких способов – это если ряд стран-членов подкомитета изменят свою позицию до следующих выборов в ISO в середине апреля 2013 года. Так уже случалось с двумя другими проектами стандартов, которые в конечном итоге были успешно утверждены. Делегация США будут убеждать коллег из других стран и добиваться их поддержки. «Если еще две страны подтвердят на готовность принять участие в этом проекте, он сможет стартовать».

Второй способ заключается в том, чтобы объединить данный проект с проектом взаимосвязанного, более общего стандарта, например, с существующим стандартом анализа и интерпретации электронных доказательств. Если же на уровне ИСО ничего не получится, то команда Хиббарда может переключить свое внимание на разработку американских национальных стандартов; в дальнейшем, если проект получит признание, он сможет вернуться на международный уровень.

«Этот проект был предложен Соединёнными Штатами, и для этого нам пришлось как следует поработать над получением поддержки со стороны Американской ассоциации адвокатов (American Bar Association)», отметил Хиббард. Он также подчеркнул, что в ходе голосования в ИСО по содержанию проекта, 18 стран проголосовали за него, и добавил: «Я по-прежнему смотрю оптимистично на перспективы проекта».

Ивен Кобленц (Evan Koblentz)

Источник: Law Technology News
http://www.law.com/jsp/lawtechnologynews/PubArticleLTN.jsp?id=1202587234696
http://www.law.com/jsp/lawtechnologynews/PubArticleLTN.jsp?id=1202587768459