Обсуждение

В архиве: 11 комментариев.

Читать и комментировать в ЖЖ ↗

Имя не сохранено · 19 декабря 2010

Комментарий

ведь вправду "автомагическая разметка" :D а там есть авторазметчики тегов (чтобы их тоже само-группировать) ?

alexkuklin · 19 декабря 2010

Комментарий

С этим как-то совсем все плохо. Культура работы с текстом отсутствует как класс. Людей, которых хоть как-то структурируют документ можно пересчитать по пальцам. И непонятно, что с этим делать.

Имя не сохранено · 19 декабря 2010

Геодата

http://hitech.newsru.com/article/17dec2010/worldlens Word Lens ориентировано на туристов, которые не владеют языком страны, в которую приехали. Чтобы узнать значение фразы, нужно навести на нее камеру смартфона. На экране текст на иностранном языке будет заменен переводом.

Анатолий Левенчук · 19 декабря 2010

Re: Геодата

Вот специально не пишу про это: по этой приладе уже отписались все. Я не хочу увеличивать количество информационного шума, копипейста и так в Сети много.

Ответ на комментарий

Имя не сохранено · 24 декабря 2010

Вот ещё в Вашу копилку

Проект стартующий, а значит, ещё не всё сказавший: http://teratecs.ru Виджет комментирования распространяется для использования в интранет-проектах. Сервис на сайте - опытный образец, но им можно пользоваться для обсуждения неконфиденциальных текстов. Скажите, Анатолий, почему в Вашем перечне нет ThinkLink от Intel и SiteWiki от Google? Кстати, про последний проект я сейчас ничего в Сети найти не смог практически. Не знаете, что с ним?

Анатолий Левенчук · 24 декабря 2010

Re: Вот ещё в Вашу копилку

Есть два направления этой работы: комментирование людьми текстовых материалов (и это направление стабильно дохлое: люди редко дискутируют по поводу фрагментов текста, люди дискутируют по поводу моделей, которые текст отражают -- поэтому они дискутируют на форумах и в тредовых дискуссиях, а не в комментах какого-то review), и разметка текстовых материалов (то есть не размышление-дискуссия, а пометка в "комменте" того, что найдено в тексте -- тип, классификация, синтаксический разбор, перевод, координаты и всякое другое). Меня дискуссии по поводу фрагмента текста не волнует, я не тексты собираюсь писать и обсуждать. Меня волнует разметка -- я тексты собираюсь перерабатывать в формальные модели.

Ответ на комментарий

Имя не сохранено · 24 декабря 2010

Комментарий

Анатолий, вопрос: результат разбирательства с "аннотаторами" привел только к идее делать комментарии к MS Word в виде типа выделенной части документа и последующей экстракции с помощью макросов, или просматриваются более юзабельные решения и для других форматов документов?

Анатолий Левенчук · 24 декабря 2010

Комментарий

Результата разбирательства с аннотаторами еще нет, тема только-только заявлена. Написать в ЖЖ -- это еще не значит "разобраться" и принять решение :)

Ответ на комментарий

Имя не сохранено · 25 декабря 2010

Re: Вот ещё в Вашу копилку

На сайте представлен движок. Каким смыслом наполнить комментарии - вопрос другой. В текущей реализации предусмотрены комментарии, соответствующие предложениям о правках к тексту: удалить, добавить, заменить. И эта нотация будет развиваться дальше. Возможны и другие схемы: переводы, например, как Вы правильно заметили. Я согласен, что просто комментирование - дохлое направление, но - только в определённом смысле. Перечисленные мной стартапы двух гигантов демонстрируют безуспешность попыток создать глобальный контекстный дискуссионный сервис. Он, конечно, должен быть, людям он нужен, но не как центр притяжения. Им не завлечь публику, люди не будут с него начинать рабочий день. Он нужен только по ситуации. Но, когда он нужен - его нет. Сейчас невозможно к фрагменту текста посмотреть возражения. Гирлянду дискуссий - пожалуйста, но не всегда есть время их распутывать, эти гирлянды. Как быть?

Ответ на комментарий

Имя не сохранено · 26 декабря 2010

Комментарий

мои извинение, ваша демонстрация работы с комментариями в MS Word была воспринята, как прототип решения :) Ниже текст на понимание задачи аннотирования :) IMHO, в связи с аннотированием текста интересней понять, что потом автоматически можно делать с размеченными кусками. Предположим у нас есть документ с требованиями и документ с требованиями аннотировали в терминах модели Яна Александера (также предположим, что модель требований Александера выразили в ISO 15926 или "аналоге" :) ), тогда мы можем: 1. проверить на пропуск описаний и дополнить модель. 2. проверить на противоречивость внутри документа и с формальной моделью предметной области. 3. трассировать результаты работ до места где требования были документированы. Остается открытым вопрос сколько нужно и сколько есть моделей для поддержки всех практик жц по ISO 15288? Вопрос с выражением моделей в ISO 15926 оставим пока за скобкой :).

Ответ на комментарий

Анатолий Левенчук · 26 декабря 2010

Комментарий

Всё много хуже :-) Что должно быть первичным: "документ требований" или "модель с требованиями"? Есть практика "поднятия 2D бумажных документов в 3D цифру". Хочется сделать такую же технологию для поднятия бумажных старинных требований в модельную цифру -- чтобы дальше развивать и использовать эти требования уже в цифре. Все эти "трассировки" нужны при этом главным образом на стадии отладки точности подъема. Аннтирование для меня -- это есть технология "подъема в цифру": берем кусок текста, и в аннотации пишем для него фрагмент модели. Но в случае 2D-->3D процесс по факту формален. В случае требований входная "бумага" неполна, бесструктурна, не соответствует никакой метамодели -- а выходная "цифра" тоже не имеет метамодели. С другой стороны, более-менее понятно, какие артефакты идут дальше по этой цепочке: архитектурные описания, которые тоже обычно пропущены (ибо сразу идут рабочие развернутые артефакты -- чертежи и расчеты, а вся "архитектура" растворена в протоколах совещаний, по которым принимались те или иные архитектурные решения). Теперь считаем обратную цепочку: все процессы приёмки сдачи, документооборота (не оборота данных!) настроены на тексты -- и если удастся сделать "приличные цифровые требования" (то есть собрать все аннотации в объединенную из них модель, убрать неизбежные противоречия, добавить недостающее и т.д.), то нужно предусмотреть какую-то их выгрузку в бумажной форме, что не сводится к аннотированию и представляет ровно обратную задачу генерации текста из аннотаций (а не генерации аннотаций по тексту). В программировании иногда рассматривается вопрос о парсерах-генераторах, которые работают в двух направлениях. Вот такой бы парсер-генератор сделать бы для требований: тексты с одной стороны, модели с другой, и возможность редактирования в любой из этих форм с автоматическим отображением изменений в другой форме. Аннотатор -- это "ручной парсер" для этой целевой архитектуры, не более того.

Ответ на комментарий