Обсуждение

В архиве: 23 комментария.

Читать и комментировать в ЖЖ ↗

alexott · 29 марта 2007

Комментарий

знаний, да, не сильно прибывает, но генерируется море информации, которую приходится пропускать сквозь себя, чтобы вычленить полезное зерно. а если работаешь в нескольких областях, то потоки становятся совершенно невообразимыми :-(

vitus_wagner · 29 марта 2007

Комментарий

Пора начинать эту проблему решать технически. Приспособить фильтры какие-нибудь, чтобы пропускать через себя не весь поток, а только то, что уже интересно. Проблема-то не новая. Раньше, правда, в связи с меньшим развитием средств коммуникации, мощные потоки информации были только у тех, кто мог это себе позволить (правителей, крумных менеджеров). У них была возможность нанять человека-референта. Сейчас такие потоки доступны всем. Следовательно, нужны столь же доступные роботы-референты.

Ответ на комментарий

alexott · 29 марта 2007

Комментарий

для меня основная проблема, что я часто черпаю идеи из соседних областей, для которых я пока не могу эффективно отфильтровывать знания. Как же можно будет натренировать робота на это? Во вторых, в каждый конкретный момент, мозг может искать какую-то определенную порцию знаний, при этом отмечая все интересные идеи. Я все потенциально интересные вещи сохраняю в букмарки/на диске/тегирую. Что в принципе происходит со всеми статьями Анатолия :-) Робот же, либо будет генерировать слишком много информации/ссылок, либо наоборот, не пропускать нужную информацию.

Ответ на комментарий

9000 · 29 марта 2007

Комментарий

Путь интересного вам в потоке 10%, а робот будет уменьшать поток всего вдвое, с пренебрежимым уровнем false negatives. Вопрос: бесполезен ли будет такой робот? :)

Ответ на комментарий

vitus_wagner · 29 марта 2007

Комментарий

В принципе 9000 уже ответил. Робот будет полезным если он хотя бы немного улучшит соотношение сигнал/шум в просматриваемом потоке информации. Объем этого потока, очевидно, ограничен. Соответственно, фильтрация источников которые в среднем наименее интересны, позволит включить в этот поток (фильтрованные) источники, которые сейчас ниже порога интересности. А что касается false negatives, то, на мой взгляд, это не страшно. Поскольку идеи, как известно, носятся в воздухе, идею, пропущенную твоим роботом, поймает, например, мой. После чего она будет пересказана в моем блоге, и получит второй шанс попасть тебе на глаза, особенно если мой блог имеет для твоего робота более высокий уровень релевантности, чем первоначальный источник идеи.

Ответ на комментарий

alexott · 29 марта 2007

Комментарий

ранкинг - это да, может быть полезным, но ранкинг должен быть динамическим. можно подумать как это дело реализовать, но пока идея мне кажется очень сложной в реализации

Ответ на комментарий

9000 · 29 марта 2007

Комментарий

Ещё раз, с цифрами. 1) Нефильтрованный поток. 10% интересного, 90% false positives. Время, требуемое на чтение, равно T. 2) Несовершенно фильтрованный поток (отсечена половина): 20% интересного, 80% false positives. Время, требуемое на чтение, примерно равно T/2. Что не так в этой картинке? :)

Ответ на комментарий

alexott · 29 марта 2007

Комментарий

я говорю про немного другое. 90% false positives может быть только если ты занимаешься одной конкретной темой. У меня фальшивых чтений значительно меньше. У меня стоит другая проблема - отфильтровывать уже прочитанную информацию, переданную другими словами, без добавления нового.

Ответ на комментарий

Имя не сохранено · 29 марта 2007

Комментарий

Вы посмотрите, все техники по личной эффективности в той или иной мере отражают данную задача - вычленить из потока инфы нужную и эффективно ее обработать. Так что это должно быть не механическое устройство, а развитие навыков и способностей человеческого мозга

Ответ на комментарий

vitus_wagner · 29 марта 2007

Комментарий

Одно другому совершенно не мешает. Устройство проводит предварительную фильтрацию, снижая мощность потока до той, которую сможет осилить человек. А уж какова конкретно будет эта осиливаемая мощность, зависит от личной эффективности.

Ответ на комментарий

alexott · 29 марта 2007

Комментарий

про гнус я уже думал, но есть одно но - это одна точка доступа к информации (имеются в виду настройки и т.п. - достаточно тяжело реплицировать). Я пока пользуюсь google reader из разных мест - дома (винда, линукс, windows mobile), на работе, вот туда и хотелось бы перенести такой функционал :-)

Ответ на комментарий

sergiej · 29 марта 2007

Комментарий

Такую же пугающую презентацию можно было делать и в 1907 году, даже страшнее.

alexott · 29 марта 2007

Комментарий

кроме мозга, есть еще и глаза и другие части тела, которые тоже учавствуют в передаче информации, и иногда становятся стопором

Ответ на комментарий

vitus_wagner · 29 марта 2007

Комментарий

Возникает мысль spamassassin слегка подхакать. В сочетании с тем же rss2email. Т.е. иметь специальную базу и прописывать не X-Spam-Status, а X-Interesting-Score. С обучалками, конечно, похуже чем в GNUS и почтовый клиент потребуется везде иметь достаточно разумный. Который сумеет хотя бы сортировать по этому score.

Ответ на комментарий

vitus_wagner · 29 марта 2007

Комментарий

Утверждение что время на чтение false positive равно времени на чтение действительно интересной вещи. Внутренние фильтры человека - штука весьма эффективная. false positive ты по диагонали пробежишь и дальше пойдешь, а над интересной вещью думать будешь. Так что такой уровень фильтрации даст не 50% выигрыш в скорости (а на самом деле не в скорости, а в объеме исходного потока), а всего процентов 5-10.

Ответ на комментарий

alexott · 29 марта 2007

Комментарий

у меня что-то раздумья приводят к мысли о динамическом формировании баз а-ля байес, но для разных тем, для того, чтобы раскидывать данные по темам. плюс хранить профили уже прочитанных статей, для того, чтобы сравнивать с новыми и избегать повторения тем. правда байес в этом случае не будет нормально работать, и надо использовать более продвинутые техники категоризации данных. я сейчас как раз пытаюсь сделать категоризацию входящих данных, основываясь исключительно на содержимом - работа у меня такая :-)

Ответ на комментарий