Обсуждение
Читать и комментировать в ЖЖ ↗
знаний, да, не сильно прибывает, но генерируется море информации, которую приходится пропускать сквозь себя, чтобы вычленить полезное зерно. а если работаешь в нескольких областях, то потоки становятся совершенно невообразимыми :-(
Комментарий
Пора начинать эту проблему решать технически. Приспособить фильтры какие-нибудь, чтобы пропускать через себя не весь поток, а только то, что уже интересно.
Проблема-то не новая. Раньше, правда, в связи с меньшим развитием средств коммуникации, мощные потоки информации были только у тех, кто мог это себе позволить (правителей, крумных менеджеров). У них была возможность нанять человека-референта.
Сейчас такие потоки доступны всем. Следовательно, нужны столь же доступные роботы-референты.
Комментарий
для меня основная проблема, что я часто черпаю идеи из соседних областей, для которых я пока не могу эффективно отфильтровывать знания. Как же можно будет натренировать робота на это? Во вторых, в каждый конкретный момент, мозг может искать какую-то определенную порцию знаний, при этом отмечая все интересные идеи. Я все потенциально интересные вещи сохраняю в букмарки/на диске/тегирую. Что в принципе происходит со всеми статьями Анатолия :-)
Робот же, либо будет генерировать слишком много информации/ссылок, либо наоборот, не пропускать нужную информацию.
Комментарий
Путь интересного вам в потоке 10%, а робот будет уменьшать поток всего вдвое, с пренебрежимым уровнем false negatives.
Вопрос: бесполезен ли будет такой робот? :)
Комментарий
В принципе 9000 уже ответил. Робот будет полезным если он хотя бы немного улучшит соотношение сигнал/шум в просматриваемом потоке информации. Объем этого потока, очевидно, ограничен. Соответственно, фильтрация источников которые в среднем наименее интересны, позволит включить в этот поток (фильтрованные) источники, которые сейчас ниже порога интересности.
А что касается false negatives, то, на мой взгляд, это не страшно. Поскольку идеи, как известно, носятся в воздухе, идею, пропущенную твоим роботом, поймает, например, мой. После чего она будет пересказана в моем блоге, и получит второй шанс попасть тебе на глаза, особенно если мой блог имеет для твоего робота более высокий уровень релевантности, чем первоначальный источник идеи.
Комментарий
не уверен насчет пренебрежимости false positives ;-)
Комментарий
ранкинг - это да, может быть полезным, но ранкинг должен быть динамическим. можно подумать как это дело реализовать, но пока идея мне кажется очень сложной в реализации
Комментарий
Ещё раз, с цифрами.
1) Нефильтрованный поток. 10% интересного, 90% false positives. Время, требуемое на чтение, равно T.
2) Несовершенно фильтрованный поток (отсечена половина): 20% интересного, 80% false positives. Время, требуемое на чтение, примерно равно T/2.
Что не так в этой картинке? :)
Комментарий
я говорю про немного другое. 90% false positives может быть только если ты занимаешься одной конкретной темой. У меня фальшивых чтений значительно меньше. У меня стоит другая проблема - отфильтровывать уже прочитанную информацию, переданную другими словами, без добавления нового.
Комментарий
Вы посмотрите, все техники по личной эффективности в той или иной мере отражают данную задача - вычленить из потока инфы нужную и эффективно ее обработать.
Так что это должно быть не механическое устройство, а развитие навыков и способностей человеческого мозга
Комментарий
Одно другому совершенно не мешает. Устройство проводит предварительную фильтрацию, снижая мощность потока до той, которую сможет осилить человек. А уж какова конкретно будет эта осиливаемая мощность, зависит от личной эффективности.
Комментарий
В качестве нулевого приближения - rss2email + GNUS с adaptive scoring.
Комментарий
про гнус я уже думал, но есть одно но - это одна точка доступа к информации (имеются в виду настройки и т.п. - достаточно тяжело реплицировать). Я пока пользуюсь google reader из разных мест - дома (винда, линукс, windows mobile), на работе, вот туда и хотелось бы перенести такой функционал :-)
Комментарий
Такую же пугающую презентацию можно было делать и в 1907 году, даже страшнее.
Комментарий
кроме мозга, есть еще и глаза и другие части тела, которые тоже учавствуют в передаче информации, и иногда становятся стопором
Комментарий
Возникает мысль spamassassin слегка подхакать. В сочетании с тем же rss2email. Т.е. иметь специальную базу и прописывать не X-Spam-Status, а X-Interesting-Score. С обучалками, конечно, похуже чем в GNUS и почтовый клиент потребуется везде иметь достаточно разумный. Который сумеет хотя бы сортировать по этому score.
Комментарий
Утверждение что время на чтение false positive равно времени на чтение действительно интересной вещи. Внутренние фильтры человека - штука весьма эффективная. false positive ты по диагонали пробежишь и дальше пойдешь, а над интересной вещью думать будешь.
Так что такой уровень фильтрации даст не 50% выигрыш в скорости (а на самом деле не в скорости, а в объеме исходного потока), а всего процентов 5-10.
Комментарий
Разумно.
Комментарий
у меня что-то раздумья приводят к мысли о динамическом формировании баз а-ля байес, но для разных тем, для того, чтобы раскидывать данные по темам. плюс хранить профили уже прочитанных статей, для того, чтобы сравнивать с новыми и избегать повторения тем. правда байес в этом случае не будет нормально работать, и надо использовать более продвинутые техники категоризации данных.
я сейчас как раз пытаюсь сделать категоризацию входящих данных, основываясь исключительно на содержимом - работа у меня такая :-)
Комментарий
Да, конечно. Только тогдашний десяток лет был вдвое-втрое длиннее нынешнего. А так -- разницы никакой.