Показаны сообщения с ярлыком data mining. Показать все сообщения
Показаны сообщения с ярлыком data mining. Показать все сообщения

пятница, апреля 10, 2009

Evernote на русском

Недавно заметил, что сервис по ведению заметок Evernote, за которым  я издавна следил был локализован. Сегодня скачал клиент, на первый взгляд достойная замена неподдерживаемому нынче Google Notebook и Microsoft OneNote.

Правда бесплатная версия имеет некоторые ограничения по количеству сохраняемой информации в месяц, но для меня совершенно не напряжные. Можно сохранять до 40 Мб в месяц, создавать в месяц не более 20000 текстовых заметок, 270 копий вебстраниц, 400 фото с телефона, 39 голосовых заметок, 11 фото высокого разрешения.

Платная версия, заменяющая эти ограничения на более легкие:


Текстовых заметокМного, много тысяч
Фото с телефона / рукописных заметок5,000
Копий веб-страниц3,300
Голосовых заметок450
Картинок высокого разрешения150

стоит 5$ в месяц.

вторник, июля 29, 2008

Блого-нумерология

У меня на блогспотовских блогах стоит код Google Analytics для просмотра статистики. Блогов 2 - околокомпьютерный блог и про рисование - trytodraw. В первом - около 35 постов, он регулярнее обновляется, во втором постов всего 13, последний - месяц назад, что-то мне в последнее время не рисуется... Подписчиков по RSS тоже у околокомпьютерного блога больше в 2 раза, 17 против 9. И тем не менее, блог о рисовании - более посещаемый, на него за месяц заходило 121 "абсолютно уникальных посетителя", а на околокомпьютерный - всего 104. Вот такая вот загадка природы.

Причём находят Trytodraw в основном с помощью гугловского поиска, с яндекса вообще не заходят. Ну еще с социальных закладок много народу заходит (с bobrdobr.ru и memori.ru). Видимо, про компьютеры блогов выше крыши существует, а про рисование не так много, так что тема востребованная, клюют даже на дилетантов :)

sindicollo

Это sindicollo.blogspot.com. В последнюю неделю началось оживление, а большую часть месяца на блог заходило человек по 5 в день. Здесь доля поискового траффика маленькая, информации о темах, о которых я пишу, в интернете и так много, так что блог на первые страницы выдачи почти не попадает. В основном сюда попадают по ссылкам. Зато доля яндекса тут равна доле гугла.

trytodraw

А это - trytodraw.blogspot.com. Тут, несмотря на то, что блог весь месяц не обновлялся, всё более-менее постоянно, взлёты чередуются с падениями. В основном, кстати, сюда попадают по ключевым словам "кельтские узоры".



суббота, декабря 29, 2007

Использование mind maps на практике

После того, как мне некоторое время назад попалась информация о том, что такое mind maps AKA интеллект-карты, я быстро оценил потенциал этой методики и начал усиленно искать информацию о ней. Первоисточник, кстати, тоже одолел (Тони Бьюзен, "Супермышление", скачал в электронном виде, поскольку в книжных магазинах города не нашёл). Замечательной штукой оказалось для анализа задач. Сейчас у меня программа для их создания на компьютере практически всегда открыта, а в ней несколько закладок с картами по задачам, проблемам, книгам, с которыми я в данный момент имею дело. Очень полезно для анализа любой области.

Например, поскольку я нынче начинающий блогер, всё, что связанно с блогами вызывает у меня интерес, в том числе, разумеется и их раскрутка. Попалась мне недавно статья 40 инструментов SMO-продвижения. Не то, чтобы я собирался все из них использовать, но по крайней мере осознавать, как это в принципе делается, мне хочется. Но список в статье абсолютно не наглядный, в нём все в кучу и для анализа того, в чём он неполный, что в него можно добавить, он очень неудобен.

20 минут и mindmap готова:


после этого в неё можно вставлять свои собственые идеи на эту тему, ссылки на другие статьи и вообще получился результат, с которым можно дальше работать.

По аналогичному принципу строятся mindmaps для конспектов, книг по специальности, проекту, с которым я в данный момент работаю, можно идеи для своего блога таким образом записывать, и найти ещё кучу потенциальных областей использования. В общем это инструмент конечного этапа data mining'а в его неавтоматизированном варианте.

среда, декабря 26, 2007

Data mining с человеческим лицом

В продолжение предыдущего поста. Я упоминал там статьи двухлетней давности Сергея Голубицкого из "Компьютерры", в которых он рассказывал про свою систему data mining'а в инете. Сегодня нашёл его же лекции на эту тему в форме mind maps:

Семинар по Data Mining: Каждую неделю на протяжении пяти лет мне приходится собирать около 150-200 газетных заметок, журнальных статей, библиографических ссылок, дайджестов, отчетов, судебных протоколов, сенатских слушаний, интервью и автобиографических откровений для того, чтобы, проанализировав всю эту разношерстную информацию, подготовить для «Бизнес Журнала» эссе-исследование по новой, в подавляющем большинстве случаев незнакомой теме. Прочитать такое обилие материалов за несколько дней… что ж, дело хоть и тяжкое, но посильное. Дальше, однако, начинается самое грустное: оказавшись один на один с листом чистой бумаги, быстро понимаешь, что ровным счетом ничего не помнишь. В голове сплошные обрывки разрозненных сюжетных линий, дат, цифр и имен фигурантов. Творческий процесс выглядит примерно так: «Итак, в начале статьи расскажем о детстве создателя «Daewoo» Ким Ву Чуна. Замечательно… Только где он там родился? В каком городе? А как назывался университет, в который Ким поступил? Ах да, обо всем этом он рассказывал в одной из своих автобиографических книг… вот только какой?

Очень полезная вещь, надо будет проштудировать.

вторник, декабря 25, 2007

Data mining

Этот термин, к моему стыду, впервые попал в поле моего зрения года два назад, когда я прочитал статью в "Компьютерре".

Вообще-то классическое определение data mining'а - это автоматизированный поиск закономерностей в больших объёмах информации, например в научных целях в экспериментальных данных или в коммерческих целях в социальных сетях, чтобы легче было людям что-то впарить. Или к примеру в данных о продажах онлайн магазинов, чтобы предлагать потенциальному покупателю "с этим товаром обычно покупают ..." или "возможно вас заинтересует ...".

Но в той статье говорилось несколько о другом - о неавтоматизированном личном поиске информации в инете, а точнее, о целой технологии, включающей в себя поиск, накопление, систематизацию информации, создание собственной базы знаний, обработку этой базы знаний.

Статью ту, точнее серию статей, я сейчас нашёл:
Автор - Сергей Голубицкий, Возвращение поросячьего восторга. Часть первая, Часть вторая, Финита поросячьего восторга.

Очень познавательное чтиво. В статьях автор рассказывал о программах, которые ему помогали накапливать информацию, нарытую в процессе вебсерфинга, причём в виде, удобном для дальнейшего использования. Просто обычно человеку, активно резвящемуся на интернет просторах, попадается куча информации, которая в данный момент не нужна, но потенциально полезна. Но в последствии найти это снова сложно, поскольку всё в закладки браузера не положишь.

Главной звездой этой серии статей была программа Content Saver, ныне переименованная в Web Research. Программа действительно удобная, я её по мотивам этих статей скачал, и до сих пор использую. Позволяет записать интернет статью в архив с добавлением категорий, а также даёт возможность локально редактировать сохранённое, подчёркивать важные места в статье жёлтым фоном, осуществлять сложный поиск по архиву по словам или по категориям.


Судя по статье на Демоблоге - есть альтернативная программа с похожими функциями - Evernote, которая помимо сохранения страниц позволяет сохранять свои заметки, в том числе рукописные, фотографии, рисунки, присваивать заметкам категории, осуществлять по ним поиск и ещё много чего. Наверное, тоже хорошая штука, правда тоже shareware.

Правда за истекшие 2 года появился другой инструмент для подобных целей - системы социальных закладок, типа memori.ru, BobrDobr, del.icio.us и т.д., в блоге с боку есть кнопка с почти полным списком подобных вещей, который также даёт возможность сохранять на будущее потенциально полезные вещи, присваивая при этом тэги, по которым впоследствии можно найти нужное. В большинстве подобных сервисов правда нет возможности локального сохранения на сервере страниц, что грозит тем, что страницу впоследствии сотрут или изменят. Хотя я думаю, вскоре что-то подобное в этих интернет-закладках появится, а может и уже где-то есть, я не все проверял. Зато есть возможность осуществлять поиск не только по своим тэгам, а по всему, что сохранили несколько тысяч пользователей этой системы, что даёт серьёзное преимущество над локальными архивами.

Я думаю, каждый человек, желающий ориентироваться в текстовой помойке по имени Инет должен для себя разработать какую-то личную систему датамайнинга. Моя только в процессе создания, пожалуй об этапах этого трудного пути я буду сообщать тут :)

Кстати, на закуску - очень интересная статья на эту же тему, которую я нашёл благодаря memori.ru
The Data Mining Skill из журнала Хакер.