Социализируемся

Я в Google+ Я в Twitter Я в Facebook

Showing posts with label Інформаційно-пошукові системи. Show all posts
Showing posts with label Інформаційно-пошукові системи. Show all posts

Monday, May 21, 2012

About Google Knowledge Graph

    Итак, Гугл анонсировал Граф Знаний от Гугла - Google Knowledge Graph, знакомьтесь:

Для нас (в рунете) увы пока еще эту опцию не включили, но уже можно ознакомиться по картинкам в презентации и статье Майка Бергмана, каким теперь будет страница с поисковыми результатами.



Ну и на закуску:
Deconstructing the Google Knowledge Graph Майка Бергмана - разбор Графа Знаний (на англ)

Как видим, страница поиска будет расширена добавлением блоков результатов по сущностям, выделенным из поискового запроса, из Википедии, Freebase, Factbook и еще нескольких источников.

Майк Бергман выделил пока только такой скудный список базовых сущностей (типов):

Entity types that I observed were in these categories:
  • People
  • Chemical Compounds
  • Directors
  • Some Companies
  • Some National Parks
  • Places
  • Musicians/Musical Groups
  • Actors
  • Some Government Agencies
  • Many Local Businesses
  • Animals
  • Movies
  • Albums
  • Notable Landmarks
  • Who Knows What Else

Entity types that I expected to see, but did not find include:
  • Products
  • Most Companies
  • Who Knows What Else
  • Songs
  • Most Government Agencies
  • Concepts
  • Non-government Organizations

Пока оценить такую страницу можно только пройдя по этой ссылке:

Полностью поддерживаю Майка Бергмана в его мнении:
Welcome to the semantic technology space, Google! I look forward to learning much from you.

Добро пожаловать, Гугл, в мир семантических технологий! С нетерпением жду, чтобы побольше изучить и узнать у тебя! :)

Ну и попроще объяснение про Google Knowledge Graph для бизнеса и SEO. (тоже англ)

Google Translate вам в помощь, guys! :)

Thursday, April 19, 2012

О социальных сетях



Интересные презентации о социальных сетях, их возможностях и предоставляемых данных. Полезно ознакомиться для Social Marketing #SEM #SMO #SMMAPI ВКонтакте, Одноклассники, Facebook
View more presentations from Mike Zimin





    Из последней презентации хочу выделить несколько слайдов:
Рейтинг популярности социальных сетей в поисковых системах
Рейтинг популярности социальных сетей в Google-ru

Рейтинг популярности социальных сетей в Yandex
Еще интересен график зависимости популярности социальных сетей от тематик. Его приводить не буду-сами посмотрите.

Ну и сами выводы докладчика:


А вот выводы ИМХО спорные :)
Абстрагировавшись от синтаксических ошибок, считаю, что:

  • - прокачанность аккаунта в Твиттере влияет на выдачу (поскольку твиттер-аккаунты тоже имеют свой PageRank и индексируются Гуглом)
  • - Гугл не любит ФБ больше всего :) - Гугл любит больше всего себя любимого. Ну, вынужден пока считаться с Твиттером и ФБ. Причем шансы на вылет у ФБ выше, Твиттер продержится дольше за счет легкости/мобильности/простоты/краткости и популярности.
  • - Напомню раскладку Google PageRank последнего апдейта: Твиттер, ФБ, Google+.

Twitter PageRank 10
Facebook PageRank 9
Google+ PageRank 8


 В любом случае, недооценивать соцсети уже нельзя.

Saturday, February 18, 2012

Поисковые системы кроме Гугл

Итак, поскольку времени на все не хватает, попалась замечательная ссылка, которая является далеко не самым лучшим переводом англоязычной статьи годовой давности под названием - "жизнь после гугл", где дается перечень новых поисковых систем (ПС), а также прикольная ссылка на определение семантического поиска, что таковым не является, а лишь есть мнение известной семантической ПС Hakia. Ну да ладно, текст статьи все равно для начала неплохо многим почитать, ну а по поводу семантического поиска, - выложу скоро, так и быть.
Итак, перепев "Жизнь после гугл-альтернативные ПС" (оригинал под тем же названием погуглите - найдете).

Соц сети
Компания IBM проанализировала все твиты для определения эмоциональной составляющей - выяснить где сердятся-радуются, согдасны-нет, критика и т.п. и передала все записи в библиотеку, кажется, Конгресса. Так что всех нас, твиттерян, проанализировали и записали :).

Системы поиска в реальном времени.
Два дня назад компания Microsoft представила новый сервис msnNOW, который собирает и анализирует данные из Facebook и Twitter (поиск осуществляет в режиме реального времени ПС Bing). 


Яндекс запустил поиск по Твиттеру - сервис микроблоггинга предоставляет поисковой системе полный доступ к данным (firehose) (читать подробнее).

Saturday, March 12, 2011

Topsy-Twitter search engine

Topsy - поисковая система по Twitter`у. В качестве результатов поиска выдает ранжированные результаты (ссылки), фотографии т твиты. Ранжирование производится по количеству и качеству ретвитов, которые получили эти ссылки.

Поисковая система  Topsy предоставляет API-доступ к результатам поиска, а также к данным типа "влиятельности" (авторитетности) автора и т.п. Доступ к API свободный, ограничение на пользование - 10 000 запросов в час. Правда при этом, из-за трудоемкости и затратности,  1 поисковая операция приравнивается к 10 запросам. Но и 1 тысяча поисковых запросов в час - тоже неплохо :). Есть возможность и коммерческого использования.


Поисковую систему Topsy относят к классу систем поиска в режиме реального времени, осуществляющих поиск по социальным медиа.


Topsy также предлагает:
  • - плагины для броузеров Firefox и Internet Explore, которые показывают самые последние и горячие новости-твиты
  • - виджет поиска, которые веб-разработчик может разместить на своем сайте. Вот такой примерчик поиска по запросу "semantic search engine". Можете протестировать и позадавать свои запросы.











Ссылки по теме:

Tuesday, March 1, 2011

Yandex APIs

Компания Яндекс также внесла свою лепту в пополнение каталога API, предоставив доступ к:

Yandex Blog Search API

Yandex is the largest search engine in Russia and develops a number of Internet-based services and products. Yandex offers owners of websites and blogs tools with which they can apply the functional services of Yandex in their projects. The site and documentation are in Russian.

The Blog Search API is a tool that lets integrate the Yandex Blog Search service on their site, whether it is a personal blog, forum or blogohosting. The API can index a personal blog or any blogs on any platform and perform a detailed search. It uses RESTful protocol and responses are formatted in XML or RSS.

Yandex Direct API

The Yandex Direct API allows developers to create applications which directly interact with the Yandex contextual advertising service. These applications allow advertising agencies as well as direct advertisers to run complex large-scaled advertising campaigns. It uses SOAP protocol and responses are formatted in JSON.


Yandex Fotok API

The Yandex Fotok API is a tool designed for allowing software and services to interact with the Yandeks.Fotkah photo service.Using the API Yandeks.Fotok users can develop a programs that can: upload photos to the service Yandex.Fotki, create and edit albums, move photos between albums, change the settings to access photos, notify on new photo and more. The API uses RESTful protocol and responses are formatted in XML and ATOM.


Yandex Maps API

The Yandex Maps API is a free tool that allows developers to embed maps on their website. Using the API users can manage cards and their contents, as well as create a variety of applications – from simple interactive directions to the office to advanced GIS services. The API uses both REST and JavaScript protocol and returns a map image based on specified parameters.




    

Google изменил алгоритм, а Yahoo провело исследование поиска

Google наконец изменил алгоритм ранжирования сайтов, чтобы избавиться от спама и дубликатов.

Источник новости: www.searchengines.ru

Yahoo провела «трехмерное» исследование поиска - «кто ищет», «что ищет» и «как ищет». Работа исследователей была представлена на конференции WSDM в Гонконге.

Измерения определялись при помощи демографических данных: пола, возраста, дохода и уровня образования, совокупности различных запросов, которые были привязаны к тематикам и географическим регионам. Вопрос «как» искали пользователи, изучался при помощи таких показателей как длина сессии и число запросов за сессию.

Ознакомиться с частью исследований можно при помощи сервиса Yahoo! Clues. Там показываются самые популярные текущие запросы, связанные запросы, и статистика по демографическим данным. Полные данные исследования доступны по ссылке research.yahoo.com (pdf) .

Источник новости: www.searchengines.ru

    

Friday, January 28, 2011

fQwiki - Open Source QWiki clone

Весь интернет шумит от суммы, выделенной на новый проект поисковой вики-системы QWiki - 8 миллионов долларов.(Подробнее про новую поисковую систему Qwiki)

И нашелся один умелец, который за 6 часов написал 321 строчку html-кода (+ javascript), без серверной части!, которая в общих чертах повторяет систему QWiki. Т.е. клон fQWiki представляет собой ОДНУ html-страницу, использует AJAX и прочие возможности web 2.0 - библиотеку JQuery, Google API`s, API поиска в англоязычной версии википедии, и возможности Semantic Web - обращение к dbpedia, выполнение SPARQL-запросов. Система fQWiki , в отличие от монстра QWiki - бесплатна, имеет открытый код (Open Source) и не претендует на миллиардные вложения :).

Рекомендую посмотреть код - очень красивое решение.

Ознакомиться с fQWiki (и взять с разрешения автора код) можно на странице проекта fQWiki. :)

Надо признать, что fQWiki предоставляет более подробную информацию, чем QWiki :)

Источники новости: businessinsider.com, newsgrange.com engl.

    

Thursday, January 27, 2011

semantic search from qwiki

(Подробнее про новую поисковую систему Qwiki)
Итак, система Qwiki открыла доступ. Пример поиска по запросу "Semantic Web".





Красиво...

Запрос: "weather in Ukraine" - We`re sorry...

Запрос "Ukraine" тоже выглядит красиво:





(Читать подробнее про новую поисковую систему Qwiki)


    

Friday, January 21, 2011

QWiki на TechCrunch Disrupt 2010

В сентябре 2010 года в Сан-Франциско прошло мероприятие TechCrunch Disrupt , которое представляет новые инновационные интернет-компании и их проекты.

Одним из номинантов конкурса стал проект QWiki.

QWiki - платформа, которая аккумулирует разные типы контента и позволяет воспроизводство его на разных устройствах.

Как утверждает докладчик, данная система работает со знаниями. (- !?)
Разработчики выделяют 3 ключевые особенности системы:
  • 1. В QWiki контент генерируется полностью автоматически без участия человека.
  • 2. Контент, воспроизводимый системой полностью озвученый, т.о. полностью обработанный, логически связанный и сгенерированный.
  • 3. Контент полностью интерактивный.

Хочу поставить ударение на том, что в оригинале докладчик вместо слова контент употребляет термин знания, что на мой взгляд терминологически не верно. Это всего лишь контент, поэтому буду употреблять именно этот термин.

Создатели системы утверждают о том, что это "семантическое приложение", и сравнивают его с поисковой системой Google, поскольку QWiki - это прежде всего поисковая система, которая автоматически создает видео-сюжеты (видео-статьи) "на лету" на основании результатов поиска. При этом это вики-система, т.е. она направлена на предоставление справочной (фактографической) информации - о людях, странах, городах, искусстве, популярных темах, погодных данных, мероприятиях, картах и т.п. Предполагается, что система может выдавать и заданные персональные данные пользователя, напр. напоминалка по календарю персональных событий и т.п.
Вся информация выдается приятным женским голосом и сопровождается видео-фрагментами.

Система в качестве исходной информации использует открытые источники, такие как фотографии из Flickr, блоги, твиты, и т.п., и, на основании обработанной информации из Википедии, генерирует видео и аудио- "сюжет".

Уникальность системы, по заявлениям авторов, в полной автоматизации процесса. (Прим. автора. Стоит все-таки не забывать, что контент википедии создают люди, и он иногда бывает не совсем правильным).

Следующий естественный шаг в эволюции Интернета - использование социального свободного контента блогов, фотографий, видео и т.п. для сбора, анализа, переработки и генерации новой (точнее - по-новому представленной) информации.

Система пока представлена альфа-версией.

В общих чертах ознакомиться с проектом можно из видео (англ.)











Подробнее о проекте можно узнать на сайте проекта qwiki.com

По материалам: Social Media Takes Time Off For A Qwiki!(англ)

ИМХО - авторы системы достаточно амбициозны, однако, не за горами ответный ход главного игрока - поисковика Google.
Делая упор на видео и аудио информацию, система становится более "тяжелой", что не всем и не всегда подходит.
Откидывать "обычный" текстовый поиск не стоит. Также нельзя не учитывать объемы необходимых вычислений и обрабатываемых данных, да и саму сложность задачи, на которую замахнулись авторы.
Тут можно вспомнить опыт предыдущего амбициозного "убийцы" Гугла - PowerSet - где он сейчас?? И что они смогли сделать?...


Добавлено 24-01-2011
Первое знакомство с QWiki (Alpha-версия) создает впечатление работы c интерактивной мультимедийной вики-системой. Система поддерживает только английский язык и имеет довольно маленькую базу. Ориентирована на визуальную и аудио- подачу энциклопедической информации общего характера в сжатой форме. На мой взгляд, очень подходит для эффектной подачи информации детям (моему сыну понравилось очень - просто, доходчиво и круто! :)), т.е. система может стать хорошей платформой для обучающей системы.

По мнению англоязычных коллег - система дает очень поверхностные знания...

...it is slick and superficial and dumbs people down. Sure, Qwiki may wind up being “successful”, but then lots of things are successful (take McDonald’s, but that doesn’t mean that 4000-calorie supersized meals are good for society).
http://thenextweb.com/microsoft/2010/10/02/qwiki-will-succeed-because-microsoft-will-buy-it/

Технического описания и научного базиса, к сожалению пока не нашла. Если кто-нибудь имеет подобную информацию, оставьте, плз, в комментах.

Посмотреть пример запроса "Semantic Web".




    

Tuesday, November 23, 2010

Новый релиз Mathematica 8 и Wolfram Alpha

Технологии Wolphram Alpha стали частью математической программы

2010-11-19 19:21
Создатели поисковика Wolphram Alpha - Wolfram Research выпустили новый проект Mathematica 8, объединивший возможности распознавания запросов на «человеческом» языке с возможностями математического программного обеспечения.

Mathematica, частично основанная на технологиях поисковой системы Wolphram Alpha, может обрабатывать массивы данных и строить по ним графики, используя мощности и интерфейс графических процессоров Nvidia CUDA или OpenCL, разработанный Apple и Khronos Group.
Лингвистическая часть системы может распознавать некоторые простые команды и переводить их в язык запросов. К примеру, Mathematica понимает команду «пи 200 знаков» ("pi 200 digits") и автоматически переформулирует ее в выражение "N[Pi, 200]."

Mathematica позиционируется как программное обеспечение для студентов и ученых. Областями применения являются различные отрасли математики, инжиниринга и прикладных вычислений – статистика и вероятности, обработка изображений, теория групп, гармонический анализ и подсчет финансовых производных.

Источник (рус): searchengines.ru

По материалам CNet News
Читать больше про Wolfram Alpha

Для релакса:
Он-лайн игры
Шарики, бродилки, стрелялки, бегалки
Куча приколов

Friday, October 8, 2010

Wolfram Alpha mobile

Wolfram Alpha представил версию поиска для Android

2010-10-08 13:56
Wolfram Alpha развивает мобильное направление поиска. В качестве нового шага на пути освоения мобильного пространства, создатели поисковой системы представили приложение для операционной системы Android.
По словам разработчиков, Wolfram Alpha для мобильного имеет такую же способность к извлечению данных, что и полная версия для PC, а также обладает полным доступом к базе, состоящей из «10 триллионов элементов данных» и включающей «десятки тысяч» моделей вычисления.
Приложение поддерживает как текстовый, так и голосовой ввод. Областями поиска, в которых система себя зарекомендовала наилучшим образом, являются математика, прикладные науки, инженерия и спорт. Приложение стоимостью $1.99 работает только на Android OS 1.6 и выше.
Цена приложения для Android во много раз ниже цены программы для Apple App Store, которая появилась в прошлом году. Тогда стартовая цена поисковой программы равнялась $49.99. Низкие продажи заставили компанию пересмотреть ценовую политику и снизить стоимость установки почти в 25 раз.
По материалам Wolfram Alpha Blog
Источник: www.searchengines.ru (русск.)

Читать подробнее про поисковик Wolfram Alpha и Стивена Вольфрама

Thursday, September 2, 2010

Тестируем Swingly - систему поиска фактов

Итак, про систему Swingly было уже написано ранее .
Это новая самообучающаяся система поиска фактов.
Наконец пришло разрешение на бета-тестирование системы.

Задем вопрос "What is the future of Internet?"
Результат получился ошеломляющий. Система выдала около двадцати результатов, а также определение, что такое интернет:

Internet is a(n) academic discipline, computer network, digital medium, discipline, mass medium, system, telecommunication, topic, wide area network
Также очень толковое разъяснение:
The Internet is a global network of interconnected computers, enabling users to share information along multiple channels. Typically, a computer that connects to the Internet can access information from a vast array of available servers and other computers by moving information from them to the computer's local memory. The same connection allows that computer to send information to servers on the network; that information is in turn accessed and potentially modified by a variety of other interconnected computers.

Ну и результаты (можете оценить сами):

1 answer from top search results.



  • communication, transactions and entertainment
    See how communication, transactions and entertainment might develop in the future of the Internet.



1 answer from web data.



  • NWE Wireless
    NWE Wireless is the future of high-speed Internet access.



    http://www.nwewn.com • Apr 30, 2009 • Report
1 answer from web data.




  • "We think the future of the Internet is about people, not technology, and knowing who has clout," Assayag said.



2 answers from web data.




  • "The future of the Internet as we know it depends on maintaining freedom and openness online," said Ben Scott, policy director of Free Press.







  • "This is a pivotal moment for the future of the Internet," said Ben Scott, policy director at Free Press, on a conference call today.



1 answer from web data.



  • Bob Taylor
    Looking forward, Bob Taylor in 2000, voiced two concerns about the future of the Internet: control and access.



1 answer from web data.




  • When the 2003 summit failed to agree on the future of Internet governance, the Working Group on Internet Governance (WGIG) was formed to come up with ideas on how to progress.



1 answer from web data.



  • two concerns
    Looking forward, Bob Taylor in 2000, voiced two concerns about the future of the Internet: control and access.



1 answer from web data.



  • video content
    Although video content is lauded and championed as the future of the internet, there is still a lot of dissension over whether it has a place in corporate blogging.



1 answer from top search results.



  • ongoing
    The future of the Internet communications revolution is ongoing, now uniting communities as it recently united networks.



1 answer from web data.



  • Seth Finkelstein's answers
    Seth Finkelstein has posted his answers to a Pew survey on the future of the Internet, and Google making us stupid (or not) in a thought provoking yet grounded (which is rare on the Web-admit it!) post.



    http://paradox1x.org • Apr 30, 2009 • Report
1 answer from web data.




  • On the matter of greater moment--Will the ax fall on Scrabulous--Jonathan Zittrain at The Future of the Internet answers his own question in the affirmative based on the name alone, opining that by calling it "rainbows and buttercups” instead of “Scrabulous” there’d be little claim of brand confusion but noting the "residual claim that the Scrabulous game board infringes the copyright held in the Scrabble game board."



1 answer from web data.



  • the term and shown activities such as publishing recommendations
    The OECD has picked up the term and shown activities such as publishing recommendations for the future of the Internet economy, for example (see the activities section).



1 answer from web data.




  • Professor Zittrain sees the rise of the relatively “tethered appliances” (e.g. iPhones, TiVos, and XBoxes) as the future of the Internet, promoted by companies and adopted by consumers because, when connected to the cloud, they seem to offer security, economies of scale or increased reliability.



1 answer from web data.



  • Google's Marissa Mayer
    Google's Marissa Mayer has unparalleled insights into the future of internet search engines.



1 answer from web data.



  • Social changes
    Social changes brought about by the Internet, & future of computing & Information Technology



1 answer from web data.



  • IPv6
    With the Asia-Pacific Network Information Centre's Geoff Huston stating that IPv4 addresses will be exhausted prior to October 2010, IPv6 is becoming increasingly important in the future of Australian Internet connectivity.



1 answer from web data.



  • Doug Gramling's three children
    Pastor Doug Gramling said his three children are part of the Internet generation that will eventually decide the future of worship.



1 answer from web data.




  • This question is part of an interview on the subject Shopping And Business On The Internet



1 answer from web data.




  • “The broadband quality study shows us which countries have made real moves towards the internet of the future," said Maria Rosalia Vicente, a professor at the University of Oviedo, in a statement.



2 answers from web data.



  • .mf
    .mf is a future Internet country code top-level domain (ccTLD) that is likely to be created for Saint Martin , following the decision on September 21, 2007 by the ISO 3166 Maintenance Agency to allocate MF as the ISO 3166-1 alpha-2 code for Saint Martin .






  • .bl
    .bl is a future Internet country code top-level domain (ccTLD) that is likely to be created for Saint Barthélemy , following the decision on 21 September 2007 by the ISO 3166 Maintenance Agency to allocate BL as the ISO 3166-1 alpha-2 code for Saint Barthélemy .



1 answer from web data.




  • No Answer



1 answer from web data.




  • No Answer



1 answer from web data.
1 answer from web data.




  • No Answer



1 answer from web data.
1 answer from web data.
2 answers from web data.




  • Google CEO Eric Schmidt made some kind of statements to the Financial Times about the future power of the Internet to be a BS detector when it comes to politicians’ statements.







  • Google CEO Eric Schmidt made some kind of statements to the Financial Times about the future power of the Internet to be a BS detector when it comes to politicians’ statements.



1 answer from web data.



  • from its early days
    This course will introduce the history and development of the genre from its early days in pulp magazines to its future on the internet.



1 answer from web data.




  • John Piper’s book, The Future of Justification, has prompted several discussions on the internet in regard to his critique of N. T. Wright.



1 answer from web data.



  • TV
    The advent of cable TV, DVR & Tivo, and the Internet has drastically changed the television landscape today, and will continue to change TV in the future.



    http://knowmoremedia.com/ • Apr 30, 2009 • Report
1 answer from web data.



  • at 1:00pm
    The special session, "Is An Open Platform the Future of the Mobile Internet?" follows immediately at 1:00pm in the same room.



1 answer from web data.



  • WiMax technology
    In short, WiMax technology promises a future of more powerful and more accessible wireless Internet access.



1 answer from web data.



  • with the United States
    BRUSSELS, Belgium-The European Union insisted Friday that governments and the private sector must share the responsibility of overseeing the Internet, setting the stage for a showdown with the United States on the future of Internet governance.



More
Результаты можно откорректировать, указать свое согласие.
 Результат меня довольно приятно удивил - мнения многих специалистов про направления развития интернета, информация свежая.

На запрос "How many documents are in the Internet?" я получила забавные ответы:
Во-первых, система сообщила в резюме, что список ответов скорее всего не соответствует моему запросу. Опять таки, в качестве информации, было дано определение и разъяснение, что такое интернет. А среди ответов были и просто перлы типа "The internet is shit.", но несколько ответов все-таки по теме, хотя и без указания конкретного числа: "But the internet is pretty big...", "The Internet is huge...".

Мне система понравилась. В отличие от других монстров типа Wolfram Alpha и других, претендующих на роль Google Killer App, эта система хотя бы частично смогла ответить на мои вопросы.


 

Популярное

Использование материалов сайта

Информация, представленная на сайте, может свободно использоваться и распространяться при обязательном указании активной прямой ссылки на сайт http://in-search-of-semantics.blogspot.com/, а тексты научных статей – при указании авторства и ссылки на бумажную публикацию.

При размещении текстов статей на своих сайтах, блогах и пр., пожалуйста, присылайте ссылки.
Комментарии перед публикацией предварительно модерируются.

Хотите сказать спасибо автору? Не откажусь :) - Поставьте ретвит на пост, или другую социальную закладку. Спасибо.