ТранспортМодаРецептыБлогиОхотаПутешествияСпортВесельеСвоими РукамиITЗнания
Мини-Игры
x

x
zakruti.com » ru » Знания, наука, образование » ПостНаука
Инвертированный индекс в информационном поиске - Станислав Протасов

Инвертированный индекс в информационном поиске - Станислав Протасов

VKTwitterOK

содержание видео

Рейтинг: 4.0; Голоса: 1
Станислав Протасов о задачах информационного поиска и о том, какие методы позволяют делать это быстрее и эффективнее. Решить задачу информационного поиска - это значит найти не реальные объекты, а объекты в некоторой информационной системе: страницы в интернете, записи в базе данных или файлы на компьютере
Дата: 2022-05-15

Комментарии и отзывы: 4


Материал, с моей точки зрения, требует существенного дополнения, которое сильно меняет восприятие сказанного.
Алгоритмы, подобные описанным, Станиславом, эффективны только в строго детерминированных условиях, где решающим условием является степень доверенности данным подаваемым на вход.
То есть подобные автоматы лишены любой машинерии, которая бы дифференцировала входящий поток на тот, который отвечает условиям эффективной работы автомата и тех которые принимать к обработке нельзя.
И что хуже всего, уровень предсказательной силы любой гипотезы, направленной на построения такой структуры данных, которая бы заставляла подобный автомат выдавать требуемый положительный результат, стремится к единице.
Говоря бытовым языком, эффективность работы автомата обратно пропорциональна вероятности существования условий при которых манипулирование результатами работы автомата, было бы выгодно.
Что в нашей с вами реальности, где поисковые машины неразрывно связаны с значимым оборотом тех или иных ресурсов - является нормой а не исключением.
Более того, подобные автоматы крайне легко поддаются реверсу. То есть нет особых сложностей в реконструкции алгоритма работы автомата, в условиях когда перед инженером есть только статистика его работы.
Как следствие, подобные автоматы требуют независимый слой логики, цель которой, детектирование естественности входящих данных, что фактически приравнивается к решению исходной задачи, но иными средствами. Что в свою очередь делает бесполезным существования начального автомата, так как он становится дублирующей сущностью.
-Итого-
То есть с обще познавательной точки зрения, это все безусловно интересно, и крайней степени полезно. Однако я бы не стал на месте Станислава, без оговорок, утверждать что именно так работают Яндекс FaceBook и так далее. Так как, вероятно не требует доказательств тот факт, что они существуют в условиях крайне агрессивной среды.

ответить

Мам мыл рам - не уменьшит а увеличит базу - будет паразитное рытье однокоренных.
В первой части - очень бестолковое обьяснение про вторичный ключ. По первому слову мы сокоащаем бащу, по каждому следующему сокращаем. Обяснено без шагов и этапов.
Нифига про индексацию как инструмент ускорения поиска.
Не смотрите - двоишник. Во всяком случае в голове не структурировано и лектор плохой.

ответить

Спасибо. Размял мозги. В своё время, в молодости, занимался квантитативной лингвистикой, но до такого, естественно, не доходил. Да и не нужно было - объёмы другие.
ответить

Объясните кто нибудь пожалуйста, нужна ли физика программисту. Я люблю программировать но с физикой я вообще не дружу. как быть
ответить
Добавить отзыв, комментарий






Другие видео канала