Фреймы для представления знаний (Марвин Минский) Страница 3 - Литвек

характера, но не обусловленные какими-либо этическими или эстетическими принципами...».

И. Берлин (1953)

Когда мы входим в комнату, нам кажется, что мы видим всю возникающую перед глазами картину с одного взгляда. В действительности же зрительное восприятие — это длительный процесс. На все требуется время: и на то, чтобы рассмотреть детали и собрать о них нужную информацию, и на то, чтобы, сделав предположения, проверить их и прийти к определенным заключениям, и на то, чтобы оценить полученные данные с учетом преследуемых целей, собственных знаний и ожиданий. Тем не менее, все это происходит настолько быстро и естественно, что невольно вызывает удивление и требует объяснений.

Некоторые специалисты считают неудовлетворительными те теории, в которых делается попытка трактовать феномен зрительного восприятия с позиции дискретных, последовательных, символьных процессов. Им кажется, что хотя машинные программы, написанные на основе этих теорий, действительно могут демонстрировать эффект «видения», для живых существ они неприемлемы ввиду грубости восприятия и малого быстродействия. Однако обычно предлагаемая альтернатива, относящаяся к крайнему случаю холизма или идеалистической «философии целостности» (см. В.Г.Афанасьев, 1964), не может быть технически реализована. Ниже я приведу доводы в пользу того, что следующие один за другим символьные процессы могут объяснить суть явлений, которые нам кажутся мгновенными и завершенными и которые имеют место при анализе сцен.

Часть теоретиков, придерживающихся ранних гештальт-психологических концепций (подробнее см. М.Г.Ярошевский, 1976), стремилась объяснить феномен зрительного восприятия с помощью имеющегося в человеческом мозге электрического поля, но уже в 30-х годах нашего столетия стала ясна несостоятельность подобных воззрений. Их современные последователи, включая приверженцев идеи интегральных преобразований, использования голограмм и интерферентных явлений, достигнуть многого также не сумели. И все же, несмотря на эти неудачи, большинство специалистов по-прежнему полагает, будто требуемая скорость восприятия может быть обеспечена только посредством некоторого глобального параллельного процесса, подобного волновому.

Излагаемая в настоящей работе теория фреймов рассматривает все основные вопросы, поднятые гештальт-психологами. Общим для обоих подходов является стремление раскрыть суть процессов, лежащих в основе соотнесения сенсорных данных либо с общими понятиями, либо с их частями, но методы, предложенные для обоснования выдвинутых положений, в корне отличны друг от друга. Гештальт-психологи стремились доказать, что эти процессы основаны главным образом на взаимодействии небольшого числа универсальных и весьма эффективных процедур, но неудачи с их эффективным выделением показали ограниченность этой идеи. В теории фреймов упор делается на многочисленность взаимодействий между сенсорными данными и образованной в процессе обучения громадной сетью символьной информации. И хотя эти взаимодействия должны, в конечном счете, основываться на том или ином наборе общих принципов, в нашей теории изучение мыслительных процессов отделено от вопросов происхождения и развития систем ИИ.

1.2. Параллелизм

Может ли оказаться полезной параллельная обработка информации? Вопрос этот следует считать чисто техническим в большей степени, чем может показаться на первый взгляд. Действительно, на уровне выявления простейших визуальных черт, текстурных элементов, характерных особенностей при стереоскопическом зрении или двигательном параллаксе использование параллельной обработки информации следует считать целесообразным. На следующем, «предметном» уровне труднее представить себе, каким образом можно использовать параллелизм, хотя в этой связи следует отметить работы А.Гузмана(1969) по выделению «ядер» и объединению их в связанные области или Д.Вальтца(1972) по использованию семантических корней для отсортировки теневых линий, выполняемой на специальной параллельной сети.

Однако на более высоких уровнях мыслительной деятельности целесообразность применения параллелизма встречает ряд принципиальных возражений. В работах по распознаванию образов было предложено довольно много схем для выполнения параллельных операций — персептроны, интегральные преобразования и т.д. Эти схемы, интересные и с математической, и с вычислительной точек зрения, видимо, могли бы служить в качестве составных частей теории обработки сенсорной информации, но не более того. Интегральные методы хороши, главным образом, для работы с изолированными двухмерными изображениями, но на их основе нельзя решить задачу выделения и распознавания объектов в сложных трехмерных сценах. Почему?

При анализе сложных сцен должны быть правильно выделены области, принадлежащие различным объектам, ибо только в этом случае воспринимаемая картина обретает смысл; однако для решения этой задачи, которая эквивалентна традиционной в гештальт-психологии проблеме «объект — фон», требуется так много усилий, что, как отмечалось в работе М.Минского и С.Пейперта(1969), сама возможность и даже целесообразность разработки методики изолированного распознавания ставится под сомнение. Для трехмерных изображений эта проблема еще более осложняется как искажением перспективы, так и тем обстоятельством, что отдельные части предметов оказываются невидимыми из-за других объектов.

В новых знаковых теориях используются методы выработки гипотез с последующим их подтверждением; эти методы кажутся нам более продуктивными. Трудно решить любую по-настоящему сложную проблему, не уделив самого пристального внимания ее отдельным составным частям. К счастью, однако, можно представить себе более эффективный (по сравнению с просто идеей параллелизма) последовательный процесс, при котором крупные, сложные знаковые структуры рассматриваются в качестве простейших операндов. Это открывает теоретически новую возможность для быстрого поиска крупных субструктур и, по-видимому, позволит найти секрет быстродействия механизмов человеческого мышления и восприятия зрительной информации.

1.3. Искусственный интеллект и процессы решения задач человеком

В настоящей работе не проводится границы между теорией человеческого мышления и теорией построения «думающих» машин: разделять их в данный момент не имеет смысла, поскольку как в той, так и в другой области знаний отсутствуют концепции, достаточно общие для объяснения и тем более для моделирования