A Conceptual Framework for High-Level Vision

Bernd Neumann · 2003

In diesem Bericht stellen wir die wesentlichen Bestandteile eines konzeptuellen Rahmens fur Hohere Bilddeutung vor. Hohere Bilddeutung umfast definitionsgemas alle Aufgaben der Szeneninterpretation oberhalb von Objekterkennung, also z.B. das Erkennen von Objektkonfigurationen, Vorgangen und absichtsvollen Handlungen. Die Modelle, auf die sich solche Interpretationen stutzen, beschreiben im allgemeinen Aggregate aus bedeutungstragenden Teilen, die in zeitlichen sowie raumlichen Beziehungen zueinander stehen. Als Reprasen­ tationsform werden Frames vorgeschlagen, ahnlich den Aggregatebeschreibungen aus der Konfigurierungstechnologie. Der Interpretationsprozess basiert auf dem Paradigma des Hypothetisieren-­un-d­Testens und wird am Beispiel einer Tischdeckszene erlautert. Hypothesenbildung erfolgt im wesentlichen durch Teil-­Ganzes-­Schliesen. Zur Evaluierung qualitativer zeitlicher Beschrankungen wird ein zeitliches Beschrankungsnetz vorgeschlagen. Ein ahnlicher Ansatz wird fur raumliche Beschrankungen skizziert, die in Form von Gitterbereichen in objektbezogenen Referenzsystemen reprasentiert werden. (HLV). The scope of HLV is defined as scene interpretation above the level of object recognition. It is shown that models, on which such interpretations can be based, typically describe aggregates composed of meaningful parts, related to each other by temporal and spatial constraints. A frame-based representation is proposed which is based on techniques imported from configuration methodology. The hypothesise-and-test interpretation process is described for a table-laying example. It is shown that expectations are generated by partwhole reasoning. A temporal constraint net is proposed for the incremental evaluation of qualitative temporal constraints. A similar approach is sketched for spatial constraints which are represented by grid locations in a reference frame attached to an object.

Read the paper · More papers on PaperTik