Explores semi-structured data, embedding schema information to explain data values and relationships, discussing XML, schema-less data benefits, and serialization.
Introduces the basics of information retrieval, covering text-based retrieval, document features, similarity functions, and the difference between Boolean and ranked retrieval.