Seminar on Internet Technologies (Summer 2026): Difference between revisions
| Line 84: | Line 84: | ||
| Large Language Model & multimodal setting | | Large Language Model & multimodal setting | ||
| [Wenfang Wu, wenfang.wu@cs.uni-goettingen.de] | | [Wenfang Wu, wenfang.wu@cs.uni-goettingen.de] | ||
| | |||
| Yes | |||
|- | |||
|- | |||
| Long-Video Understanding and Video Question Answering | |||
| In this topic, you will study methods for understanding long videos and for answering questions based on video content. This includes long-range temporal modeling, multimodal video understanding, and question answering over complex video sequences. | |||
| Vision-language models & Large language model | |||
| [Haihan Zhang, haihan.zhang@cs.uni-goettingen.de] | |||
| | | | ||
| Yes | | Yes | ||