Без заголовка
Нет задачи передавать фотографические картинки 1:1 каждый кадр, ибо смотрит не машина. Мозгам в видео нужно много меньше информации. Поэтому кодировать нужно ближе к тому, что раскодируют из видео мозги. А мозги видят прежде всего контуры. Их и нужно кодировать точно, а остальное -- пятнами.