We can also run it using an OpenAI-compatible API like Ollama.
from docling.datamodel.pipeline_options import PictureDescriptionApiOptions
url="http://localhost:11434/v1/chat/completions"
"model": "granite3.2-vision:2b"
AI text/layout recreation from video frame; verify against source image.