CaptionForge creates stronger local dataset captions by combining multiple image-caption witnesses, distilling their agreements and contradictions, validating the result with a VLM, and exporting auditable LoRA-ready captions.
image-captioning lora captioning-images captioning audit-trail jsonl dataset-preparation comfyui local-ai lora-training ollama qwen vision-language-models multimodal-ai joy-caption joycaption qwen2-5 comfyui-custom-nodes dataset-captions vlm-validation
-
Updated
Jun 21, 2026 - Python