←Back to NewsAI News/ImagemodelImageOpen SourceJev-Omni Scores Decisions Across Text, Images, Audio, and Video in MillisecondsA 12B multimodal classifier fine-tuned from Gemma 4 that returns calibrated probabilities across text, image, audio and video inputs.SourceAlphaSignalPublishedSep 29, 2026, 12:57 AMAuthorAlphaSignal NewsroomRead1 min readA 12B multimodal classifier fine-tuned from Gemma 4 that returns calibrated probabilities across text, image, audio and video inputs.Reporting is indexed from AlphaSignal. Rights remain with the original publisher and cited sources.Read original report ↗Next readsAlphaSignal · modelTeleOCR Beats Gemini and GPT-5.2 at Document Parsing With 1.2B ParametersAlphaSignal · modelStarDoc-AI's TeleOCR Beats Gemini 3 Pro at Document Parsing With 1.2B ParametersAlphaSignal · modelEfficientNet-B0 RA Hits 800K Downloads as Developers Chase Tiny 5M Models