Extremely Fast and Accurate Transcription with Granite Speech 5.0 Turbo CTC ibm-granite • 2 days ago • 26
TransVLM: Detecting Any Shot Transition with Vision-Language Models HeyGenAI • about 16 hours ago • 4
FLUX 3 Model Overview: Multimodal Flow Models for Image, Video, Audio, and Action Prediction ResterChed • Jul 24 • 22
Exploring NVIDIA Nemotron 3.5 Lightning: Making it see with little resources tngtech • 16 days ago • 17
DAVIDAU DELETED MY POST AND BANNED ME FOR ASKING ABOUT BENCHMARKS — HERE IS THE FULL ANALYSIS (9B + 27B + 390 MODELS) DedeProGames • 16 days ago • 15
mLateOn: A New SoTA for Multilingual ColBERT-Style Retrieval, Evaluated on HAKARI-Bench hotchpotch • 15 days ago • 8
Extremely Fast and Accurate Transcription with Granite Speech 5.0 Turbo CTC ibm-granite • 2 days ago • 26
TransVLM: Detecting Any Shot Transition with Vision-Language Models HeyGenAI • about 16 hours ago • 4
FLUX 3 Model Overview: Multimodal Flow Models for Image, Video, Audio, and Action Prediction ResterChed • Jul 24 • 22
Exploring NVIDIA Nemotron 3.5 Lightning: Making it see with little resources tngtech • 16 days ago • 17
DAVIDAU DELETED MY POST AND BANNED ME FOR ASKING ABOUT BENCHMARKS — HERE IS THE FULL ANALYSIS (9B + 27B + 390 MODELS) DedeProGames • 16 days ago • 15
mLateOn: A New SoTA for Multilingual ColBERT-Style Retrieval, Evaluated on HAKARI-Bench hotchpotch • 15 days ago • 8