Evaluation-Verification Reward for Consistent Multi-Reference Image Editing Paper • 2607.29025 • Published 5 days ago • 14
ExtractBench: A Benchmark for Schema-Guided Enterprise Document Extraction Paper • 2607.29677 • Published 5 days ago • 17
Meshy T2: Fast Native Mesh Generation with Flow Matching Paper • 2607.28675 • Published 8 days ago • 47
VideoCoCo: Code-as-CoT for Physically-Consistent Video Generation via an Agentic Dual-Engine System Paper • 2607.27380 • Published 7 days ago • 70
ReToken: One Token to Improve Vision-Language Models for Visual Retrieval Paper • 2607.28627 • Published 6 days ago • 8
Chimera: Designing and Chinchilla-Scaling Hybrid Visual Diffusion Transformers Paper • 2607.28611 • Published 6 days ago • 19
VideoCoCo: Code-as-CoT for Physically-Consistent Video Generation via an Agentic Dual-Engine System Paper • 2607.27380 • Published 7 days ago • 70
ACE-Data-0: Human-Centric Ambient Capture as Embodied Data Engine Paper • 2607.28625 • Published 6 days ago • 41
PhiZero: A World Model Built Around Physical Language Paper • 2607.28624 • Published 6 days ago • 165
OmegaUse-OfficeVal: Benchmarking LLM Agents on Long-Horizon Office-Suite Tasks with Economic Grounding Paper • 2607.27155 • Published 7 days ago • 12
Can AI agents conduct open-ended AI research? Early evidence from two case studies Paper • 2607.27191 • Published 7 days ago • 18
PerceptionBench: Evaluating Atomic Visual Perception in Multimodal Large Language Models Paper • 2607.24957 • Published 9 days ago • 18
OmniDelta: Skill-Driven Budget Allocation for Token Compression in OmniLLMs Paper • 2607.25669 • Published 8 days ago • 9
view post Post 3977 who's working on an NVFP4 version of Kimi-K3? See translation 4 replies · 🤗 9 9 👍 6 6 🚀 4 4 🔥 4 4 😔 1 1 + Reply