Scaling Up Reasoning Patterns and Interaction Turns for Visual Search
Junyi Li
ProvenceStar
AI & ML interests
Multimodal Model, Reinforcement Learning
Recent Activity
upvoted a paper about 15 hours ago
Beyond Data Scaling: Representation-Centric Continued Pre-training for Vision-Language-Action Models upvoted a paper 5 days ago
StreamPI: Streaming Multimodal Temporal Modeling for Vision-Language-Action Models upvoted a paper 7 days ago
GameXpert-Bench: How Far Are Coding Agents from Expert Game Development?Organizations
None yet