SOTA Papers
LatestTrendingDigestSearch
Newsletter
  1. Home
  2. Chenyang Gu

Chenyang Gu

1 article on SOTA Papers

Computer Science

Verifiable Rewards Improve Native Visual Reasoning Training

A 300-task procedural suite replaces preference-only judging with task-specific scorers, raising matched reinforcement-learning performance from 0.509 to 0.548.

cs.AIcs.LGcs.MM
Sep 4, 20264 min2608.26105

Co-authors

Junxiang XuRuisi WangFanyi PuMaijunxian WangRan JiTongxi ZhouJing ZuoHongcan XiaoYimeng GengWanqi YinWei ChenOscar QianZhengan YanZiqi HuangHaiwen DiaoLiang PanBo LiXiangyu FanDezhi LuoFengyuan YuZehong ZhaoQingying GaoTinghui ZhuYilan ZhangJingqi TongPinyuan FengZhengze JiangLetian WangZiyu GuoRenrui ZhangJieneng ChenSonia JosephConstantin VenhoffSaman MotamedMengyue YangChandra SripadaAlan YuillePhilip TorrLvmin ZhangVikash KumarDaniel KhashabiNikolaus KriegeskorteRapha\"el Milli\`ereVincent C. M\"ullerAnyi RaoQuan WangZiwei LiuDahua LinLei YangHokin DengZhongang Cai
SOTA Papers

Curated editorial synthesis of meaningful arXiv papers. No slop, no overclaiming.

Fields

  • Computer Science
  • Physics
  • Mathematics
  • Economics
  • Electrical Engineering

Navigation

  • Latest
  • Trending
  • Weekly Digest
  • Search
  • Contact

Legal

  • Terms of Service
  • Privacy Policy

© 2026 SOTA Papers. All rights reserved.

Data sourced from arXiv.org