Podcast Episodes

Back to Search
Rethinking Cross-Tokenizer On-Policy Distillation: From Alignment Coverage to Supervision Reliability

Episode 2347

🤗 Upvotes: 77 | cs.CL, cs.AI

Authors:
Bingxi Hou, Guochao Jiang, Guofeng Quan, Weiqing Li, Wenfeng Feng, Guohua …

2 days, 5 hours ago

Short Long
View Episode
DuoMatching: Joint-Marginal Distribution Matching for Few-Step Video Generation

Episode 2346

🤗 Upvotes: 52 | cs.CV

Authors:
Jiahao Zhan, Yan Wang, Yongrui Ma, Qunliang Xing, Ruchang Yao, Runtao Liu, Shijie…

2 days, 5 hours ago

Short Long
View Episode
TRACE: Rollout-Guided Quantization-Aware Training for FP4 Reinforcement Learning of MoE Language Models

Episode 2345

🤗 Upvotes: 33 | cs.LG, cs.CL

Authors:
Xin Wang, Hao Yu, Zhengyang Zhuge, Bochao Mao, Zheng Li, Junda Feng, Yuyan…

2 days, 5 hours ago

Short Long
View Episode
EVISKILL: Grounding Skill Evolution in Replayable Evidence

Episode 2344

🤗 Upvotes: 30 | cs.AI

Authors:
Yan Zhou, Yili Wang, Yiwei Dai, Qinggang Zhang, Xin Wang

Title:
…

2 days, 5 hours ago

Short Long
View Episode
From Evidence to Action: How Tool-Using Agents Fail

Episode 2343

🤗 Upvotes: 27 | cs.CL, cs.AI

Authors:
Hongzhan Lin, Shidong Cao, Ziyang Luo, Wenhao Chai, Mong-Li Lee, Wynne Hsu…

2 days, 5 hours ago

Short Long
View Episode
AutoSciBench: Autonomous Benchmark Generation for Evaluating Scientific Agents

Episode 2342

🤗 Upvotes: 22 | cs.AI

Authors:
Dongki Kim, Namkyeong Lee, Surag Nair, Carl Edwards, Xiner Li, Edward De Brouwer,…

2 days, 5 hours ago

Short Long
View Episode
Kandinsky 6.0 Video: Foundation Models for Synchronized Video and Audio Generation

Episode 2341

🤗 Upvotes: 83 | cs.CV, cs.AI, cs.LG, cs.MM

Authors:
Team Kandinsky, Julia Agafonova, Bulat Akhmatov, Mikhail Aks…

3 days, 6 hours ago

Short Long
View Episode
ALoDLM: Adaptively Looped Diffusion Language Models

Episode 2340

🤗 Upvotes: 37 | cs.AI, cs.LG

Authors:
Liancheng Fang, Zhuowei Li, Youngeun Kim, Tianchen Zhao, Rajat Koner, Jiay…

3 days, 6 hours ago

Short Long
View Episode
Adaptive Reward Routing: Dynamic Multi-Reward Optimization for Joint Audio-Video Diffusion via Forward-Process RL

Episode 2339

🤗 Upvotes: 112 | cs.CV

Authors:
Songlin Yang, Xiaotong Zhao, Jiacheng Zhang, Zhe Wang, Toyota Li, Eric Liu, Alan…

1 week ago

Short Long
View Episode
Beyond Memory: Harnessing Long-Horizon Agents with Explicit Belief States

Episode 2338

🤗 Upvotes: 58 | cs.AI

Authors:
Yu Luo, Jiamin Jiang, Yimin Zuo, Xidao Wen, Rongchen Gao, Yongqian Sun, Shenglin …

1 week ago

Short Long
View Episode

Love PodBriefly?

If you like Podbriefly.com, please consider donating to support the ongoing development.

Support Us