Podcast Episodes

Back to Search
【第63期】无论DPO还是PPO,Preference Feedback应该怎么用?
【第63期】无论DPO还是PPO,Preference Feedback应该怎么用?

Seventy3: 用NotebookLM将论文生成播客,让大家跟着AI一起进步。

今天的主题是:

Unpacking DPO and PPO: Disentangling Best Practices for Learning from Preference Feedback

Summary

This …

1 year, 9 months ago

Short Long
View Episode
【第62期】sCMs:比Diffusion更快的图像生成算法
【第62期】sCMs:比Diffusion更快的图像生成算法

Seventy3: 用NotebookLM将论文生成播客,让大家跟着AI一起进步。

今天的主题是:

Simplifying, stabilizing, and scaling continuous-time consistency models

Summary

This research paper in…

1 year, 9 months ago

Short Long
View Episode
【第61期】大模型的「推理」是在做什么?
【第61期】大模型的「推理」是在做什么?

Seventy3: 用NotebookLM将论文生成播客,让大家跟着AI一起进步。

今天的主题是:

Procedural Knowledge in Pretraining Drives Reasoning in Large Language Models

Summary

This research inv…

1 year, 9 months ago

Short Long
View Episode
【第60期】RLTools:基于C++的开源强化学习工具
【第60期】RLTools:基于C++的开源强化学习工具

Seventy3: 用NotebookLM将论文生成播客,让大家跟着AI一起进步。

今天的主题是:

RLtools: A Fast, Portable Deep Reinforcement Learning Library for Continuous Control

Summary

RLtools, a…

1 year, 9 months ago

Short Long
View Episode
【第59期】SymDPO:多模态In-context learning提升技巧
【第59期】SymDPO:多模态In-context learning提升技巧

Seventy3: 用NotebookLM将论文生成播客,让大家跟着AI一起进步。

今天的主题是:

SymDPO: Boosting In-Context Learning of Large Multimodal Models with Symbol Demonstration Direct Pref…

1 year, 9 months ago

Short Long
View Episode
【第58期】AM-RADIO,融合多种视觉大模型
【第58期】AM-RADIO,融合多种视觉大模型

Seventy3: 用NotebookLM将论文生成播客,让大家跟着AI一起进步。

今天的主题是:

AM-RADIO: Agglomerative Vision Foundation Model -- Reduce All Domains Into One

Summary

This paper propo…

1 year, 9 months ago

Short Long
View Episode
【第57期】降低数值精度影响LLM数学推理能力
【第57期】降低数值精度影响LLM数学推理能力

Seventy3: 用NotebookLM将论文生成播客,让大家跟着AI一起进步。

今天的主题是:

How Numerical Precision Affects Mathematical Reasoning Capabilities of LLMs

Summary

This research paper…

1 year, 9 months ago

Short Long
View Episode
【第56期】o1的self-correction是一种In context Alignment
【第56期】o1的self-correction是一种In context Alignment

Seventy3: 用NotebookLM将论文生成播客,让大家跟着AI一起进步。

今天的主题是:

A Theoretical Understanding of Self-Correction through In-context Alignment

Summary

This research paper…

1 year, 9 months ago

Short Long
View Episode
【第55期】RLInspect
【第55期】RLInspect

Seventy3: 用NotebookLM将论文生成播客,让大家跟着AI一起进步。

今天的主题是:

RLInspect: An Interactive Visual Approach to Assess Reinforcement Learning Algorithm

Summary

This techn…

1 year, 9 months ago

Short Long
View Episode
【第54期】Impacts of AI on Innovation
【第54期】Impacts of AI on Innovation

Seventy3: 用NotebookLM将论文生成播客,让大家跟着AI一起进步。

今天的主题是:

Artificial Intelligence, Scientific Discovery, and Product Innovation

Summary

This document is a resear…

1 year, 9 months ago

Short Long
View Episode

Love PodBriefly?

If you like Podbriefly.com, please consider donating to support the ongoing development.

Support Us