
8期


你有没有想过,AI天才也需要“岗前培训”才能上岗?本期我们将从几篇最新论文出发,揭秘如何为AI搭建高效的“培训工厂”,并探索如何教AI学会“做事的方法论”,而不仅仅是“堆知识”。我们还会聊聊一个有趣的问题:AI会为了讨好你而放弃原则、变成一个“老好人”吗?最后,我们将从一个全新的角度,看看合作的本质,也许就藏在最底层的成本计算里。
00:00:32 AI天才出厂后,谁给它做“岗前培训”?
00:06:42 如何让AI的“学徒”跟上“大师”的脚步
00:11:35 AI的进化,从“知道什么”到“该做什么”
00:17:26 为什么AI会变成一个“老好人”?
00:22:03 合作的秘密,藏在成本里
本期介绍的几篇论文:
[LG] Miles v0.1: Production-Level Post-Training
[RadixArk]
https://arxiv.org/abs/2609.08368
---
[LG] Online Draft Co-Training for Speculative Decoding in Large-Scale, Long-Context RL Post-Training
[NVIDIA]
https://arxiv.org/abs/2609.07108
---
[AI] Procedural Graphs: Self-Evolving Execution Structures for LLM Agents
[Google]
https://arxiv.org/abs/2609.09153
---
[CL] Measuring LLM Sycophancy under Sustained Multi-Turn Pressure
[Texas A&M University & University of Cincinnati]
https://arxiv.org/abs/2609.09090
---
[AI] Tapes Together Strong: The Co-evolution of Computation and Cooperation
[Google]
https://arxiv.org/abs/2609.10817


3期
98期

沪ICP备06026464号-4 网络文化经营许可证
沪网文[2014]0587-137号
信息网络传播视听许可证:0911603
©2011-2019 qingting.fm ALL Rights Reserved.
应用名称:蜻蜓FM | 开发者:上海麦克风文化传媒有限公司