林俊旸离职后的发声
离职引发关注
3月26日,广受科技圈关注的原阿里千问技术负责人林俊旸在社交账号发布长文。他虽未透露职业规划相关话题,但聚焦技术探讨,提到千问,其观点引发广泛关注。这一离职事件,让人们对他在AI领域的新见解充满期待。
长文核心观点
林俊旸在文中详述了对大模型发展路线的理解及对AI下一阶段的预判。他指出过去两年重塑了行业对大模型的评估方式与核心期待,而当下行业正迈向训练智能体的时代,智能体式思考将成为主流。
大模型发展的关键节点
推理式思考阶段
OpenAI的o1表明“思考”可被训练,DeepSeek-R1证明推理式后训练能复现扩展。2025年上半年行业焦点在让模型推理时多想一会儿,这一阶段至关重要,推动了AI推理能力的发展。

智能体式思考的兴起
林俊旸认为下一步是智能体式思考,即与环境交互并依反馈更新计划。2025年初千问团队有合并思考与指令模式的野心,虽方向正确但实践困难,因两种模式数据分布和行为目标不同。
智能体式思考的特点与挑战
特点
智能体式思考与推理式思考优化目标不同。推理式思考以最终答案前内部思辨质量评判,智能体思维关注与环境交互中持续取得进展,核心问题转变,训练核心对象变为模型加环境的系统。
挑战
实现智能体式思考面临诸多挑战。如平衡模型合并与提升数据质量困难,分开做有吸引力,像Qwen发布独立版本。未来研究瓶颈在环境设计、评估器鲁棒性和反作弊机制等方面。

相关问答
林俊旸离职后首发长文主要探讨了什么?
主要探讨大模型发展路线,认为行业正从训练模型走向训练智能体时代,智能体式思考将成主流,还提及千问团队相关尝试及面临的问题。
智能体式思考与推理式思考有何不同?
推理式思考以最终答案前内部思辨质量评判,智能体思维关注与环境交互中持续取得进展,核心问题和训练核心对象都有变化。
千问团队在合并思考与指令模式上遇到了什么问题?
两种模式数据分布和行为目标存在显著差异,在平衡模型合并与提升数据质量和多样性过程中,两方面表现都平庸。
行业从训练模型时代走向训练智能体时代的特征是什么?
特征是跟真实世界的闭环交互,模型训练核心对象变为模型加环境的整个系统,环境设计等多方面进入核心圈。
未来智能体式思考发展面临哪些挑战?
训练中的奖励作弊问题,研究瓶颈集中在环境设计、评估器鲁棒性和反作弊机制等方面,harness工程重要性凸显。
简短标题:林俊旸离职后发声,智能体式思考会是AI未来方向?
转载声明:欢迎分享本文,转载请保留出处!发布者 财云量化
