推理时计算 on Answer

推理时计算 on Answer https://answer.freetools.me/tags/%E6%8E%A8%E7%90%86%E6%97%B6%E8%AE%A1%E7%AE%97/ Recent content in 推理时计算 on Answer Hugo -- 0.152.2 zh-cn Mon, 09 Mar 2026 06:26:43 +0800 测试时训练：当模型在推理阶段继续学习会发生什么 https://answer.freetools.me/%E6%B5%8B%E8%AF%95%E6%97%B6%E8%AE%AD%E7%BB%83%E5%BD%93%E6%A8%A1%E5%9E%8B%E5%9C%A8%E6%8E%A8%E7%90%86%E9%98%B6%E6%AE%B5%E7%BB%A7%E7%BB%AD%E5%AD%A6%E4%B9%A0%E4%BC%9A%E5%8F%91%E7%94%9F%E4%BB%80%E4%B9%88/ Mon, 09 Mar 2026 06:26:43 +0800 https://answer.freetools.me/%E6%B5%8B%E8%AF%95%E6%97%B6%E8%AE%AD%E7%BB%83%E5%BD%93%E6%A8%A1%E5%9E%8B%E5%9C%A8%E6%8E%A8%E7%90%86%E9%98%B6%E6%AE%B5%E7%BB%A7%E7%BB%AD%E5%AD%A6%E4%B9%A0%E4%BC%9A%E5%8F%91%E7%94%9F%E4%BB%80%E4%B9%88/ 深入解析Test-Time Training (TTT) 的核心原理与技术演进。从TTT层的隐藏状态即模型设计，到TTT-E2E的长上下文突破，再到TTT-Discover的科学发现能力，全面探讨测试时训练如何打破传统训练与推理的边界，让AI模型在推理过程中持续进化。为什么大模型越思考越聪明：从o1到DeepSeek-R1的推理时计算革命 https://answer.freetools.me/%E4%B8%BA%E4%BB%80%E4%B9%88%E5%A4%A7%E6%A8%A1%E5%9E%8B%E8%B6%8A%E6%80%9D%E8%80%83%E8%B6%8A%E8%81%AA%E6%98%8E%E4%BB%8Eo1%E5%88%B0deepseek-r1%E7%9A%84%E6%8E%A8%E7%90%86%E6%97%B6%E8%AE%A1%E7%AE%97%E9%9D%A9%E5%91%BD/ Mon, 09 Mar 2026 05:19:58 +0800 https://answer.freetools.me/%E4%B8%BA%E4%BB%80%E4%B9%88%E5%A4%A7%E6%A8%A1%E5%9E%8B%E8%B6%8A%E6%80%9D%E8%80%83%E8%B6%8A%E8%81%AA%E6%98%8E%E4%BB%8Eo1%E5%88%B0deepseek-r1%E7%9A%84%E6%8E%A8%E7%90%86%E6%97%B6%E8%AE%A1%E7%AE%97%E9%9D%A9%E5%91%BD/ 深入解析推理时计算扩展如何改变大模型发展范式。从Google DeepMind的test-time compute论文到OpenAI o1和DeepSeek-R1的技术突破，系统阐述两种核心机制（修改提议分布与搜索验证器）、计算最优分配策略、训练与推理计算的权衡分析。包含AIME、GPQA等基准测试数据、DeepSeek-R1四阶段训练流程、自我纠正的困境，以及对推理Scaling Law未来发展的前瞻分析。