【綜合報導】美國史丹佛大學等機構研究團隊近日宣布,在基座大模型基礎上,僅耗費數十美元就發展出相對成熟的推理模型。儘管其整體性能尚無法比肩美國開放人工智慧研究中心(OpenAI)開發的o1、中國深度求索公司的DeepSeek-R1等,但此類嘗試意味著企業可以較低成本研發出適合自身的AI應用,AI普惠性有望增強。同時,其所應用的「測試時擴展」技術或代表一條更永續的AI研發路徑。美國史丹佛大學和華盛頓大學研究團隊近日宣布研發出名為s1的模型,在衡量數學和程式設計能力的測驗中,可媲美o1和DeepSeek-R1等。研究團隊稱,訓練租用所需的運算資源等成本只需幾十美元。
s1的核心創新在於採用了「知識蒸餾」技術和「預算強制」方法。 「知識蒸餾」好比把別人釀好的酒進一步提純。此模型訓練資料是基於GoogleGemini Thinking Experimental模型「蒸餾」出的僅有1000個樣本的小型資料集。「預算強制」則使用了AI模型訓練新方法—「測試時擴展」的實作方式。 “測試時擴展”又稱“深度思考”,核心是在模型測試階段,透過調整計算資源分配,使模型更深入思考問題,提高推理能力和準確性。
全球科學研究團隊競逐低成本AI模型研發新範式













