[慢讯]阿里海外实验室微调Qwen3.6-35B-A3B,比肩deepseek/glm等更大模型
阿里巴巴旗下的 AI 研发团队Accio-Lab微调Qwen3.6-35B-A3B,模型Occamy-1.0比肩deepseek/glm等更大模型。训练方式:
Qwen3.6-35B-A3B
├─ Marathon Expert: SFT → HDPO ┐
└─ Sprint Expert: SFT ├─ Uniform merge → SAO → Occamy-1.0
SFT 数据集加起来只有 4.033 亿 Token,分布在不到 1.5 万条轨迹里,而且全都是 Agent 方向的(工具调用、终端操作、长流程任务)。所以agent相关性能提升可能比较显著,但世界知识和非agent方面可能没太大提升。
https://cdn3.ldstatic.com/optimized/4X/b/4/7/b470e6f99bcd3686b070e4071e15afdfe9b115a9_2_690x293.png
https://cdn3.ldstatic.com/optimized/4X/9/b/a/9baf80cc48b64344bf3dccc180476cf6042a85c3_2_690x488.webp
huggingface.co (https://huggingface.co/Accio-Lab/occamy-1.0)
https://cdn3.ldstatic.com/optimized/4X/a/e/7/ae7337214518eb1b3a334223330163414cb66b10_2_690x372.png
Accio-Lab/occamy-1.0 · Hugging Face (https://huggingface.co/Accio-Lab/occamy-1.0)
We’re on a journey to advance and democratize artificial intelligence through open source and open science. 做大事和做小事的难度是一样的,都会消耗时间和精力,所以 如果决心做事,就要做大事 。
页:
[1]