星颖资源网

 找回密码
 立即注册
查看: 39|回复: 1

[慢讯]阿里海外实验室微调Qwen3.6-35B-A3B,比肩deepseek/glm等更大模型

[复制链接]

6万

主题

1万

回帖

23万

积分

管理员

Rank: 9Rank: 9Rank: 9

积分
235761
发表于 2026-9-27 12:24:03 | 显示全部楼层 |阅读模式
阿里巴巴旗下的 AI 研发团队Accio-Lab微调Qwen3.6-35B-A3B,模型Occamy-1.0比肩deepseek/glm等更大模型。
训练方式:
Qwen3.6-35B-A3B
├─ Marathon Expert: SFT → HDPO ┐
└─ Sprint Expert: SFT ├─ Uniform merge → SAO → Occamy-1.0
SFT 数据集加起来只有 4.033 亿 Token,分布在不到 1.5 万条轨迹里,而且全都是 Agent 方向的(工具调用、终端操作、长流程任务)。所以agent相关性能提升可能比较显著,但世界知识和非agent方面可能没太大提升。


huggingface.co (https://huggingface.co/Accio-Lab/occamy-1.0)

Accio-Lab/occamy-1.0 · Hugging Face (https://huggingface.co/Accio-Lab/occamy-1.0)
We’re on a journey to advance and democratize artificial intelligence through open source and open science.
回复

使用道具 举报

0

主题

2806

回帖

5612

积分

VIP(年费)

积分
5612
发表于 2026-9-27 18:10:26 来自手机 | 显示全部楼层
做大事和做小事的难度是一样的,都会消耗时间和精力,所以 如果决心做事,就要做大事 。
回复

使用道具 举报

您需要登录后才可以回帖 登录 | 立即注册

本版积分规则

微信

社群

VIP

AI

顶部

QQ|本站内容来源网友投稿或网络转载,如果有侵权的内容,请联系我们删除。|小黑屋|人人为我,我为人人!| 星颖资源网

GMT+8, 2026-10-5 06:01 , Processed in 0.043312 second(s), 25 queries .

快速回复 返回顶部 返回列表