星颖 发表于 2026-7-24 11:00:00

LongCat-2.0:

LongCat-2.0:Agent 长任务成本与真实项目验证

刷到一个真实任务测试:作者用 LongCat-2.0 完成一个城市电台项目,单个 Session 累计处理约 134 万 Token,其中 124 万是 Cache Read,输入缓存命中率达到 94.46%。

原帖 86 赞、68 收藏、17 评论、5 分享。作者强调 LongCat-2.0 的 Cache 命中不计费,所以评估 Agent 不只看模型跑分,而要看任务有没有完成、人工介入了几次、最终账单是多少。

这个案例的信号在于,Agent Coding 正在进入“长任务交付成本”阶段。以后大家选 Agent 或卖 Agent 服务,可能会更关心缓存命中率、上下文复用、人工接管次数,而不是单纯比较一次性代码生成效果。

可复刻方向包括 Agent 成本看板、长任务评测模板、垂直行业自动化交付服务,或者把“真实任务完成度 + 账单”包装成企业采购/课程/工具评测内容。

















xxyg666 发表于 2026-7-26 15:42:00

线下名额放出十分钟秒空,候补名单已经排到明年春天

QiYuan789 发表于 2026-8-8 07:08:45

这种帖子对我这种小白很友好,先学起来。

LuoHanYing7 发表于 2026-8-11 19:34:48

没想到这里还有赚钱的讯息

ZhuXiXi1314 发表于 5 天前

先把一个小环节做到位,再去追求规模。

lyzn888 发表于 前天 20:08

做项目还是要少幻想,多测试,多复盘。
页: [1]
查看完整版本: LongCat-2.0: