LongCat-2.0:
LongCat-2.0:Agent 长任务成本与真实项目验证刷到一个真实任务测试:作者用 LongCat-2.0 完成一个城市电台项目,单个 Session 累计处理约 134 万 Token,其中 124 万是 Cache Read,输入缓存命中率达到 94.46%。
原帖 86 赞、68 收藏、17 评论、5 分享。作者强调 LongCat-2.0 的 Cache 命中不计费,所以评估 Agent 不只看模型跑分,而要看任务有没有完成、人工介入了几次、最终账单是多少。
这个案例的信号在于,Agent Coding 正在进入“长任务交付成本”阶段。以后大家选 Agent 或卖 Agent 服务,可能会更关心缓存命中率、上下文复用、人工接管次数,而不是单纯比较一次性代码生成效果。
可复刻方向包括 Agent 成本看板、长任务评测模板、垂直行业自动化交付服务,或者把“真实任务完成度 + 账单”包装成企业采购/课程/工具评测内容。
线下名额放出十分钟秒空,候补名单已经排到明年春天 这种帖子对我这种小白很友好,先学起来。 没想到这里还有赚钱的讯息 先把一个小环节做到位,再去追求规模。 做项目还是要少幻想,多测试,多复盘。
页:
[1]