Anthropic复盘测试影响分析服务扩容:Claude写八成代码,CI任务半年激增25倍
摘要
Anthropic工程师撰文复盘,在Claude编写约80%代码、测试量增长10倍、CI任务半年增加25倍的智能体编程压力下,团队三个临时补丁仅维持70天、29天和不到一天,最终用三周重设计为无状态、内存存储加journal的可水平扩展架构,并建议按两季度内25倍负载做容量规划。
随着智能体编程在研发流程中加速渗透,代码生成规模与测试需求正以超出传统预期的速度膨胀。Anthropic工程师近日撰文,复盘了其测试影响分析(Test Impact Analysis)服务在这一压力下的扩容历程,披露了一组颇具参考价值的内部数据。
文章给出的数字颇为直观:Claude编写了约80%的代码,测试数量增长10倍,而CI任务在六个月内增加了25倍。这种量级的变化,让原本尚可支撑的测试影响分析服务迅速逼近瓶颈,团队不得不连续采取应急手段。
据复盘,团队先后部署了三个临时补丁——扩容、按包分片、每日重启,但它们分别只维持了70天、29天和不到一天。补丁的快速失效,说明问题并非单纯的资源不足,而是架构层面难以随负载线性扩展。
最终,团队用三周时间将服务重新设计为无状态、内存存储加journal的可水平扩展架构,从根本上改变了扩展方式。文章同时给出建议:团队应按两个季度内25倍负载来做容量规划,为智能体编程带来的持续增长预留空间。
本文由新大陆基于公开信息编辑整理
信息来源:AIHOT AIHOT原文 ↗