人工智能

CAIS远程劳动指数更新:Claude Fable 5 将真实自由职业项目自动化率推高至 16.1%

2026年7月10日 · admin
openmagic ad

据 IT之家 7 月 3 日消息,AI 安全中心(CAIS)于 7 月 1 日更新了远程劳动指数 RLI。来源显示,最新进入测试的 Claude Fable 5 模型在该基准中的“自动化率”达到 16.1%,刷新了该测试纪录。RLI 关注的不是简单问答或代码题,而是让 AI 智能体尝试完成真实远程自由职业项目,覆盖 3D 与 CAD、建筑设计、平面设计、视频动画、音频制作、数据分析、网页应用等任务,因此这一结果被视为观察 AI 对远程知识型与创意型工作的替代能力的重要信号。

RLI 测的是什么:从“会回答”到“能交付”

与许多模型榜单不同,RLI 的核心在于交付物质量。按照来源摘要说明,该评测严格参照工业标准设置任务,每个项目的最终成果都会由人工评审员审查,并与人类专业人员制作的标准交付物进行对照。其关键指标“自动化率”,衡量的是 AI 输出中有多少比例能够达到或超过人类专业交付物质量。

这意味着,RLI 并不只是测试模型是否理解需求、是否能生成好看的图片或文本,而是在评估 AI 智能体是否能把需求拆解、执行、产出,并形成接近真实客户可验收的成果。对于远程工作市场来说,这类指标比单次演示更具参考价值,因为它更接近自由职业者面对的项目环境。

  • 任务类型更贴近产业场景:包括 CAD、建筑平面图、平面设计、动画广告和数据分析等。
  • 评价标准强调最终交付:由人工评审对比人类专业作品,而非只看模型自评或自动评分。
  • 自动化率反映质量达标比例:16.1% 代表部分项目成果已能达到或超过人类基准交付物。

从 2.5% 到 16.1%:远程劳动自动化速度正在加快

来源显示,在本次榜单之前,RLI 的最高得分为 4.17%,由 Opus 4.6 基于 Claude Cowork 框架创造。而 RLI 自 2025 年 10 月底发布以来,最初最高得分为 2.5%。在上线约 8 个月后,Claude Fable 5 将纪录提升到 16.1%,这一变化说明 AI 智能体在多步骤项目执行、视觉生成质量和工具协同方面可能出现了明显进展。

从绝对数值看,16.1% 并不意味着多数远程岗位已经可以被完整替代;但从增长速度看,它提示了一个更值得关注的趋势:AI 的能力提升正在从“辅助单个环节”转向“完成部分完整项目”。如果后续模型继续沿着智能体化、工具调用和多模态生成方向迭代,远程自由职业平台上的部分标准化项目,可能率先受到冲击。

设计、动画与建筑类任务出现改善,但距离稳定替代仍有差距

在具体项目表现上,来源提到 Claude Fable 5 在珠宝设计任务中生成的戒指设计,相比此前 AI 模型质量显著提升,不过实际交付物与人工设计产品之间依然存在差距。这一点很关键:AI 可以在构图、样式、视觉呈现上快速进步,但涉及材料约束、工艺可行性、品牌审美与客户沟通的部分,仍然需要专业经验。

此外,在 2D 动画广告、建筑平面图等项目中,新模型的视觉质量和模型准确度也有改善。对于中文读者熟悉的设计外包、短视频素材制作、装修平面图初稿等场景而言,这类能力进展意味着 AI 工具可能先成为“初稿生产力”,帮助从业者压缩方案探索时间,而不是立刻完全取代专业人员。

影响解读:远程工作者需要从“交付执行”转向“审美、判断与整合”

RLI 的新纪录对平面设计、建筑辅助设计、动画制作、数据分析等远程岗位都具有提示意义。短期看,AI 更可能改变工作流:客户或团队用 AI 生成多个初稿,再由人类筛选、修改、验收;中期看,低复杂度、需求清晰、可模板化的项目可能面临更强价格压力。

因此,对相关从业者而言,竞争重点会从“能不能做出一个交付物”,转向“能不能定义好需求、判断好坏、处理例外、整合工具并承担最终质量”。对企业来说,RLI 也提供了一个观察窗口:当 AI 智能体在真实项目中的达标比例持续上升,自动化不再只是办公效率工具,而会成为影响外包、人力配置和产品迭代速度的产业变量。

总体来看,Claude Fable 5 在 RLI 中达到 16.1% 自动化率,代表 AI 远程劳动能力的一次显著跃升,但并不等于创意与专业服务岗位被全面替代。更现实的判断是:AI 正在加速进入真实交付链条,而掌握 AI 工具、具备专业判断和项目整合能力的人,将更可能在下一阶段远程工作市场中保持优势。