View a markdown version of this page

在工作人员仪表板中查看工作人员的详细信息 - AWS 截止日期云

本文属于机器翻译版本。若本译文内容与英语原文存在差异,则一律以英文原文为准。

在工作人员仪表板中查看工作人员的详细信息

工作人员仪表板提供处理任务的工作人员的详细信息。你可以看到:

  • 工作程序的元数据,例如实例类型。

  • 工作人员执行的会话操作。

  • 工作器性能,包括 CPU、内存和磁盘使用率。仪表板还显示了 GPU-accelerated 实例的 GPU 利用率。

  • 一段时间内 CPU、内存和磁盘使用情况的图表。该图还包括 GPU-accelerated 实例的 GPU 利用率。

  • 一段时间内磁盘速度的图表。

  • 任务的工作人员日志。

通过任务查看工作人员仪表板
  1. 按照中的在 Deadline Cloud 中查看和管理工作详情步骤查看工作列表。

  2. 作业列表中选择作业。

  3. 从 “步骤” 列表中选择一个步骤。

  4. 从 “任务” 列表中选择一项任务。

  5. 在任务表中,从 操作” 菜单中选择 “查看工作人员仪表板”

从车队详细信息中查看工作人员仪表板
  1. 按照中的步骤在 Deadline Cloud 中查看队列和舰队详细信息查看舰队。

  2. 从 “工作人员” 列表中选择一个工作人员。

  3. 操作” 菜单中选择 “查看工作人员仪表板”

使用案例

检测配置不足的实例

当渲染时间超过预期时,工作人员仪表板可以帮助确定您的实例的大小是否足以适应您的工作负载。虽然对于许多渲染器来说,vCPU 利用率为 100% 是正常的,但持续较高的内存使用率接近最大容量和较高的磁盘空间利用率可能表明您的实例配置不足。对于 GPU-accelerated 工作负载,持续较高的 GPU 利用率也可能表明您需要额外的 GPU 容量。在这种情况下,升级队列的实例配置可以减少渲染错误并显著缩短渲染时间。但是,在升级后继续监控员工绩效以确保找到最佳平衡点很重要——过于激进的升级会导致过度配置导致不必要的成本。

检测过度配置的实例

即使任务成功完成,也可能有机会优化成本。工作人员仪表板可以显示你支付的计算能力是否超过了工作负载的需求。如果您发现该工作线程的平均 vCPU 使用率低、内存利用率最低且未使用磁盘空间过多,则可以缩小队列的实例配置。

排除失败的任务

在调查失败的任务时,工作人员仪表板是宝贵的诊断工具。特别注意峰值内存使用率和磁盘空间利用率——如果这些指标接近或达到 100%,它们很可能是任务失败的根本原因。这种资源耗尽表明您当前的实例缺乏有效处理工作负载的能力。在这些情况下,使用增加的内存或磁盘空间配置实例将有助于确保成功完成任务。

最佳实例利用率

vCPU 利用率

目标范围:70— 90%

  • 低于 70%:可能未充分利用计算资源,这意味着您支付的 CPU 超过了工作负载需求

  • 70— 90%:最佳范围,您可以在不遇到瓶颈的情况下高效使用资源

  • 始终保持在 100%:可能表明 CPU 瓶颈可能会减慢渲染速度

有些渲染任务自然会 CPU-intensive 比其他任务多,100% 的 vCPU 使用率可能不是问题。 Real-time 可视化任务可能显示更稳定的 CPU 利用率,而计算要求不断变化的任务可能具有不同的模式。

内存利用率

目标范围:70— 85%

  • 低于 50%:您的工作负载可能过大实例

  • 70— 85%:最佳利用率,为峰值留出足够的余量

  • 90% 以上:出现性能下降或内存不足错误的风险

内存要求可能会因场景复杂度、纹理分辨率和仿真数据而有很大差异。监控一段时间内的内存趋势对于确定您的工作负载的内存需求是否在增长非常重要。

磁盘空间利用率

目标范围:60— 80%

  • 低于 40%:可能是存储空间过度配置

  • 60— 85%:利用率良好,可容纳临时文件和缓存

  • 85% 以上:大型渲染期间空间耗尽的风险

请记住,磁盘 I/O 性能可能与容量一样重要,特别是对于在渲染期间使用 read/write 大量纹理或缓存文件的工作负载。