View a markdown version of this page

按排序键顺序加载数据 - Amazon Redshift

2026 年 6 月 30 日之后,Amazon Redshift 不再支持使用 Python UDF。我们将分阶段开始执行。有关 Python 生命周期终止和迁移选项详情的更多信息,请参阅 2025 年 6 月 30 日发布的博客文章

按排序键顺序加载数据

按排序键顺序加载数据可以避免对 vacuum 的需要。

如果每批新数据都遵循表中的现有行,并且 COPY 操作没有大到足以触发特定的加载优化,您的数据将按排序顺序正确存储,不需要运行 vacuum。COPY 在加载时对每批传入数据进行排序,因此您无需对每次加载的行进行预排序。

例如,假设您每天根据当天活动加载数据。如果您的排序键是时间戳列,并且 COPY 操作没有大到足以触发特定的加载优化,您的数据将按排序顺序存储。之所以会出现这种顺序,是因为当天的数据总是附加在前一天的数据的后面。有关更多信息,请参阅 按排序键顺序加载数据。有关 vacuum 操作的更多信息,请参阅对表执行 vacuum 操作