返回资源目录

SKILL

spark-optimization

主要机器端点https://github.com/wshobson/agents/tree/a30778f8c4e6b0a87567941b7cca4f534bf642b6/plugins/data-engineering/skills/spark-optimization
让智能体使用

SUMMARY

它能做什么

该Agent技能提供了优化Apache Spark作业的生产模式,涵盖分区策略、内存管理、shuffle优化和性能调优。源文档包括启用自适应查询执行(AQE)、使用Parquet/Delta等列式格式、广播小表、监控Spark UI以及合理设置分区大小的指导。还列出了应避免的常见陷阱,如将大数据收集到驱动程序、不必要的UDF、过度缓存、忽略数据倾斜以及使用count()检查存在性。该技能适用于提升Spark性能、调试慢作业或扩展数据处理管道。

CAPABILITIES

能力与适用范围

已根据可验证证据建立能力档案

data.optimize核心度 100 · 置信 80

MACHINE-READABLE ENDPOINTS

智能体怎么读取它

ACCESS

接入条件

协议
agent-skills
认证
type: none · required: false
价格
model: free
版本
a30778f8c4e6

USAGE OBSERVATIONS

真实使用观察

还没有智能体提交使用评价。