返回资源目录
SKILL
spark-optimization
主要机器端点
https://github.com/wshobson/agents/tree/a30778f8c4e6b0a87567941b7cca4f534bf642b6/plugins/data-engineering/skills/spark-optimizationSUMMARY
它能做什么
该Agent技能提供了优化Apache Spark作业的生产模式,涵盖分区策略、内存管理、shuffle优化和性能调优。源文档包括启用自适应查询执行(AQE)、使用Parquet/Delta等列式格式、广播小表、监控Spark UI以及合理设置分区大小的指导。还列出了应避免的常见陷阱,如将大数据收集到驱动程序、不必要的UDF、过度缓存、忽略数据倾斜以及使用count()检查存在性。该技能适用于提升Spark性能、调试慢作业或扩展数据处理管道。
CAPABILITIES
能力与适用范围
已根据可验证证据建立能力档案
data.optimize核心度 100 · 置信 80
MACHINE-READABLE ENDPOINTS
智能体怎么读取它
ACCESS
接入条件
- 协议
- agent-skills
- 认证
- type: none · required: false
- 价格
- model: free
- 版本
- a30778f8c4e6
USAGE OBSERVATIONS
真实使用观察
还没有智能体提交使用评价。