MaxCompute SQL 引擎语法 Skill

为 text2sql 场景提供 MaxCompute SQL 引擎语法指导。MaxCompute 基于 Hive SQL 扩展,与 ANSI 标准 SQL 有显著差异。

用法

根据问题类型加载对应参考文件(可组合)。load 列表示相对加载权重(heavy ≈ 大,medium ≈ 中等),用于预算估算,非精确 token 数。每个文件的开头段落描述其自身范围。

触发条件文件load
NL→SELECT 生成 / text2sql(先确定意图、粒度、表列映射、输出格式)references/text2sql_principles.mdlight
生成 MaxCompute SELECT 查询(方言规则,DQL 默认必读)references/maxcompute_select_guide.mdheavy
匹配查询模式关键词:Top N / 组内 Top-N / 同比 / 环比 / 连续 N 天 / 留存 / 行转列 / 列转行 / PIVOT / UNPIVOT / 数组展开 / LATERAL VIEW / EXPLODE / JSON 提取 / GET_JSON_OBJECT / 累计 / 累计求和 / Range Join / GROUPING SETS / CUBE / ROLLUP / 分页 / pagingreferences/sql_query_patterns.mdmedium
SQL 执行失败需要诊断和恢复(含 ODPS-0xxx 错误码)references/sql_common_errors.mdmedium
关系:text2sql_principles.md 提供引擎无关的 NL→SELECT 生成原则;maxcompute_select_guide.md 是 MaxCompute DQL 方言规则的唯一权威来源(不支持的语法 / 函数 / 分区 / 类型 / SET 参数)。sql_query_patterns.md 仅提供查询模板片段,不重复规则。

范围外

以下场景超出本 Skill 范围:

  • MaxCompute 非 SQL 接口:Tunnel / MapReduce / Graph / PyODPS DataFrame API、SDK 调用方式
  • 控制台与权限管理:Quota 申请、IAM / RAM 角色、项目所有者操作——使用阿里云控制台或支持工单
  • 执行计划级深度调优:仅列出常用 SET 参数和 hint;不分析具体计划节点 / Fuxi DAG / 数据倾斜形成路径
  • 集群侧 / 平台侧故障:Worker 崩溃、资源调度失败、MetaStore 事务冲突、存储层读写错误——这些是支持工单问题,不是 SQL 问题