本节介绍 Studio 中 SQL 脚本的运行流程:从选择计算资源、设置默认 Catalog,到查看结果、日志、运行历史,以及结果导出。
概述
SQL 脚本的运行模型如下:
运行需要选择 交互式集群类型 计算资源。
运行结果在编辑器下方分 结果、日志、代码信息 三个 Tab 展示。
最近 30 天的运行历史记录可在 运行记录 中查看。
前提条件
当前工作空间已绑定 交互式集群 类型计算资源。详见 计算资源概述。
您具备当前 SQL 文件的「运行」「编辑」或「管理」权限。
您具备目标 Catalog 中相关库表的访问权限。
操作步骤
步骤 1:选择计算资源
1. 打开 SQL 文件。
2. 在编辑器右上角单击 计算资源 下拉,选择当前工作空间内的 交互式集群 类型计算资源。
步骤 2:设置默认 Catalog 与 Schema(可选)
1. 在编辑器右上角设置 默认 Catalog 与 默认 Schema 。
2. 之后 SQL 中可直接写
table_name,系统按默认 Catalog / Schema 解析。3. 也可通过
catalog_name.schema_name.table_name 三段式指定查询对象信息。步骤 3:运行 SQL
可选三种方式运行:
方式 | 入口 | 行为 |
全部运行 | 操作栏 全部运行 | 顺序执行文件中所有以 ; 分隔的 SQL。 |
运行选中 | 选中片段后单击 运行选中 或 ⌘ + Enter | 仅执行选中代码。 |
运行光标所在语句 | 光标置于语句中并按 ⌘ + Enter(不选中任何文本) | 自动识别当前 ; 之间的语句执行。 |
步骤 4:填写参数(如有)
步骤 5:查看运行结果
运行结束后,编辑器下方展示三类信息:
5.1 结果 Tab
展示当前 SQL 的查询结果表格,支持:
操作 | 说明 |
排序 | 单击列名升序 / 降序排序。 |
显示字段 | 选择显示 / 隐藏列、冻结列、调整列顺序。 |
数据检索 | 在结果区查找文本,高亮命中并支持上下条切换。 |
结果筛选 | 添加筛选条件(多条件用 AND / OR 连接)。 |
复制 | 选中区域右键复制,或 ⌘ + A / ⌘ + C 全选复制。 |
下载 | 单击 下载 ,支持 CSV / Excel / TXT。 |
可视化 | 单击 创建图表 ,按列生成柱状图、折线图、饼图等。 |
5.2 日志 Tab
展示 SQL 执行的日志,包括 Spark Session 输出、Spark 执行日志、错误堆栈等。
5.3 代码信息 Tab
展示当前 SQL 执行的代码段信息。
步骤 6:查看运行历史
1. 在编辑器下方单击 运行记录 ,可查看当前脚本近 30 天的所有运行记录,以及近 3 天的所有运行结果。
2. 支持的操作:
查看详情 :进入单次运行的结果、日志、代码信息。
查看任务洞察 :查看单次运行的任务洞察和 Spark UI 信息。
提示
运行历史按文件 ACL 过滤,您只能看到您有权访问的文件对应的运行记录。
步骤 7:导出结果
格式 | 说明 |
CSV | 默认编码 UTF-8,包含表头。 |
Excel(.xlsx) | 保留列类型与展示格式。 |
TXT | 制表符分隔。 |
参数说明
运行配置
参数 | 说明 | 是否必填 | 默认值 |
计算资源 | 交互式集群资源。 | 是 | 无 |
默认 Catalog | 解析未带 Catalog 前缀的引用。 | 否 | 无 |
默认 Schema | 解析未带 Schema 前缀的引用。 | 否 | 无 |
结果区配额
项目 | 限制 |
单次查询默认展示数据量 | 行数不超过 2w 行,大小不超过 10M |
下载结果默认数据量 | 行数无限制,大小不超过 500M |
查询记录保存时长 | 30 天 |
查询结果保存时长 | 3 天 |
查询记录条数 | 不超过 1024 条 |
子结果 tab 数 | 不超过 100 个 |
常见问题
Q1:报「Resource group not connected」?
工作空间未绑定交互式集群计算资源,或所选资源组状态不可用。请前往 创建计算资源 创建并绑定,或选择其他可用资源组。
Q2:查询很慢,如何排查?
切到 代码信息 Tab 查看 Spark 执行洞察(扫描行数、扫描字节数、shuffle 数据量等)。
单击 查询 ID > 查看 Spark UI (路标),获取算子级执行详情。
检查 SQL 是否触发了全表扫描;考虑添加分区过滤或调整 Catalog 物化视图。
Q3:如何中止一个跑了很久的查询?
当前文件正在运行:单击操作栏 停止 。
相关文档
SQL IDE 基础操作