Azure Databricks 2026 年 7 月发布了这些功能和改进。
注释
在大多数情况下,下面列出的发布日期和内容仅对应于Azure公有云的实际部署。
本文提供 Azure 公有云上的 Azure Databricks 服务演进历史,供您参考;该信息可能与由世纪互联运营的 Azure 上的实际部署情况不一致。
注释
发布过程分阶段进行。 Azure Databricks 帐户可能要等到初始发布日期后的一周或更长时间才会更新。
Anthropic 托管摄取连接器(Beta)
2026 年 7 月 17 日
Lakeflow Connect 的 Anthropic 连接器现已推出 Beta 版。 连接器允许将合规性 API 数据(审核活动、组织、用户、角色、组、设置和 Claude 聊天和消息)从Anthropic引入Azure Databricks。
Microsoft Teams中的 Databricks Genie 应用现在以公共预览版提供
2026 年 7 月 17 日
Microsoft Teams中的 Databricks Genie 应用现在以公共预览版提供。 应用将 Genie 引入Microsoft Teams,以便用户可以提出数据问题并获取答案,而无需离开Microsoft Teams。
Lakebridge 代理转换器处于 Beta 版
2026 年 7 月 16 日
Lakebridge 智能体转换器目前处于 Beta 阶段。 使用它可将旧版 SQL 方言(如 T-SQL、Snowflake、Redshift、Oracle、BigQuery 和 Teradata)转换为工作区中的迁移项目中的 ANSI SQL。 转换器由 Genie Code 提供支持,分析每个源脚本、验证语法和语义意向,并在将结果写入工作区之前迭代修复错误。 工作区管理员必须从 “预览 ”页启用它。
Unity Catalog 中的 Scala 和 Java UDF 现已正式可用
2026 年 7 月 16 日
在 Unity 目录中注册 Scala 和Java用户定义的函数(UDF),并通过 Unity 目录治理在笔记本、作业和 SQL 仓库中重复使用它们。 重用现有的 JVM 逻辑,并在所有计算环境(包括无服务器)中获得比 Python UDF 更好的性能。
请参阅 Unity 目录中的 Scala 和Java用户定义的函数(UDF)。
AI 搜索高 QPS 功能现已正式发布
2026 年 7 月 15 日
AI Search High QPS 现已正式发布,支持标准端点。
在标准 AI 搜索终结点上设置目标 QPS,以支持高吞吐量、实时工作负载,例如搜索栏、建议系统和实体匹配。 默认启用高 QPS,但不会影响现有端点。 仅当为端点配置目标 QPS 时,额外容量及其相关成本才会适用。
Azure Databricks帐户的自定义 URL (公共预览版)
2026 年 7 月 15 日
现在可以为所有用户和工作区声明并启用自定义 URL,以便为Azure Databricks帐户提供单一品牌入口点(例如acme.databricks.com)。 请参阅为Azure Databricks帐户提供自定义 URL。
数据分类现已默认支持更多合规标准
2026 年 7 月 15 日
对于启用了合规性安全配置文件且选择了 C5 或 TISAX 控制项的工作区,数据分类现已默认可用。
Lakebase 现已符合 SOC 2 Type 2 合规要求
2026 年 7 月 14 日
Lakebase 现在符合 SOC 2 类型 2。
无服务器计算现已在Azure英国西部区域提供
2026 年 7 月 14 日
适用于笔记本、作业、管道和 SQL 仓库的无服务器计算,以及无服务器私有连接,现已在 Azure UK West(ukwest)区域正式可用。 请参阅 无服务器可用性。
Trigger.AvailableNow 对 OpenSharing 流式处理的支持 (GA)
2026 年 7 月 14 日
从 OpenSharing 表中进行的流式读取现已支持 Trigger.AvailableNow 触发器。 此触发器在启动时捕获共享表的当前版本,在一个或多个微批次中处理所有可用数据(遵循 maxFilesPerTrigger 和 maxVersionsPerRpc 设置),然后停止,因此非常适合按计划执行的、类似批处理的增量处理。 此前,OpenSharing 源中的 Trigger.AvailableNow 已转换为 Trigger.Once,后者每次运行处理一个微批次。 此功能需要 Databricks Runtime 18.0 或更高版本。
对于 Databricks 到 Databricks 接收方,请参阅 使用 Apache Spark Structured Streaming 查询表;对于开放共享接收方,请参阅 使用 Spark Structured Streaming 访问共享表。
查看仓库活动详细信息(正式上线)
2026 年 7 月 13 日
SQL 仓库监视 UI 中的 “活动详细信息 ”切换现已正式发布。 在 “正在运行的群集 ”图表上查看颜色编码的批注,解释仓库为何保持活动状态,包括查询活动、提取查询、打开会话和空闲状态。 将鼠标悬停在条形上以查看元数据,或单击“提取活动”以筛选查询历史记录表。 请参阅 活动详细信息。
Lakebase 自动缩放更新通知现在提前 3 天发布
2026 年 7 月 10 日
为了更快地向项目提供 Postgres 版本更新、安全修补程序和新功能,Lakebase 自动缩放缩短了计划的更新通知窗口。 计划更新现在至少提前 3 天发布,而不是 7 天。 可以检查项目的设置,了解即将进行的更新。
Unity 目录中的机密(公共预览版)
2026 年 7 月 10 日
现在,您可以在 Unity Catalog 中将机密作为可保护对象进行存储、治理和访问。 Unity 目录机密使用三级命名空间(catalog.schema.secret)并受 Unity 目录特权控制,因此可以应用用于其他数据资产的相同访问控制和审核。
现已默认向启用了合规性安全配置文件的工作区提供 Databricks SQL 警报
2026 年 7 月 9 日
Databricks SQL 警报现已支持 Azure Databricks 所支持的所有合规性安全配置文件标准,并且对于启用了合规性安全配置文件的工作区默认可用。
使用 Databricks SQL 警报通过按计划运行查询、评估条件以及满足条件时通知收件人来监视数据和 KPI。
请参阅 Databricks SQL 警报。
与 SAP Business Data Cloud 的专用连接(BDC)
2026 年 7 月 9 日
现在可以使用Azure 专用链接私下连接到 SAP Business Data Cloud (BDC)。 如果贵组织需要专用网络连接,请在创建连接之前,为支持 SAP BDC 共享的存储帐户配置 Azure 专用链接。
Strac 连接器(Beta)
2026 年 7 月 9 日
Strac 连接器现已在 Beta 版 Lakeflow Connect 中提供。 工作区管理员可以从 预览 页控制对此功能的访问。
连接器将数据安全审核事件从 Strac 实例引入Azure Databricks。 身份验证使用 Strac API 密钥。
自定义模型服务端点的 Protobuf 张量输入(公开预览)
2026 年 7 月 9 日
对于具有基于张量的输入签名的自定义模型服务端点,你现在可以将请求正文作为序列化的 KServe v2ModelInferRequest 与 Content-Type: application/x-protobuf 发送,而不再使用 JSON。
此功能为 公共预览版 ,仅在 2026 年 7 月 9 日之后部署的终结点上可用。
Google Gemini 2.5 Flash 计划停用
2026 年 7 月 8 日
Google Gemini 2.5 Flash 将于 2026 年 10 月 2 日停用。 建议的替代是双子座 3.1 专业版或双子座 3.5 闪存。
使用 Unity 目录权限限制对 AI 函数的访问(公共预览版)
2026 年 7 月 8 日
现在可以使用 Unity 目录权限来限制组织可以访问哪些特定于任务的 AI 函数,而不受基础模型访问。 请联系你的帐户团队启用此功能。
Anthropic Claude Sonnet 4 计划退役
2026 年 7 月 8 日
Anthropic Claude Sonnet 4 将于 2026 年 10 月 9 日退休。 Claude Sonnet 4.6 是推荐的替代方案。
Genie Spaces 现已更名为 Genie Agents
2026 年 7 月 8 日
Genie Spaces 现在被称为 Genie Agents。 文档的名称已更改,但产品的功能保持不变。
对象元数据列现在以公共预览版提供
2026 年 7 月 8 日
该 _object_metadata 列现已进入公开预览版阶段。 该 _object_metadata 列是隐藏的元数据列,用于公开云存储中对象的对象级别属性,包括 MIME 类型、ETag、用户定义的键值元数据、系统定义的元数据和对象标记。 它从 Databricks Runtime 18.1 开始可用。
在中国Azure配置无服务器出口控制
2026 年 7 月 7 日
现在可以在由世纪互联(Mooncake)运营的Azure中配置无服务器出口控制,以管理来自无服务器计算的出站网络连接。 无服务器出口控制仅在中国北部 3 区域可用,并且你的工作区必须位于中国北部 3 区域。 请参阅 什么是无服务器出口控制? 以及 管理无服务器出口控制的网络策略。
REPLACE WHERE 流程现已正式发布
2026 年 7 月 7 日
REPLACE WHERE 用于管道和独立流式表的 Flows 现已正式可用。 使用它们在每次刷新时仅替换匹配谓词的行,而无需重新处理整个表的历史记录。
现已默认支持 Excel 文件格式
2026 年 7 月 7 日
Excel文件格式支持现已在所有工作区中默认提供。 无需外部库或手动转换,即可直接使用内置支持引入、分析和查询.xls.xlsx以及.xlsm文件。 请参阅读取和流式传输Excel文件。
托管 Iceberg 物化视图现已进入公开预览阶段
2026 年 7 月 7 日
现在可以创建与外部 Iceberg 读取器兼容的物化视图。 此功能目前以公共预览版提供。 若要启用它,请联系 Databricks 帐户团队。 请参阅 创建与外部 Iceberg 读取器兼容的物化视图。
预算现已正式发布
2026 年 7 月 6 日
现已正式发布预算,包括 Unity AI 网关的预算。
预算允许管理员定义支出阈值。 对于通过 Unity AI Gateway 管理的请求(包括 Genie 交互),管理员可以设置额外的每用户阈值和覆盖设置,并配置诸如电子邮件告警和阻止使用等操作。
请参阅创建和监视预算。
现在支持在作业中刷新物化视图或流式表时使用标准性能模式
2026 年 7 月 6 日
通过 Lakeflow 作业中的 SQL 任务 进行编排的物化视图和流式表刷新操作现在会遵循该作业的 性能优化 设置。 关闭设置后,刷新将使用标准性能模式,这消耗的 DBU 更少。
有关计划刷新的性能模式的详细信息,请参阅 选择计划刷新的性能模式。
Lakeflow Connect 行级筛选现已正式可用
2026 年 7 月 2 日
Lakeflow Connect 中的行筛选现已正式可用。 行筛选允许你仅引入所需的行,方法是应用类似于 SQL WHERE 子句的条件、提高性能和最大程度地减少数据重复。 行筛选在初始加载和后续增量更新期间均适用,SaaS 连接器(包括 Google Analytics、Salesforce 和 ServiceNow)以及所有基于查询的连接器都受支持。
MySQL 集成 CDC 管道现已在 Beta 版中
2026 年 7 月 1 日
适用于 MySQL 的集成 CDC 管道现在处于 Beta 版中。 集成的 CDC 管道使用单个管道将更改数据从 MySQL 引入Azure Databricks,并将提取和应用程序合并到一个管道更新中。 与基于网关的标准体系结构不同,集成 CDC 管道不需要单独的引入网关。
Veeva Vault 连接器(Beta)
2026 年 7 月 1 日
Veeva Vault 连接器现已在 Beta 版 Lakeflow Connect 中提供。 工作区管理员可以从 预览 页控制对此功能的访问。
连接器使用 Veeva 的 Direct Data API 将保管库实例中的所有标准对象、自定义对象、系统表和审核跟踪表引入Azure Databricks。 身份验证通过 Microsoft Entra ID 使用 OAuth 2.0 M2M。