08:00Databricks数据工程Databricks 开放查询历史系统表,慢查询排查有了新入口Databricks 的查询历史系统表正式可用,查询运行记录有了可直接分析的数据入口。# 数据平台# 工程实践
08:00Databricks数据工程Databricks Apps 遥测功能正式上线Databricks Apps 的遥测能力正式可用,应用的追踪、日志和指标可以写入 Unity Catalog 表,并支持通过 OpenTelemetry SDK 补充自定义埋点。# 数据平台# 工程实践
08:00Databricks数据工程Genie One 技能现支持多个文件与文件夹Genie One 的技能现在可以包含多个文本文件和子文件夹,最多三级目录、50 个文件或文件夹,不必把所有说明挤进单个文件。# 数据平台# 工程实践
08:00Databricks数据工程元存储级 ABAC 策略进入 BetaUnity Catalog 的 ABAC 策略进入元存储级 Beta:行过滤、列掩码和授权规则可以一次设在更高层级,覆盖现有及后续创建的目录。# 数据平台# 工程实践
08:00Databricks数据工程Moonshot AI 的 Kimi K2.7 将停止服务Databricks 提醒,Moonshot AI 的 Kimi K2.7 计划在 2026 年 10 月 30 日停止服务,并建议迁移到 Kimi K3。# 数据平台# 工程实践
08:00Databricks数据工程经典计算现支持基础环境(Beta)Databricks 经典计算环境开始支持基础环境(Beta),可以用平台提供或工作区自定义的环境来管理 Python 依赖。# 数据平台# 工程实践
23:19AWS Big Data数据工程在 SageMaker Unified Studio 中发现与治理 Snowflake 数据AWS 展示如何把 Snowflake 接入 SageMaker Unified Studio:不搬动原始数据,也能统一编目、做联邦查询和数据质量检查。# 数据平台# 工程实践
08:00Databricks数据工程Databricks 提醒:GovCloud IL5 工作区移除 Anthropic 模型Databricks 的公告将 9 月 19 日列为调整日期:选择 DoD IL5 合规标准的 AWS GovCloud 工作区将无法创建或使用 Anthropic 模型端点,受影响的工作负载需要迁移到其他受支持模型。# 数据平台# 大模型
04:55AWS Big Data数据工程将 SageMaker Unified Studio 连接至 Power BI(上):基于 IAM 身份中心的域AWS 给出 Power BI 连接 SageMaker Unified Studio 受管数据的做法。上篇聚焦 IAM Identity Center 域,可直接用 Athena ODBC 驱动连接,不再需要第三方桥接。# 数据平台# 工程实践
04:55AWS Big Data数据工程将 SageMaker Unified Studio 连接至 Power BI(下):基于 IAM 的域这组教程的下篇转向 IAM 域,说明如何通过 Athena ODBC 驱动与相应身份配置,让 Power BI 访问 SageMaker Unified Studio 中的数据。# 数据平台# 工程实践
23:59AWS Big Data数据工程联合航空打通 Redshift 与 Databricks,查询数据不用再复制联合航空通过 AWS Glue Data Catalog 联邦,让 Redshift Serverless 查询 Databricks Unity Catalog 管理的数据,不必再复制一份。# 数据平台# 工程实践
23:36AWS Big Data数据工程Kinesis 按需流新增容量缩减能力,流量高峰过后不用一直撑着Kinesis Data Streams 的按需 Advantage 流现在支持缩减预热吞吐容量。流量高峰过去后,可以监控使用情况并释放多余容量。# 数据平台# 工程实践
00:06AWS Big Data数据工程从 CloudSearch 迁到 OpenSearch Serverless,需要做哪些准备AWS 梳理 CloudSearch 迁移到 OpenSearch Serverless 的步骤:先评估配置,再调整索引映射、查询语法和权限,导入数据后做切换前验证。# 数据平台# 工程实践
00:05AWS Big Data数据工程用 Iceberg 物化视图加速 Spark 查询,不用改业务 SQLAWS 展示如何让 EMR 与 Glue 利用 Iceberg 物化视图自动改写查询计划,加速重复的 Spark 分析查询,而不要求业务重写 SQL。# 数据平台# 工程实践
23:14AWS Big Data数据工程AWS 将 Redshift 数据分析接入 ChatGPT WorkAWS 发布面向 ChatGPT Work Data agent 的数据分析插件。团队可以在对话中查询 Redshift 数仓和数据湖中的受治理数据,完成分析并生成可分享的仪表盘。# 数据平台# 智能体
01:38AWS Big Data数据工程AWS Glue 6.0 支持声明式 Spark 数据管道Glue 6.0 引入 Spark Declarative Pipelines。官方教程用单个作业将原始订单依次处理为 Bronze、Silver 和 Gold 层的数据表,完成校验与聚合,无需另写编排逻辑。# 数据平台# 工程实践
00:46AWS Big Data数据工程AWS 连续 16 年位列 Gartner 云平台服务领导者象限AWS 表示,在 Gartner 2026 年战略云平台服务魔力象限报告中,公司连续第 16 年被列入领导者象限,并在执行能力维度位列最高。# 行业动态
00:43AWS Big Data数据工程Sony LIV 用 Kinesis、EMR 与 Iceberg 构建实时视频分析AWS 介绍 Sony LIV 的实时分析架构:结合 Kinesis Data Streams、Amazon EMR 和 Apache Iceberg,持续处理视频平台的流式数据,为理解观众使用情况提供支持。# 数据平台# 工程实践
05:35AWS Big Data数据工程企业 Agent 如何跨系统访问数据?AWS 给出三种架构AWS 介绍利用 MCP 服务与 Bedrock AgentCore 实现数据联邦访问的三种模式:目录优先、直接访问数据源,以及混合访问。目标是让 Agent 在数据原有位置获取信息,减少对数据工程师中转的依赖。# 智能体# 数据平台# 工程实践
00:26AWS Big Data数据工程新一代 OpenSearch Serverless 的九种私网连接方式新一代 OpenSearch Serverless 使用 on.aws 域名上的标准 AWS PrivateLink 端点。官方整理了单 VPC、多 VPC、跨账号、本地机房及跨区域等九种连接模式,并说明对应的 DNS 解析和数据路径。# 工程实践
00:23AWS Big Data数据工程Moovit 改造多引擎湖仓,数据管道成本降低 33%据 AWS 案例,Moovit 将重聚合任务从 Redshift 分流到 EMR 的 Spark SQL,并利用 Redshift Serverless 隔离工作负载。完成多引擎湖仓改造后,整体数据管道成本降低了 33%。# 数据平台# 工程实践