← 主题地图

平台AI化

模型网关、AI 内建功能与治理合并——AI 从外挂变成平台地基

近 7 天收录 31 个事件 · 每 6 小时更新

AWSAmazon OpenSearch ServiceAmplitudeAnthropicBigQueryClaudeClickHouseDatabricksElectricSQLFivetranGoogleGoogle CloudMicrosoftMotherDuckPingCAPPostgreSQLPower BIRipplingSnowflakeTiDBdbt LabsphData华为数澜科技

本主题必读

扩展Claude能力:Skills与MCP协同构建智能体2026-08-11加拿大大型铁路用Databricks Genie Code将管道创建自动化率提至90%2026-08-13Agentic AI 架构为何需要数据库,不只是向量存储2026-07-31开源数据层将赢得AI未来2026-08-06构建医疗AI无需重建数据平台2026-08-10Snowflake CoCo跨区域推理配置与合规指南2026-08-13AI时代,数据中台焕发新生?2026-08-12跨区域推理:是什么,启用它实际涉及什么2026-08-13如何在APJ为CoCo配置跨区域推理2026-08-14AI加速数据使用,Dataverse助力数据治理准备2026-08-11完整Agent状态栈:内存、文件与Serverless数据库持久化2026-08-07Databricks谈大规模AI编码成本管理2026-08-07
8月14日3 个事件
RSSSnowflake Engineering (Medium)21 小时前 54

如何在APJ为CoCo配置跨区域推理

Snowflake 官方博客介绍了在亚太(APJ)区域为 CoCo 配置跨区域推理(CRI)的方法。许多模型未在悉尼、东京、新加坡等区域原生部署,因此需要跨区域调用。通过设置 CORTEX_ENABLED_CROSS_REGION 参数为 AWS_APJ、AWS_AU 或 AWS_JP 等区域限定值,可以仅允许流量在亚太区域内经过云厂商私网传输,从而满足数据驻留审查要求。

推荐理由:面向数据平台管理员的安全配置实践,涉及数据驻留与跨区域推理边界,对使用 Snowflake AI 功能的从业者具有直接参考价值。
平台AI化Snowflake
官网Amplitude Blog19 小时前 54

Amplitude发布Code Mode与Data Assistant Agent,用AI解读指标变化

Amplitude发布两个AI能力:Code Mode和Data Assistant Agent。Code Mode让团队用SQL与Python深入分析行为数据,回答指标为何变化、哪些用户受影响、下一步该做什么,示例中产出23%转化率提升的洞察;Data Assistant Agent则识别并优先处理数据质量问题,增强分析可信度。原文还援引Anthropic 2026年6月报告,称用户认为AI最缺的是判断力与情境推理,Amplitude将此视为下一个要解决的问题。

推荐理由:展示如何把AI编码分析和数据质量校验结合,帮助团队从“看指标”迈向“理解指标因果”,对数据产品和BI团队有参考价值。
RSSSnowflake Engineering (Medium)周四 22:01 精选 60

Snowflake AI函数消除80%自定义管道代码

Snowflake AI Functions将文本分类、实体提取、情感分析等数据丰富任务从传统的Python脚本、外部API和编排工作流中抽离,合并为一条SQL语句。据称可减少80%的自定义管道代码,数据无需离开仓库,也无需管理API密钥和编排层。数据工程师可直接在Snowflake内完成文本增强,大幅简化管道架构。

推荐理由:数据从业者可了解平台内置AI函数如何简化数据管道,减少外部依赖与运维成本。
平台AI化Snowflake
8月13日4 个事件
RSSDatabricks Blog周四 00:35 精选 51

加拿大大型铁路用Databricks Genie Code将管道创建自动化率提至90%

加拿大最大铁路网络之一运营约2万英里线路,年承运货物价值超2500亿加元。其数据团队借助Databricks Genie Code、Unity Catalog、自定义Agent Skills及Databricks Apps上的Streamlit应用,将管道开发变成可复制的工厂:一段YAML提示即可生成生产级摄取代码,涵盖表定义、历史加载、流式摄入、增量合并和自动化测试。结果新表摄入自动化率超过90%,管道交付从数天压缩至数分钟。

推荐理由:数据从业者可借鉴如何用AI Agent与元数据驱动大规模数据管道现代化,降低手工重复开发。
RSSSnowflake Engineering (Medium)周四 02:55 49

Snowflake CoCo跨区域推理配置与合规指南

CoCo依赖跨区域推理运行,但安全团队可能担心数据离开欧盟。通过设置CORTEX_ENABLED_CROSS_REGION参数为AWS_EU或AZURE_EU,可将流量限制在欧盟区域,且走云厂商私有骨干。需注意参数默认值可能因账户创建时间而异,且显式禁用会覆盖默认设置。本文给出账户级配置命令及审查要点。

推荐理由:数据从业者需理解AI功能跨区域推理的配置方式,以应对数据驻留与安全审查。
平台AI化Snowflake
RSSSnowflake Engineering (Medium)周四 02:55 47

跨区域推理:是什么,启用它实际涉及什么

Snowflake CoCo依赖跨区域推理(CRI)才能访问前沿AI模型和完整Cortex AI产品;若账号级参数禁用,开发者打开CoCo将无响应。启用CRI有四个关键点:区域限制来自云提供商、数据不经过公共互联网、可保留推理在本区域、启用不会改变账单。例如,将CORTEX_ENABLED_CROSS_REGION限定为同一云提供商,推理流量走AWS或Azure私有骨干而非公共互联网。该限制本质由云提供商的区域容量和模型部署范围决定。

推荐理由:数据从业者需要理解Snowflake跨区域推理的配置影响,尤其是数据合规、区域可用性和Cortex AI启用前提,以便规划平台AI化落地。
平台AI化Snowflake
RSSMicrosoft Power BI (Power Platform Blog)周二 22:00 40

AI加速数据使用,Dataverse助力数据治理准备

AI增加了业务数据的规模、价值和用途。Dataverse为管理员提供容量、保留、安全、审计和恢复等管理控制。文章以制造商在采购、财务和供应链中使用AI为例,说明管理员需支撑交易量和数据增长,并回答哪些环境与表在增长、哪些记录需保留、谁能访问、能否恢复等实际问题。文章强调数据所有权、访问模型、生命周期和定期复核是AI时代数据治理的基础。

推荐理由:数据从业者应关注AI落地对数据治理提出的新要求:自动化Agent持续读写数据时,容量、权限、保留和审计成为必须解决的实操问题。
平台AI化MicrosoftPower BI
8月12日13 个事件
RSS爱分析收录 08-12 46

AI时代,数据中台焕发新生?

数澜科技创始人甘云锋在接受爱分析访谈时表示,“拆中台”是个误会,AI兴起后数据中台窗口重新打开。他认为数据基座的核心目标是持续输出高质量数据集,本体与语义层是企业AI消除歧义、降低幻觉的关键。数澜从高峰期500人缩减至几十人后,如今定位为“数据+AI”公司,专注数据基座、行业模型和数据智能体,服务军工、央国企及大型民企客户。

推荐理由:数据从业者应关注数据中台向AI数据基座演进的路径,以及本体语义层在企业级AI中的落地价值。
RSSAWS Big Data Blog周三 02:29 44

GPU加速在Amazon OpenSearch Service上构建十亿级向量索引

Amazon OpenSearch Service和OpenSearch Serverless现已支持GPU加速的向量k-NN索引,可将十亿级向量索引构建时间从数天缩短到数小时。本文深入介绍了解耦的GPU架构、CAGRA到HNSW的转换过程,以及基于十亿个1024维向量的基准测试。该能力基于NVIDIA cuVS库,在GPU构建索引的同时,现有CPU基础设施可继续提供搜索服务。文章还分享了生产环境运行GPU加速索引构建的最佳实践。

推荐理由:向量索引是大规模AI应用的关键基础设施,GPU加速方案能显著降低索引构建时间和成本,数据平台从业者应关注其架构与生产实践。
平台AI化AWSAmazon OpenSearch Service
RSSTiDB Blog07-31 精选 38

Agentic AI 架构为何需要数据库,不只是向量存储

TiDB工程师在SCaiLE Europe 2026上论述,单独的向量数据库并非AI应用的必要代价,而是数据同步约束下的变通方案。每个新增AI组件都会复制一份数据,带来独立的接入路径、运维和同步任务,导致栈越堆越复杂。TiDB通过同一Raft流同步行存储、列存储、向量索引和全文索引,由SQL优化器决定查询走哪个存储。文章认为分布式SQL原生支持向量搜索与分析能力,可减少数据漂移和多系统运维成本。

另有 1 家信源报道:TiDB Blog
推荐理由:数据从业者关注的多系统同步与数据一致性痛点,本文给出分布式数据库一体化方案,对构建Agentic AI数据栈有参考价值。
RSSTiDB Blog08-07 30

完整Agent状态栈:内存、文件与Serverless数据库持久化

TiDB博客文章指出,AI应用需要四种持久化层:Agent记忆、生成文件、操作状态和检索数据。无服务器数据库能自动扩缩容、按用量计费并支持缩容到零,适合突发流量。文章建议评估引擎而非标签,重点关注连接行为和冷启动,并认为分散的技术栈会累积问题,单一引擎可消除系统边界和一致性缺陷。

推荐理由:数据库从业者可借此理解AI应用对数据持久化的新需求,以及Serverless数据库在Agent场景中的适配逻辑。
平台AI化PingCAPTiDB
RSSTiDB Blog08-07 28

TiDB SCaiLE 2026:AI Agent 时代,数据库复杂性不变但节奏更快

TiDB SCaiLE 2026 将于10月15日在美国山景城计算机历史博物馆举行,会议分为 AI-Native 与 Enterprise 两大 track。Manus 迁移至 TiDB Cloud 后三个月内接近 100 万数据库租户,超过 90% 的新集群由 Agent 创建。Atlassian 将 750 多个 PostgreSQL 集群整合到 16 个 TiDB 集群,承载超 300 万张表。议程强调真实生产数字与权衡,包括评估后未选择 TiDB 的团队分享。

推荐理由:AI Agent 正在改变数据基础设施的负载模式,数据库的并发、多租户和上下文管理成为新挑战,本文可帮助数据从业者了解生产级应对方案。
RSSTiDB Blog08-06 33

开源数据层将赢得AI未来

AI改变了重写应用代码的成本,但持久化数据层的迁移成本依然高昂。封闭数据平台会让路线图、定价和部署选择受制于人,而开源数据层能保留关键控制力。TiDB 已被 Kimi、Pinterest、Atlassian、Dify 等用于生产负载,证明开放性与规模化并非取舍。

推荐理由:数据从业者可借此评估AI时代数据平台选型,理解开放数据层在避免锁定和保持控制权方面的战略价值。
平台AI化PingCAPTiDB
收录DataHot 精选周二 22:03 55

ElectricSQL加入Databricks,为AI Agent沙箱带来WASM Postgres

PGlite开发方ElectricSQL加入Databricks,双方计划把WASM Postgres带入AI Agent沙箱。每个Agent可在自己的运行环境中获得低延迟本地数据库,并通过同步引擎连接中心状态。这让Databricks的Postgres能力从湖仓进一步延伸到边缘和Agent运行时。

另有 1 家信源报道:X 线索·@databricks
推荐理由:AI Agent正在形成独立的运行时数据层,PGlite与实时同步的组合值得数据平台和Agent基础设施团队持续关注。
Data Agent平台AI化DatabricksElectricSQL
收录DataHot 精选周日 23:52 48

Databricks称专用数据Agent比通用Coding Agent更准更省

Databricks用401个真实内部任务对Genie Code与三款通用Coding Agent进行评测。厂商公布的结果显示,Genie Code准确率为76.6%,平均每项任务成本0.55美元,正确答案成本不到最接近对手的一半。该结果属于Databricks自建基准,应结合评测设计审慎解读。

另有 1 家信源报道:X 线索·@databricks
推荐理由:这是少见的专用数据Agent与通用Coding Agent成本、准确率同场比较,能帮助团队理解语义搜索和企业上下文的实际价值。
收录DataHot 精选周三 03:00 53

pg_clickhouse 0.10增强查询下推,TPC-H Q17降至37毫秒

pg_clickhouse 0.10加入相关子查询下推、重构的纯C驱动和更多聚合函数。在22个TPC-H查询中,已有16个可完整下推;官方给出的Q17结果从32.7秒缩短到37毫秒。版本继续强化PostgreSQL查询ClickHouse时的透明加速能力。

另有 1 家信源报道:X 线索·@ClickHouseDB
推荐理由:查询下推覆盖率直接决定PostgreSQL与ClickHouse组合方案的实用性,这次升级包含可量化的性能进展。
实时分析平台AI化ClickHousePostgreSQL
收录DataHot 精选08-03 43

ClickHouse成立基础数据库研究团队ClickHouse Labs

数据库研究者Andy Pavlo加入ClickHouse并担任数据库研究副总裁,ClickHouse同时成立ClickHouse Labs。团队计划把研究成果放到ClickHouse、PostgreSQL等真实负载中验证,并以论文和开源成果的形式公开。

另有 1 家信源报道:X 线索·@ClickHouseDB
推荐理由:数据库厂商重新建立面向基础研究的长期团队,可能影响查询优化、存储引擎和AI时代数据库架构的演进。
数据人平台AI化ClickHousePostgreSQL
收录DataHot 精选周二 00:20 48

数据Agent将制造机器查询洪峰,传统数仓面临新负载

MotherDuck认为,LLM最近半年才开始较稳定地生成SQL,数据Agent并没有错过窗口。新的挑战是Agent会在很短时间内发起大量探索和验证查询,而传统数仓主要围绕人工交互与定时任务设计,需要重新考虑并发、隔离和成本控制。

另有 1 家信源报道:X 线索·@motherduck
推荐理由:这条观点把讨论从‘Agent能否写SQL’推进到‘数据平台能否承受机器规模的查询行为’,对容量规划很有启发。
收录DataHot 精选周一 23:10 48

dbt State让Fivetran单个模型运行时间从40分钟降到40秒

dbt State会结合metadata和模型SQL判断上游数据或代码是否变化,只构建需要更新的节点,其余节点复用、克隆或自动延迟到生产状态。Fivetran案例中,一个模型的运行时间从约40分钟降至40秒,体现状态感知执行对成本与迭代速度的价值。

另有 1 家信源报道:X 线索·@getdbt
推荐理由:状态感知构建能直接降低无效计算,适合关注数据工程效率、云数仓成本和开发反馈周期的团队。
平台AI化dbt LabsFivetran
RSSGoogle BigQuery Release Notes周三 15:00 精选 55

BigQuery支持Gemini 3.1 Flash Lite与3.5 Flash GA模型

BigQuery宣布正式支持gemini-3.1-flash-lite和gemini-3.5-flash GA模型,适用于us、eu及global多区域端点。用户可在所有生成式AI函数中使用这些模型。该更新源自BigQuery官方发布说明。

另有 2 家信源报道:Google BigQuery Release Notes · Google BigQuery Release Notes
推荐理由:数据从业者可在BigQuery内直接调用最新Gemini模型进行生成式分析,降低AI功能集成成本。
平台AI化GoogleBigQueryGoogle Cloud
8月11日3 个事件
官网Claude 官方博客收录 08-11 精选 48

扩展Claude能力:Skills与MCP协同构建智能体

Anthropic于2025年12月19日发布文章,介绍如何结合Skills和MCP构建遵循工作流程的智能体。MCP负责连接外部工具,Skills则教导Claude如何高效使用这些工具。例如,通过MCP连接Notion并添加会议准备技能,Claude能自动提取相关页面并按团队标准格式化文档。文章还发布了Agent Skills开放标准,旨在实现跨平台的可移植性。

推荐理由:该文章详细解析了MCP与Skills的互补关系,对构建代理的数据平台和Agent开发者具有直接指导意义。
Data Agent平台AI化AnthropicClaude
官网Claude 官方博客收录 08-11 37

Claude Enterprise新增分析与成本控制功能

Anthropic为Claude Enterprise推出更丰富的管理员分析、模型级权限和支出警报。新增仪表板可按组和用户查看使用与成本,并显示工件创建、文件编辑等输出及其成本。Claude Code控制台新增价值和使用两个标签页,提供活跃开发者、会话数和常用命令,并估算生产力提升和每次提交成本。分析聊天支持自然语言提问并生成可导出的图表。

推荐理由:企业级AI平台增强可观测性与成本治理,数据分析从业者需了解其能力边界以评估数据场景落地。
平台AI化AnthropicClaude
RSSdbt Blog周二 03:03 41

dbt Summit 2026主题演讲与产品议程

dbt Labs宣布dbt Summit 2026将于9月15-18日在拉斯维加斯Cosmopolitan举行,重点围绕AI时代的数据基础展开。峰会设有两个主旨演讲和四大支柱议题,包括升级引擎、为AI升级、用AI升级等方向。文章强调,许多组织的数据尚未达到可支撑AI代理的水平,而dbt正在帮助团队弥合这一差距。

推荐理由:dbt是数据工程与治理关键工具,其年度峰会内容反映了数据平台如何为AI代理时代重构,值得数据从业者关注。
8月10日5 个事件
RSSInfoQ 中文周一 23:24 精选 42

华为重定义存储:推AI数据中心五层架构

华为在2026数据存储用户精英论坛上提出AI数据中心数据基础设施五层架构,涵盖AI数据湖、AI数据平台、算力、模型和Agent。为应对大规模推理与Agent落地,华为推出业界首个面向大规模推理的上下文记忆存储CMS(G3.5存储),置于HBM/DRAM与共享存储之间,支持构建PB级共享KV Cache池。华为表示战略方向未变,而是将单点能力整合为全栈方案,存储正进入模型推理路径。

推荐理由:AI推理和Agent规模化落地正在改变数据基础设施架构,存储层创新直接关系到AI数据平台与Agent应用的性能与成本,数据从业者应关注。
RSSFivetran Blog周一 22:20 40

构建医疗AI无需重建数据平台

Fivetran与phData联合发文,指出充分利用AI需要自动化数据集成、上下文工程和代理化基础设施。文章提到37%的医院处于亏损或低利润运营,Fivetran的Epic EMR连接器帮助Inova Health和Sharp Healthcare等机构保持医疗数据AI就绪、合规且可访问。通过现代化的AI-ready数据基础,医疗机构可在临床文档、预测性患者监测、诊断影像等领域部署AI。

推荐理由:数据从业者可了解医疗行业如何在不重构数据平台的前提下,通过集成与治理能力支撑AI应用,是数据平台AI化的落地案例。
平台AI化FivetranphData
RSSInfoQ 中文周一 22:26 精选 47

33%增速、126%留存:Snowflake财报展现AI落地故事

Snowflake 2027财年第一季度收入达13.91亿美元,同比增长33%,产品收入13.34亿美元,同比增长34%,净收入留存率达126%。超过1.36万个账户使用其AI能力,AI编程工具CoCo进入7100多个账户。财报显示AI正成为推动数据平台消费增长的新引擎,而非独立核算的新业务。

推荐理由:Snowflake财报显示AI能力正转化为数据平台的实际消费增长,是数据平台AI化的重要风向标,值得数据从业者关注。
平台AI化Snowflake
官网Claude 官方博客周一 10:34 38

Claude推出MCP Apps交互式连接器

Anthropic宣布在Claude中引入MCP Apps,用户可直接在对话中打开并操作Asana、Slack、Figma等工具。该功能支持实时协作,例如在Amplitude中构建分析图表并调整参数,或在Box中预览文档并提取洞察。MCP Apps将工具变成交互式连接器,无需切换标签页即可完成项目管理和可视化任务。

推荐理由:数据从业者可通过Claude的交互式连接器直接操作分析工具,提升数据探索与协作效率,是Data Agent与平台AI化的重要实践。
Data Agent平台AI化AnthropicClaudeAmplitude
官网Snowflake Release Notes周一 01:32 39

Snowflake 10.24 版本发布:新增每用户配额与语义视图物化

Snowflake 发布 2026 年 7 月 9 日至 15 日的 10.24 版本说明,新增每用户配额(Preview)功能,可对 AI 功能如 Cortex Agents、Snowflake CoWork 和 CoCo 设置用户级消费上限。同时,语义视图物化(Public preview)上线,支持物化常用维度和指标以预聚合数据、提升查询性能。

推荐理由:语义视图物化直接关系到语义层与查询性能优化,每用户配额则涉及 AI 数据平台成本治理,均为数据从业者关注的关键能力更新。
8月8日1 个事件
RSSTechCrunch AI周六 05:30 31

Rippling推AI支出控制台,追踪员工AI投入产出

HR软件商Rippling发布AI Spend Console,用于追踪和控制企业AI支出,可查看员工、团队及角色的花费与生产力。此前Rippling因AI支出失控,3月时预计将消耗R&D人力预算的40%,月度增长80%。该工具还能识别高AI花费但代码常被返工的工程师。

推荐理由:企业AI支出正成为数据驱动管理的新痛点,该产品展示了如何用数据分析工具治理AI成本与ROI,值得数据从业者关注。
平台AI化Rippling
8月7日2 个事件
RSSDatabricks Blog08-07 25

Databricks谈大规模AI编码成本管理

Databricks博客指出,AI编码工具虽能带来数量级效率提升,但成本指数增长不可持续。为兼顾广泛访问与成本可控,他们与Stripe、Coinbase、Uber、Ramp等企业交流,总结出多项成本管理技术,并开源了Omnigent和Unity AI Gateway等关键组件。

推荐理由:数据从业者可从头部数据平台的实际经验中,了解AI编码及Agent场景下的成本控制方法,对构建数据Agent和AI数据平台有直接借鉴意义。
平台AI化Databricks
RSSSnowflake Engineering (Medium)08-07 精选 40

Snowflake AIM:将数据迁移从数年缩短至数周

Snowflake 推出 AIM,提出数据工程的未来是自主化。文章指出数据仓库迁移的真正难点不在于 SQL 复杂,而在于流程冗长、环节众多,且依赖人工维护清单和记忆。传统方式用 Excel 跟踪迁移进度,有人要反复手动运行 SQL Server 导出脚本,几周后清单就会过期并造成混乱。AIM 针对这一场景,试图让迁移过程更自主可控。

另有 1 家信源报道:Snowflake Engineering(Medium)
推荐理由:数据从业者应关注 Snowflake 如何将自主化引入数据仓库迁移,这类工具可能重塑上云迁移的项目交付方式。
平台AI化Snowflake