至顶网软件频道消息: 微软在公布预览的时候将这个第二代版本称为“不折不扣的数据湖”。据悉,Azure Data Lake是微软用于云中大数据分析工作负载的存储库。

Azure Data Lake Storage Gen2将第一代Azure Data Lake的核心功能与兼容Hadoop的文件系统端点(直接集成到Azure Blob Storage)进行了统一。
微软在一篇博客文章中解释说:“这些增强功能将对象存储的规模和成本优势与通常只和本地文件系统相关联的可靠性及性能相结合。这个新的文件系统包括一个完整的分层命名空间,让文件和文件夹优先级最高,转化为更快速、更可靠的分析任务执行。”
Gen2还为客户带来“无限存储”以及与Azure Active Directory的本地集成。
微软在2015年宣布了Azure Data Lake Service的初始计划。第一代Azure Data Lake旨在与HDInsight配合,这是微软针对Windows和Linux的Hadoop-onAzure服务。 最初Azure Data Lake是建立在微软内部“Cosmos”大数据存储和分析服务基础之上的。
除此之外,微软还宣布推出了Azure Data Factory V2的几项新功能,包括支持控制流数据管道结构;无码数据迁移和编排设计;灵活调度。
据悉,Azure Data Factory是一种混合数据集成(ETL)服务。将通过与世纪互联的合作在中国现有两个Azure区域基础上再增加两个。
好文章,需要你的鼓励
穆拉蒂时隔18个月首次接受重大媒体采访,介绍其创立的Thinking Machines Lab正在开发的"交互模型"。该模型能以200毫秒间隔处理音频、文本和视频流,捕捉人类交流中的中断、修正和停顿。她还谈及OpenAI"政变周"经历,强调行业决策权过于集中的担忧,并回应了公司近期研究人员离职问题,表示这是初创实验室的正常波动。
STATE16研究院这篇综述发现,物理AI系统存在"静默失效"风险——AI以高度自信执行基于错误世界信息的动作,却不触发任何报警,并提出在AI输出与物理执行之间建立独立授权层的框架。
本期《Quick Charge》播客涵盖多个热点话题:特斯拉疑似试图删除FSD欺诈相关证据以规避巨额赔付;卡特彼勒持续推进建筑领域电气化布局;住宅太阳能30%税收抵免即将到期。此外,嘉宾Tom Pacheco就高压系统与电池技术培训展开探讨,强调电动车技术人才培养的紧迫性。节目同时提醒有意安装太阳能的用户尽快行动,可通过EnergySage平台比较多家安装商报价。
UIUC与微软联合研发的OpenWebRL框架让4B小模型仅凭400条初始数据,通过在真实网站上边做边学的强化学习方式,在网页智能体基准上超越了用27万条数据训练的竞争对手。