一年前,当云社区聚集在拉斯维加斯参加AWS re:Invent的时候,生成式AI几乎还没有备提及,而本周AWS在年度大会上发布了一系列公告,强调生成式AI将成为其发展的首要任务。

AWS推出了Generative AI Stack,旨在为客户提供利用AI的应用、用于构建大型语言模型的新工具、以及加速模型训练和推理的基础设施成果。
AWS公司首席执行官Adam Selipsky(如图)表示:“围绕生成式AI模型的创新是爆炸性的,将重塑我们在工作和家庭中与之交互的每一款应用。我们正在以一种完全不同的方式来探讨生成式AI这个整体概念。”
广泛的能力
Selipsky在这次re:Invent大会上近两个半小时的主题演讲中,分享了有关生成式AI策略的细节,其中一个重点在芯片领域取得的进展,AWS在现有产品基础上构建了新的生成式AI功能,并继续通过Nvidia和Anthropic PBC等主要合作伙伴追求创新。
Selipsky表示:“拥有最广泛和最深入的能力是很重要的,我们开始利用AWS彻底从头重新思考IT基础设施。”
重新思考IT基础设施的一个关键因素就要涉及到硅。AWS通过Nitro虚拟机管理程序以及后续几代的Trainium、Graviton和Inferentia处理器在硅技术方面取得了不错的成绩。
本周一晚上,AWS公司公用事业计算高级副总裁Peter DeSantis公布了AWS无服务器产品和横向扩展数据库的一系列进展,突出了芯片所发挥的作用。“Nitro是AWS开始构建定制芯片的一个原因,”DeSantis在他的演讲中这样说道。
今天,Selipsky宣布推出了AWS Trainium2,一款用于生成式AI和机器学习训练的专用芯片,以及Graviton4。他还公布了Nvidia扩大合作伙伴关系,其中包括把Nvidia的DGX Cloud人工智能训练即服务平台引入AWS。
“DGX Cloud是Nvidia的AI工厂,”Nvidia公司首席执行官黄仁勋表示,Selipsky邀请他走上re:Invent演讲台发表演讲,他指出,DGX Cloud将有16000个GPU连接到一台超级计算机。“这就像65台超级计算机合而为一。”
ChatGPT的潜在竞争对手
硅芯片这一层的额外火力,最终将催生一系列新产品,而且AWS希望这些产品能够吸引企业的兴趣,并有可能成为OpenAI ChatGPT生成式AI解决方案的替代方案。今天,AWS发布了Amazon Q,这是AWS生成式AI战略的一个关键要素。Amazon Q是一款在工作场所使用的生成式AI助手。该工具的功能还将添加到Amazon QuickSight云原生商业智能服务中,使客户能够为工作场所应用打造量身定制的解决方案,包括通过Amazon Connect进行呼叫中心管理。
AWS分析服务、数据库和AI领导力副总裁G2 Krishnamoorthy在接受媒体采访时谈到Amazon Q to QuickSight在生成式AI堆栈中的应用:“您需要这一层为服务构建者而设计的功能,它就像一个助手,可以帮助你完成各种任务。”
Amazon Q最初主要面向开发人员和IT专业人员,明年可能会被广大企业广泛采用。开发人员能够在几分钟内以对话方式将新功能迭代到代码中。
“Amazon Q也是您的业务专家,”Selipsky说。“它是完全可定制的。”
Amazon Q的可定制性,是AWS寻求部署生成式AI堆栈的一个关键差异化因素。Selipsky表示,客户想要不同的模型,他当然也注意到了OpenAI本月因首席执行官Sam Altman的突然离职和最终回归所引发的一场混乱。
Selipsky说:“不会有一种模式能够统治所有,您需要尝试不同的模型,需要一个真正的模型提供商选项。我认为过去10天发生的事件,已经非常清楚地表明了这一点。”
Selipsky没有直接提及我们熟知的名字,而是在主题演讲中提到了AWS相对于“其他云提供商”的竞争地位。当他宣布AWS在用于生成式AI和机器学习训练的专用处理器方面取得的进展时,这一点尤其引人注目。
“与此同时,许多云提供商只是在谈论他们自己的机器学习芯片,”Selipsky说。
在今天的公告发布之前,AWS在本周一还发布了一系列公告,在第一位主题演讲者上台之前,AWS就已经在re:Invent大会上发布了80多条新闻稿,传递的信息很明确:AWS无意放弃在公有云食物链顶端的地位,并且打算继续发挥自身的优势。
Selipsky表示:“在亚马逊,我们下了大胆的赌注,最重要的重塑都是属于你们的。”
好文章,需要你的鼓励
英国国家医疗服务(NHS)正将无人机纳入常规医疗物流体系。自今年2月起,无人机每天在雷恩斯公园和圣乔治医院之间运送血液等诊断样本,飞行仅需3分钟,比公路运输快约85%,且碳排放减少高达98%。目前已有逾2000名患者受益。NHS计划将该服务扩展至圣赫利尔、克罗伊登等多家医院,最终惠及约180万名患者。该网络由英国医疗初创公司Apian与谷歌旗下Wing合作运营。
AgentLens是Explyt公司联合俄罗斯学术机构开发的AI编程助手评测基准,通过分析完整人机交互轨迹而非仅看最终结果,从五个维度评估代码智能体的真实表现。
边缘AI计算厂商Aetina宣布,将在其DeviceEdge AIE-KT风冷系列和新款AIE-PT无风扇平台上支持英伟达全新Jetson T3000和T2000模块。T3000基于Blackwell GPU,最高提供865 FP4 TFLOPS算力,功耗70W;T2000则提供400 FP4 TFLOPS,面向视觉AI代理和自主移动机器人等场景。两款模块预计2027年第一季度上市,支持Nemotron、Cosmos 3等英伟达AI软件生态。
韩国梨花女子大学提出Splash框架,通过识别AI模型中的"休眠参数"并只在其中训练触觉能力,让小型多模态AI在学会感知材质触感的同时,完整保留原有视觉语言推理能力。