近日,亚马逊网络服务公司宣布位于阿布扎比的技术创新研究所(TII)已经在云提供商的基础架构上完成了大型语言模型Falcon 40B的训练。
这标志着AWS和TII之间合作的一个重要里程碑,AWS和TII都在试图拓展人工智能研究和开发的边界。Falcon 40B模型具有400亿个参数容量,具备很高的性能和准确度,在Hugging Face的Open LLM Leaderboard排行榜上拔得头筹。
现在可以通过Amazon SageMaker JumpStart使用Falcon 40B,据称它为希望使用最先进的语言模型而又不想自己从头开始进行搭建的企业和组织开辟了一种新的可能。客户可以通过Amazon SageMaker访问Falcon 40B,使用翻译、问题回答、总结和图像识别等功能。
2023年6月,人工智能成了最热门的东西,纳斯达克指数飙升,投资者的资金涌向任何拥有.AI域名或者声称在使用AI的公司。
AWS虽不是一家人工智能创业公司,但它紧密关注着人工智能和大型语言模型,并致力于成为该领域的领导者。随着Falcon 40B模型在AWS上训练成功,亚马逊证明自己正在致力于成为人工智能和LLM的领导者。
除了Falcon 40B的消息之外,AWS还宣布扩大与印度数字服务公司Persistent Systems的合作关系,后者主要服务于银行和金融服务业。
根据双方拓展的合作,Persistent Systems将使用Amazon CodeWhisperer,让其开发人员生成带有注释的代码,帮助他们绕过耗时的开发任务,加速创建新的解决方案。
2022年6月,亚马逊推出了CodeWhisperer,这是一项人工智能服务,可以提供编码帮助。AWS表示,它已经用来自开源项目、内部代码库和其他来源的数十亿行代码对CodeWhisperer进行了训练。该服务能够一次生成超过10行代码。
好文章,需要你的鼓励
企业AI搜索公司Glean宣布年度经常性收入(ARR)达3亿美元,较15个月前的1亿美元增长三倍。尽管谷歌、微软、OpenAI等科技巨头纷纷入局企业AI搜索市场,Glean凭借"上下文图谱"技术深度理解企业业务需求,并帮助客户显著降低AI计算成本。该公司提供按用量计费和混合定价两种模式,客户涵盖Databricks、Reddit、Pinterest及三星等企业。Glean上轮融资后估值达72亿美元。
香港中文大学与MiniMax提出ClaimDiff-RL框架,将图像描述的AI训练从整体打分升级为逐条核查,有效解决了传统方式导致AI"少说保平安"的问题,同时在多项基准测试上超越Gemini-3-Pro-Preview。
杰夫·贝索斯旗下的蓝色起源公司在佛罗里达卡纳维拉尔角进行静态点火测试时,新格伦重型火箭发生爆炸。这是美国历史上最大规模的火箭爆炸之一,也是蓝色起源公司遭遇的最严重失败。所有人员安全,但该事故可能导致新格伦火箭项目长期暂停。此前该火箭已成功完成三次发射,并实现了助推器回收和重复使用。
ParaVT是一个由南洋理工等多校联合提出的并行视频工具调用框架,通过让AI同时分析多段视频并引入PARA-GRPO算法解决训练中的格式崩溃与工具跳过问题,在六项长视频理解测试中平均提升约7.9%。