Nvidia推出PAIR软件,助力本地搭建AI计算集群
Nvidia发布免费测试版工具PAIR,可连接Windows、macOS、Linux设备组成AI推理集群,支持DGX Spark及RTX GPU设备协同处理任务。
Nvidia发布免费测试版工具PAIR,可连接Windows、macOS、Linux设备组成AI推理集群,支持DGX Spark及RTX GPU设备协同处理任务。
llm-d在544块H100 GPU上部署7530亿参数的GLM-5.2模型,通过前缀感知路由、KV缓存分层等技术,支持3000个并发编码智能体零抢占运行,成本较商业API低5-10倍。
数据中心GPU物理寿命通常可达五年以上,但经济寿命受性能迭代影响仅约2至4年,企业需权衡升级与转售策略,二手市场可回收原值10%至20%。
小米在华发布SkyNomad增程SUV系列,共四款车型,起售价209900元人民币,低于理想和问界同级车型。该系列搭载昆仑平台,全系标配英伟达Thor芯片、激光雷达等辅助驾驶硬件,最高续航达1705公里,并推出配备电动天...
Nvidia发布免费测试版工具PAIR,可将同一网络内不同的PC设备连接组成AI推理集群,支持Windows、macOS和Linux系统。该工具主要面向家庭用户,但也可用于企业闲置桌面算力,兼容DGX Spark超级计算...
英国AI基础设施初创公司Nscale成立仅两年,据悉最快本月晚些时候上市。上市前,该公司正洽谈额外融资35亿美元,包括向投资者出售15亿美元可转换票据,并向英伟达寻求20亿美元投资。此前英伟达已参与其3月完成的11亿美元...
Hot Chips 2026大会上,OpenAI、英特尔、Meta等公司展示了多款新型AI芯片,主打更低成本、更快速度和更低功耗,芯片厂商也在推动AI从GPU向CPU、PC端迁移。分析人士指出,Nvidia之外的市场正变...
本周AI领域动态频繁:OpenAI为Astra模型增设安全防护措施;美国政府就AI训练版权"合理使用"问题表态支持OpenAI;英伟达计划以130亿美元收购开源模型平台Hugging Face;谷歌新模型Gemini 3...
英伟达发布免费开源工具PAIR,可自动发现并连接家中闲置的电脑(GeForce GPU、RTX Pro、DGX Spark及苹果M4芯片设备),在设备空闲时协同处理本地AI推理任务,支持Ollama、LM Studio等...
英伟达宣布以129亿美元收购开源AI平台Hugging Face,此举标志着这家芯片巨头进军AI操作系统领域。分析师认为该交易或将为企业带来更强的平台可靠性、模型评估工具和安全资源,同时保持Hugging Face作为开...
英伟达证实以约129亿美元收购Hugging Face,该平台是研究人员分享开源AI模型的类GitHub平台,托管超50万数据集及200万模型。分析认为此举助英伟达洞察客户偏好与技术趋势,并布局小型专业化模型市场,而非单...
英伟达宣布以129.3亿美元收购Hugging Face,承诺保持其品牌独立与开放中立。此举旨在强化开放模型的分发与工具层建设,加速企业AI落地,同时巩固英伟达从芯片商向开发者平台与生态公司的转型,但外界仍关注其能否真正...
现代AI平台需要跨多集群、多云环境传递用户身份,而非依赖单点SSO。文章介绍了一种中心化身份网关模式:由统一身份网关负责会话创建与生命周期管理,各区域网关通过共享验证接口确认会话并注入可信身份信息。NVIDIA采用该方案...
英伟达宣布以130亿美元收购AI模型平台Hugging Face,旨在加速开放权重模型的普及。该平台拥有超1800万开发者、300万模型和百万级应用,是全球最大的开源AI资源库之一。此次交易是英伟达迄今最大规模收购,预计...
CNBC《疯狂钱潮》主持人吉姆·克莱默在30年期国债收益率冲上5.26%的背景下,用市盈率对比拆解了英伟达、MongoDB、戴尔等股票的涨跌逻辑,指出市场并非在抛弃AI和数据中心,而是资金正从高估值股票转向低估值品种。节...
CNBC《Mad Money》主持人吉姆·克莱默在节目中提出,市场正把资金追捧转向戴尔、Snowflake等新热点,却让亚马逊、Alphabet、Meta、微软、英伟达、特斯拉等"科技七巨头"估值跌至历史低位。他逐一分析...
人形机器人正采用中央与分布式混合计算架构,兼顾高层推理规划与关节级实时控制。相比自动驾驶汽车,人形机器人因近距离接触人类、多模态传感器及连接方式繁多,攻击面更广,面临模型篡改、无线中间人攻击等安全风险,功能安全与网络安全...
本文是AI模型协同设计系列第三篇,聚焦如何利用投机解码(Speculative Decoding)在保持精度的同时加速大语言模型推理。文章提出五条选择草稿长度与草稿机制的实用准则:通过增加草稿长度将GEMM推入计算密集区...