<?xml version="1.0" encoding="UTF-8"?>
<rss version="2.0" xmlns:atom="http://www.w3.org/2005/Atom">
  <channel>
    <title>Air News - 标签: gpu</title>
    <link>http://889990.xyz/news/tag/gpu</link>
    <description>标签 gpu 下的最新资讯</description>
    <language>zh-cn</language>
    <lastBuildDate>Thu, 30 Jul 2026 21:34:06 GMT</lastBuildDate>
    <atom:link href="http://889990.xyz/rss/tag/gpu.xml" rel="self" type="application/rss+xml" />
    
    <item>
      <title><![CDATA[GPU利用率成企业AI新瓶颈，管理层面加速演进]]></title>
      <link>http://889990.xyz/news/vision/3453/gpu-management-utilization-constraint</link>
      <guid isPermaLink="true">http://889990.xyz/news/vision/3453/gpu-management-utilization-constraint</guid>
      <pubDate>Thu, 30 Jul 2026 15:09:09 GMT</pubDate>
      <description><![CDATA[随着大模型落地，企业AI的核心瓶颈已从模型质量转向算力利用率。Dharma‑AI 在最新博客中指出，GPU 空闲等同于航空器停场，只有通过专用模型与持续的 GPU 管理才能提升整体 ROI。]]></description>
      <category><![CDATA[视野]]></category>
      <enclosure url="https://image.889990.xyz/huggingface/20260730/gpu-management.webp" type="image/jpeg" />
    </item>
    
    <item>
      <title><![CDATA[AllenAI推出OlmoEarth平台 实现行星级卫星推理突破]]></title>
      <link>http://889990.xyz/news/solution/3408/olmoearth-platform-geospatial-inference</link>
      <guid isPermaLink="true">http://889990.xyz/news/solution/3408/olmoearth-platform-geospatial-inference</guid>
      <pubDate>Tue, 28 Jul 2026 16:27:42 GMT</pubDate>
      <description><![CDATA[Allen Institute for AI（AI2）在7月28日发布OlmoEarth平台，提供从模型微调到大规模卫星图像推理的一站式基础设施。平台以CPU‑GPU‑CPU三阶段硬件划分，实现跨洲级别推理仅需一天，成本仅为每平方公里几分钱，旨在帮助环保组织和政府快速获取可操作的地球观测洞察。]]></description>
      <category><![CDATA[应用]]></category>
      <enclosure url="https://image.889990.xyz/huggingface/20260728/olmoearth-infrastructure.webp" type="image/jpeg" />
    </item>
    
    <item>
      <title><![CDATA[TileLang实现GPU高性能内核自动化编译，突破Tensor‑Core GEMM与FlashAttention]]></title>
      <link>http://889990.xyz/news/opensource/3375/tilelang-high-performance-gpu-kernels</link>
      <guid isPermaLink="true">http://889990.xyz/news/opensource/3375/tilelang-high-performance-gpu-kernels</guid>
      <pubDate>Sat, 25 Jul 2026 18:08:12 GMT</pubDate>
      <description><![CDATA[TileLang 作为面向 GPU 的高阶 Python DSL，能够在数十行代码内完成张量核 GEMM、融合 Softmax、FlashAttention 等复杂算子，并交由编译器自动生成高效 CUDA，实现自动调优与显存节省，为 AI 推理提供新一代算力加速方案。]]></description>
      <category><![CDATA[开源]]></category>
      
    </item>
    
    <item>
      <title><![CDATA[AMD发布Helios AI机架系统 挑战Nvidia算力霸主]]></title>
      <link>http://889990.xyz/news/trends/3347/amd-helios-ai-rack-challenge-nvidia</link>
      <guid isPermaLink="true">http://889990.xyz/news/trends/3347/amd-helios-ai-rack-challenge-nvidia</guid>
      <pubDate>Thu, 23 Jul 2026 20:33:02 GMT</pubDate>
      <description><![CDATA[在旧金山的Advancing AI大会上，AMD CEO苏姿丰宣布Helios AI机架系统将于今年晚些时候交付，旨在以千兆瓦级算力对标Nvidia的Vera Rubin和Grace Blackwell，已获OpenAI、Meta、Anthropic等多家巨头预订。]]></description>
      <category><![CDATA[前沿]]></category>
      <enclosure url="https://image.889990.xyz/techcrunch/20260723/amd-takes-on-nvidia-with-its-helios-ai-rack-scale-system.webp" type="image/jpeg" />
    </item>
    
    <item>
      <title><![CDATA[Nvidia Jetson芯片登月，GPU首次登陆月球表面推动空间AI创新]]></title>
      <link>http://889990.xyz/news/vision/3332/nvidia-gpu-moon-rover</link>
      <guid isPermaLink="true">http://889990.xyz/news/vision/3332/nvidia-gpu-moon-rover</guid>
      <pubDate>Thu, 23 Jul 2026 15:00:00 GMT</pubDate>
      <description><![CDATA[TechCrunch 7 月 23 日报道，Nvidia 与月球探测初创公司 Lunar Outpost 合作，将 Jetson 系列 GPU 装配到下一代月球车上，计划在今年年底前实现首次月球表面运行。此举标志着高性能计算硬件进入极端太空环境，为未来人类月球基地提供关键的本地化感知与决策能力。]]></description>
      <category><![CDATA[视野]]></category>
      <enclosure url="https://image.889990.xyz/techcrunch/20260723/nvidia-is-sending-gpus-to-the-moon.webp" type="image/jpeg" />
    </item>
    
    <item>
      <title><![CDATA[Etched完成10.3亿美元估值，凭自研芯片冲击GPU算力格局]]></title>
      <link>http://889990.xyz/news/vision/3331/etched-10b-valuation-ai-chip</link>
      <guid isPermaLink="true">http://889990.xyz/news/vision/3331/etched-10b-valuation-ai-chip</guid>
      <pubDate>Thu, 23 Jul 2026 15:00:00 GMT</pubDate>
      <description><![CDATA[AI芯片初创Etched完成3亿美元C轮融资，估值突破10.3亿美元，凭自研低压预填芯片和集群级内存技术，宣称可加速任意模型推理，挑战传统GPU主导的算力格局。]]></description>
      <category><![CDATA[视野]]></category>
      <enclosure url="https://image.889990.xyz/techcrunch/20260723/ai-chip-startup-etched-defies-skeptics-hits-10-3b-valuation-from-big-name-investors.webp" type="image/jpeg" />
    </item>
    
    <item>
      <title><![CDATA[Infinity获1500万美元融资 推动全芯片通用推理软件挑战Nvidia垄断]]></title>
      <link>http://889990.xyz/news/vision/3271/infinity-raises-15m-universal-inference</link>
      <guid isPermaLink="true">http://889990.xyz/news/vision/3271/infinity-raises-15m-universal-inference</guid>
      <pubDate>Mon, 20 Jul 2026 15:15:00 GMT</pubDate>
      <description><![CDATA[AI基础设施公司Infinity本周完成1500万美元融资，估值达1亿美元。出资方包括Touring Capital、Principal VC以及OpenAI、Anthropic的研究员。Infinity致力于打造跨芯片的通用推理库，直接冲击Nvidia在CUDA生态的统治地位。]]></description>
      <category><![CDATA[视野]]></category>
      <enclosure url="https://image.889990.xyz/techcrunch/20260720/inference-startup-infinity-raises-15m-from-touring-capital-openai-and-athropic-researchers.webp" type="image/jpeg" />
    </item>
    
    <item>
      <title><![CDATA[企业加速采购AI算力却难看清成本，计算缺口持续扩大]]></title>
      <link>http://889990.xyz/news/vision/3206/enterprise-ai-compute-gap</link>
      <guid isPermaLink="true">http://889990.xyz/news/vision/3206/enterprise-ai-compute-gap</guid>
      <pubDate>Thu, 16 Jul 2026 17:35:19 GMT</pubDate>
      <description><![CDATA[针对107家中型企业的调研显示，AI基础设施支出正以超出可视化能力的速度增长，超过六成企业计划在一年内更换或新增算力供应商，但只有不到一半能够精准追踪GPU使用率和实际成本，导致计算缺口日益凸显。]]></description>
      <category><![CDATA[视野]]></category>
      <enclosure url="https://image.889990.xyz/venturebeat/20260716/the-ai-compute-gap-enterprises-are-buying-infrastructure-faster-than-they-can-measure-what-it-costs.webp" type="image/jpeg" />
    </item>
    
    <item>
      <title><![CDATA[Meta启动新一代AI芯片量产，九月投产助力降低GPU成本]]></title>
      <link>http://889990.xyz/news/vision/3102/meta-ai-chips-production-september</link>
      <guid isPermaLink="true">http://889990.xyz/news/vision/3102/meta-ai-chips-production-september</guid>
      <pubDate>Thu, 09 Jul 2026 17:17:37 GMT</pubDate>
      <description><![CDATA[Meta 为应对芯片短缺和算力成本高企，宣布其自研的 MTIA 系列 AI 芯片将在九月进入量产。芯片采用模块化 chiplet 设计，由 Broadcom 共同研发，交由台积电代工，并配套三星、SanDisk、住友电工等供应链，以提升推荐系统和生成模型的算力效率。]]></description>
      <category><![CDATA[视野]]></category>
      <enclosure url="https://image.889990.xyz/techcrunch/20260709/metas-new-ai-chips-will-begin-production-in-september.webp" type="image/jpeg" />
    </item>
    
    <item>
      <title><![CDATA[Nvidia受算力市场自生困境，内存巨头抢占增长红利]]></title>
      <link>http://889990.xyz/news/vision/3103/nvidia-lose-market-lead-to-memory-rival</link>
      <guid isPermaLink="true">http://889990.xyz/news/vision/3103/nvidia-lose-market-lead-to-memory-rival</guid>
      <pubDate>Thu, 09 Jul 2026 17:06:11 GMT</pubDate>
      <description><![CDATA[TechCrunch 报道，随着自研芯片和云厂商转向自建算力，Nvidia 的 GPU 价格与股价双双回落；与此同时，内存供应紧张让 Micron 等 DRAM 巨头价值飙升，算力生态的供需失衡正重新洗牌。]]></description>
      <category><![CDATA[视野]]></category>
      <enclosure url="https://image.889990.xyz/techcrunch/20260709/nvidia-is-a-victim-of-the-compute-marketplace-it-created.webp" type="image/jpeg" />
    </item>
    
    <item>
      <title><![CDATA[NVIDIA发布Nemotron‑Puzzle‑75B‑A9B实现服务器吞吐提升逾两倍]]></title>
      <link>http://889990.xyz/news/trends/3099/nvidia-nemotron-puzzle-75b-performance</link>
      <guid isPermaLink="true">http://889990.xyz/news/trends/3099/nvidia-nemotron-puzzle-75b-performance</guid>
      <pubDate>Thu, 09 Jul 2026 08:47:37 GMT</pubDate>
      <description><![CDATA[NVIDIA AI团队推出压缩版Nemotron‑3‑Super模型Nemotron‑Labs‑3‑Puzzle‑75B‑A9B，参数从120.7B/12.8B降至75.3B/9.3B，保持88层混合布局。单机8×B200节点总吞吐提升1.6‑2.14倍，单卡H100上1M‑token并发从1提升至8，展示了结构压缩与短期知识蒸馏相结合的高效推理路径。]]></description>
      <category><![CDATA[前沿]]></category>
      <enclosure url="https://image.889990.xyz/marktechpost/20260709/nvidia-releases-nemotron-labs-3-puzzle-75b-a9b-a-compressed-hybrid-moe-llm-delivering-2-03x-server-throughput-at-matched-user-throughput.webp" type="image/jpeg" />
    </item>
    
    <item>
      <title><![CDATA[法国AI初创ZML推出免费LLMD推理平台 跨芯片加速显著]]></title>
      <link>http://889990.xyz/news/solution/3082/zml-llmd-inference-software-release</link>
      <guid isPermaLink="true">http://889990.xyz/news/solution/3082/zml-llmd-inference-software-release</guid>
      <pubDate>Wed, 08 Jul 2026 08:00:00 GMT</pubDate>
      <description><![CDATA[法国AI创业公司ZML今日发布免费推理服务器LLMD，支持NVIDIA、AMD、TPU、Apple Metal、Intel Arc等多种芯片，实现跨芯片高效加速，帮助企业降低成本并提升算力利用率。]]></description>
      <category><![CDATA[应用]]></category>
      <enclosure url="https://image.889990.xyz/techcrunch/20260708/hot-french-startup-zml-releases-free-product-to-speed-inference-across-lots-of-ai-chips.webp" type="image/jpeg" />
    </item>
    
    <item>
      <title><![CDATA[Google、Amazon的AI扩张推高碳排放，净零目标面临严峻考验]]></title>
      <link>http://889990.xyz/news/vision/3010/google-amazon-ai-carbon-impact</link>
      <guid isPermaLink="true">http://889990.xyz/news/vision/3010/google-amazon-ai-carbon-impact</guid>
      <pubDate>Thu, 02 Jul 2026 19:14:46 GMT</pubDate>
      <description><![CDATA[Google 与 Amazon 最新可持续报告显示，AI 计算导致公司碳排放分别上升 25% 与 16%，使其净零承诺面临巨大挑战，数据中心与 GPU 采购成为主要驱动因素。]]></description>
      <category><![CDATA[视野]]></category>
      <enclosure url="https://image.889990.xyz/techcrunch/20260702/a-warning-sign-about-ais-real-cost-courtesy-of-google-and-amazon.webp" type="image/jpeg" />
    </item>
    
    <item>
      <title><![CDATA[Together AI完成8亿美元融资，估值升至83亿美元，开放模型云服务加速竞争]]></title>
      <link>http://889990.xyz/news/vision/2997/together-ai-raises-800m</link>
      <guid isPermaLink="true">http://889990.xyz/news/vision/2997/together-ai-raises-800m</guid>
      <pubDate>Wed, 01 Jul 2026 18:29:14 GMT</pubDate>
      <description><![CDATA[2026年7月1日，AI Neocloud 提供商 Together AI 宣布完成 8 亿美元 C 轮融资，最新估值 83 亿美元。此轮由 Aramco Ventures 领投，凸显企业对成本更低的开源模型算力需求快速增长。]]></description>
      <category><![CDATA[视野]]></category>
      <enclosure url="https://image.889990.xyz/techcrunch/20260701/neocloud-together-ai-raises-800m-leaps-to-8-3b-valuation.webp" type="image/jpeg" />
    </item>
    
    <item>
      <title><![CDATA[NVIDIA发布Nemotron两塔模型，实现2.42倍文本生成吞吐并保持98.7%质量]]></title>
      <link>http://889990.xyz/news/trends/2982/nvidia-nemotron-two-tower-diffusion</link>
      <guid isPermaLink="true">http://889990.xyz/news/trends/2982/nvidia-nemotron-two-tower-diffusion</guid>
      <pubDate>Wed, 01 Jul 2026 08:10:17 GMT</pubDate>
      <description><![CDATA[NVIDIA正式推出Nemotron两塔（TwoTower）扩散语言模型，基于冻结的Nemotron‑3‑Nano‑30B骨干，实现约2.42倍的生成吞吐，同时保持98.7%的自回归质量，全部开源并提供多模式推理接口，标志着大模型并行解码的关键突破。]]></description>
      <category><![CDATA[前沿]]></category>
      
    </item>
    
    <item>
      <title><![CDATA[Etched完成5亿美元估值并签下10亿美元AI芯片订单，挑战英伟达芯片霸主]]></title>
      <link>http://889990.xyz/news/trends/2979/etched-ai-chip-valuation-5b</link>
      <guid isPermaLink="true">http://889990.xyz/news/trends/2979/etched-ai-chip-valuation-5b</guid>
      <pubDate>Tue, 30 Jun 2026 18:13:02 GMT</pubDate>
      <description><![CDATA[AI芯片新秀Etched宣布完成500亿美元后估值，并已获得价值10亿美元的前沿推理集群合同。公司凭借自研高效推理芯片、定制机架和软件套件，力图在成本与功耗上超越英伟达，吸引了包括Peter Thiel、Geoffrey Hinton在内的重量级投资者。]]></description>
      <category><![CDATA[前沿]]></category>
      <enclosure url="https://image.889990.xyz/techcrunch/20260630/nvidia-competitor-etched-hits-5b-valuation-1b-in-sales-for-ai-chip.webp" type="image/jpeg" />
    </item>
    
    <item>
      <title><![CDATA[Google推出Colab CLI 让终端直接调用云GPU/TPU]]></title>
      <link>http://889990.xyz/news/solution/2697/google-colab-cli-launch</link>
      <guid isPermaLink="true">http://889990.xyz/news/solution/2697/google-colab-cli-launch</guid>
      <pubDate>Sat, 06 Jun 2026 22:07:34 GMT</pubDate>
      <description><![CDATA[Google AI团队本周发布开源的Colab CLI，开发者和AI代理可在本地终端创建、管理Colab会话，并一键使用云端GPU或TPU运行Python脚本，实现无需离开Shell的高效算力调用。]]></description>
      <category><![CDATA[应用]]></category>
      
    </item>
    
    <item>
      <title><![CDATA[Nvidia推出Vera CPU 打开2000亿美元全新AI代理市场]]></title>
      <link>http://889990.xyz/news/vision/2635/nvidia-vera-200b-market</link>
      <guid isPermaLink="true">http://889990.xyz/news/vision/2635/nvidia-vera-200b-market</guid>
      <pubDate>Thu, 21 May 2026 00:28:31 GMT</pubDate>
      <description><![CDATA[在最新财报发布会上，Nvidia创始人兼CEO黄仁勋宣布，公司全新面向AI代理的CPU产品Vera已实现首批20亿美元销售，并预估可开启价值约2000亿美元的全新市场，标志着GPU巨头向AI专用计算平台的关键转型。]]></description>
      <category><![CDATA[视野]]></category>
      <enclosure url="https://image.889990.xyz/techcrunch/20260521/jensen-huang-says-hes-found-a-brand-new-200b-market-for-nvidia.webp" type="image/jpeg" />
    </item>
    
    <item>
      <title><![CDATA[NVIDIA推出NVFP4 4位预训练方案，10万亿token规模实现FP8相近精度]]></title>
      <link>http://889990.xyz/news/trends/2559/nvidia-nvfp4-4bit-pretraining</link>
      <guid isPermaLink="true">http://889990.xyz/news/trends/2559/nvidia-nvfp4-4bit-pretraining</guid>
      <pubDate>Mon, 18 May 2026 08:42:52 GMT</pubDate>
      <description><![CDATA[NVIDIA在最新技术报告中公布了NVFP4——一种原生支持Blackwell Tensor Core的4位浮点微尺度格式，并基于该格式在12B混合Mamba‑Transformer上完成了10万亿token的预训练。实验显示，模型在MMLU‑Pro等基准上仅比FP8基线低0.04个百分点，显著提升算力与内存效率。]]></description>
      <category><![CDATA[前沿]]></category>
      <enclosure url="https://image.889990.xyz/marktechpost/20260518/nvidia-introduces-a-4-bit-pretraining-methodology-using-nvfp4-validated-on-a-12b-hybrid-mamba-transformer-at-10t-token-horizon.webp" type="image/jpeg" />
    </item>
    
    <item>
      <title><![CDATA[Benchmark押注Cerebras IPO获数十亿美元回报，VC Eric Vishria险错失会议]]></title>
      <link>http://889990.xyz/news/vision/2518/cerebras-ipo-benchmark-investment</link>
      <guid isPermaLink="true">http://889990.xyz/news/vision/2518/cerebras-ipo-benchmark-investment</guid>
      <pubDate>Thu, 14 May 2026 20:23:03 GMT</pubDate>
      <description><![CDATA[Benchmark 通过早期投资 AI 芯片公司 Cerebras，在其 2026 年 IPO 后持股市值突破数十亿美元。VC Eric Vishria 当初几乎错过首次路演，却因团队实力和技术前景最终实现高额回报。]]></description>
      <category><![CDATA[视野]]></category>
      <enclosure url="https://image.889990.xyz/techcrunch/20260514/cerebras-ipo-makes-billions-for-benchmark-but-vc-eric-vishria-almost-didnt-take-the-meeting.webp" type="image/jpeg" />
    </item>
    
  </channel>
</rss>