
#GPU
共找到 50 篇文章RSS Feed

算力GPUDharma-AI专用模型
•0 阅读•1分钟•视野

AllenAI推出OlmoEarth平台 实现行星级卫星推理突破
大模型GPUAllenAI卫星影像OlmoEarth
•33 阅读•1分钟•应用
TileLang实现GPU高性能内核自动化编译,突破Tensor‑Core GEMM与FlashAttention
TileLang 作为面向 GPU 的高阶 Python DSL,能够在数十行代码内完成张量核 GEMM、融合 Softmax、FlashAttention 等复杂算子,并交由编译器自动生成高效 CUDA,实现自动调优与显存节省,为 AI 推理提供新一代算力加速方案。
FlashAttentionGPUTileLangTensor CoreAutotuning
•28 阅读•1分钟•开源

AMD发布Helios AI机架系统 挑战Nvidia算力霸主
AMD算力NvidiaGPUHelios
•64 阅读•1分钟•前沿

Nvidia Jetson芯片登月,GPU首次登陆月球表面推动空间AI创新
NvidiaGPUJetsonLunar Outpost月球
•35 阅读•1分钟•视野

Etched完成10.3亿美元估值,凭自研芯片冲击GPU算力格局
AI芯片SequoiaAndreessen HorowitzGPUEtched
•53 阅读•1分钟•视野

Infinity获1500万美元融资 推动全芯片通用推理软件挑战Nvidia垄断
OpenAINVIDIAAnthropicGPUInfinity
•55 阅读•1分钟•视野

企业加速采购AI算力却难看清成本,计算缺口持续扩大
GoogleNVIDIA算力MicrosoftGPU
•61 阅读•1分钟•视野

Meta启动新一代AI芯片量产,九月投产助力降低GPU成本
AI芯片MetaTSMCGPUBroadcom
•45 阅读•1分钟•视野

Nvidia受算力市场自生困境,内存巨头抢占增长红利
算力NvidiaGPUDRAMMicron
•45 阅读•1分钟•视野

NVIDIA发布Nemotron‑Puzzle‑75B‑A9B实现服务器吞吐提升逾两倍
NVIDIAMoEGPUMambaNemotron-3
•39 阅读•1分钟•前沿

法国AI初创ZML推出免费LLMD推理平台 跨芯片加速显著
Yann LeCunGPUZMLLLMD
•22 阅读•1分钟•应用

Google、Amazon的AI扩张推高碳排放,净零目标面临严峻考验
GoogleAmazonGPU碳排放
•62 阅读•1分钟•视野

Together AI完成8亿美元融资,估值升至83亿美元,开放模型云服务加速竞争
NVIDIA开源模型GPUTogether AIAramco Ventures
•58 阅读•1分钟•视野
NVIDIA发布Nemotron两塔模型,实现2.42倍文本生成吞吐并保持98.7%质量
NVIDIA正式推出Nemotron两塔(TwoTower)扩散语言模型,基于冻结的Nemotron‑3‑Nano‑30B骨干,实现约2.42倍的生成吞吐,同时保持98.7%的自回归质量,全部开源并提供多模式推理接口,标志着大模型并行解码的关键突破。
生成式AINVIDIAMoEGPUNemotron
•49 阅读•1分钟•前沿

Etched完成5亿美元估值并签下10亿美元AI芯片订单,挑战英伟达芯片霸主
AI芯片NVIDIAGPUInferenceEtched
•45 阅读•1分钟•前沿
Google推出Colab CLI 让终端直接调用云GPU/TPU
Google AI团队本周发布开源的Colab CLI,开发者和AI代理可在本地终端创建、管理Colab会话,并一键使用云端GPU或TPU运行Python脚本,实现无需离开Shell的高效算力调用。
GoogleTPUGPUColab CLI
•161 阅读•1分钟•应用

Nvidia推出Vera CPU 打开2000亿美元全新AI代理市场
NvidiaAgentic AIGPUCPUVera
•73 阅读•1分钟•视野

NVIDIA推出NVFP4 4位预训练方案,10万亿token规模实现FP8相近精度
NVIDIANVFP4GPUTransformer EngineMamba-Transformer
•100 阅读•1分钟•前沿

Benchmark押注Cerebras IPO获数十亿美元回报,VC Eric Vishria险错失会议
CerebrasBenchmarkGPUEric Vishria
•34 阅读•1分钟•视野