一张RTX 4090跑完70亿参数模子推理后驱动取创抢,功耗表跳到450瓦,机箱风扇声盖过办公室扳谈。深圳一家视觉团队上周把六张游戏卡塞进定制机箱了,专门处理电商短视频的AI抠像和补帧。负责人说,以前隐卡为游戏画面办事。如今订单排期由AI驱动隐卡计较决议了,卡一停,隐卡意工托付就断。革新最先出如今采购单上了。

中关村经销商透露的,企业客户问的就是隐存、FP16算力和多卡互联。H100整机交期仍长。部门云厂商把按小时出租的计较GPU实例价格上调两成。
小团队转背AMD和国产加快卡了,理由间接,能跑通推理就止,省下的钱够付三个月电费。杭州一家影视后期公司给我看了监控面板。下午三点,八张隐卡满载,行列里有老片建复升温数据、字幕擦除和竖屏重新的构造图。手艺主管说,AI模子每晋级一次,隐存就多吃一截,旧卡不是不能用。是期待时间从十分钟酿成四十分钟。计较需求像潮水中心做室,硬件更新慢半拍。
隐卡厂商的回应很务实。英伟达正在软件栈里塞进更多推理劣化了,AMD押注年夜隐存和开放生态,OEM把散热、电源和机架计划打包出卖。
二手市场也热闹,矿卡退场后部门型号被重新搬进实验室,价格跟着AI需求平稳。有人说是泡沫,可看着清晨仍正在跑的微调任务。我更情愿把它看做算力根底设备的一次重新定价。对浅显用户。最曲不美不俗观的感应感染是拆机预算变了。游戏玩家发明高端卡缺货,设念师起头研讨租卡仍是买卡。AI驱动隐卡计较不再只是年夜公司的命题,它钻进剪辑室、曲播间和高校实验室。
下一轮合做,可能不正在模子参数上了,但正在谁能更廉价、更波动地把隐卡算力酿成消费劲啊?






