
B300半年涨三倍;大厂集体绕开算力中转站;Infra公司多名核心高管离职;Token成本击穿圈人再变现丨算力情报局Vol.13
Quick Answer
The price of the B300 AI chip has surged over threefold in six months, now exceeding 12 million CNY, while major companies are avoiding intermediary computing power stations due to security and performance concerns.
Quick Take
Additionally, significant management changes at an AI Infra company highlight instability in the sector, as the industry shifts from a focus on hardware to operational efficiency.
Key Points
- B300 prices rose from 4 million to over 12 million CNY within six months.
- Major firms are avoiding computing power intermediaries due to data security risks.
- Three core executives have left a prominent AI Infra company amid management upheaval.
- 3D stacked chips are gaining traction, with valuations skyrocketing in the startup scene.
- AI operational costs are rising, making traditional user acquisition strategies unsustainable.
📖 Reader Mode
~2 min readB300半年内涨三倍,某华东大厂要求供应商二选一
B300整机价格仍在持续上涨。据多位业内人士透露,国内现货报价已从春节后的400多万元/台一路飙升至超过1200万元/台,市场也从“每周一个价”演变为“每天一个价”。
但在高价和缺货之下,部分所谓“现货”并不存在。据知情者了解,其接触的至少三四起交易中,卖方均以有现货为由,要求买方提供验资材料、企业资质等信息,最终目的是套取国内重要企业的资金、采购和算力部署数据,存在信息安全隐患。
真实货源的争夺也在加剧。有消息称,此前正在推进规模或超过1万台B300采购的某华东大厂,其扫货力度超过另一家此前积极采购B300的头部互联网公司。为保障自身订单,该公司还要求部分供应商优先供货,并限制其同时向后者供货。
国产推理芯片开始拆开做:AFN厂商FFN已流片,推理新玩家先做P卡
有业内人士透露,一家长期押注AFN架构的国产AI芯片企业研发取得新进展,面向FFN/MoE的芯片已经完成流片,而Attention芯片仍处于设计阶段。在Attention芯片成熟前,公司计划先与GPU组成异构推理方案。
另一家专注AI推理芯片赛道的企业则选择先从Prefill芯片切入,首款产品的性能目标是超过H100,计划于明年底推出。据了解,其首代产品采用LPDDR存储方案,后续将升级至3D堆叠。
大厂普遍绕开算力中转站:安全、性能、封号三大顾虑
据业内人士分析,大厂普遍不愿使用算力中转站,这一现象背后有多重现实考量。中转站本是为解决国内开发者无法直接调用海外AI模型(如Claude、GPT)而出现的“曲线救国”方案,通过中间层转接,让用户在国内即可调用国外大模型接口,价格往往比官方更低。
然而对大厂而言,中转模式虽“便宜”,但“代价太高”。
首先是数据安全,B端客户无法接受数据经第三方中转,只能信任原厂直接调用;其次是并发性能问题,中转站难以满足大厂对TPM和RPM的高并发要求;计费黑箱同样棘手——中转站宣称打折但后台不可追溯,大厂要求每笔可核销;封号风险更是不容忽视,订阅账号的逆向超刷易导致原厂封禁,字节、腾讯均曾因此受损。
3D芯片创业潮起,半年估值翻数倍,量产是一道坎
AI推理需求快速增长,加上国内先进制程推进受限,3D堆叠芯片正在成为芯片创业的新风口。近期,多家相关创业公司受到资本追捧,有公司半年内估值从数亿元涨至数十亿元。
资本热情并不等于产业成熟。3D芯片涉及堆叠工艺、良率、成本和供应链等多重挑战,在融资竞速之外,真正决定公司价值的仍是能否完成量产闭环。更多芯片创业公司的信息交流添加微信 BENSONEIT 。
存储大厂寻求补齐关键拼图,数百亿控股某IP公司BU未果,转投另一家西部公司
国内头部存储厂商此前曾与一家国内IP公司接触,希望以数百亿元估值控股其RCD芯片业务BU,以补齐RCD存储接口芯片能力。RCD是DDR5 RDIMM服务器内存的核心接口芯片,全球主要供应商仅有三家。随着AI服务器需求增长,RCD正成为国产存储产业链竞相布局的关键环节。
不过,据业内人士透露,由于双方在估值等问题上未能达成一致,这笔交易最终未能落地。随后,该存储厂商将目光转向西部某芯片公司,合作推进RCD芯片布局。
AI Infra明星公司高层巨震
华北一家因“AI工厂”路线而受到行业关注的AI Infra公司,近期发生管理层重大变动。
雷峰网(公众号:雷峰网)了解到公司有三位核心高管已离职,其中包括去年从国际科技巨头高调加盟的CTO。该公司背靠地方国资体系,过去两年承担多个区域级算力基础设施项目建设,一度被业内视为国内AI工厂模式的重要探索者。
目前国内智算产业从“拼卡”走向“拼运营”的关键阶段,此时核心管理团队接连离场的原因是啥?
推理新架构持续升温,投资人却“没流片不投”
推理新架构持续升温,但多位投资人表示不知道该投哪家创业公司,有的甚至直言不会考虑没有完成流片的项目。
相比之下,投资人对GPU赛道的判断已经趋于一致。有业内人士认为,很难再诞生新的头部GPU公司,训练侧最终只会剩下一两家企业;推理侧虽然市场更大,但长期同样容不下太多玩家。
在一位投资人看来,部分国产GPU公司目前仍围绕地方智算集群项目开展业务,不仅卖芯片,还承担部署、运维等工作。这类项目难以标准化,即便已经完成上市,也距离真正实现良性经营还有一定差距。哪家国产推理芯片能率先实现商业化落地?欢迎添加微信 Evelynn7778 互通有无。
AI时代算力逻辑生变:互联网“先圈人再变现”模式走不通了
有业内人士认为,互联网时代“先拉新、做大用户规模、再算DAU”的经典逻辑在AI时代已走不通。核心差异在于边际成本结构——互联网时代增量用户几乎不带来增量成本,而算力完全不同:每新增一个用户,都会实实在在消耗Token,带来直接的算力成本增量。
这意味着,靠用户规模摊薄研发成本的互联网打法已失效,企业无法像过去那样通过“免费”快速圈住用户再慢慢变现。因此,“免费送1000万Token”的补贴模式在商业上不可能成立——每送出一份,都是真金白银的成本支出,没有平台能耗得起。
情报太少仍意犹未尽?更多精彩欢迎扫描下方二维码,加入雷峰情报群结识志同道合的朋友,畅聊行业前沿资讯,爆料内幕故事~

雷峰网原创文章,未经授权禁止转载。详情见转载须知。
— Originally published at leiphone.com
Want this in your inbox every morning?
Daily brief at your local 8am — bilingual EN/中文, free.
More from 雷峰网芯片
See more →隼瞻创始人曾轶:AI推倒芯片设计壁垒,我们要做半导体行业的「Copilot」
Zeng Yi, founder of Sunzhan, emphasizes that AI is reshaping chip architecture, enabling RISC-V's rise as companies like Qualcomm and Google adopt customizable AI processors. He believes RISC-V's flexibility and open-source nature will drive its adoption in the semiconductor industry, particularly in AI applications.

