半导体
-
Meta开源30B本地智能体模型,这是要革云计算的命?
?Meta AI Research发布的这个Muse Glimmer
-
Meta开源30B本地智能体模型Muse Glimmer,Apache 2.0授权,消费级GPU跑复杂任务
Meta AI Research今天扔出了?
-
Meta发布开源模型Muse Glimmer:300亿参数面向本地智能体执行
该模型采用多阶段训练方法实现高效性能,并支持多模态输入,增强了编码和自动化任务的处理能力。
-
Canva将2026年的增长率削减了三分之一, Jeff Dean离开了谷歌, Elon建立了自己的FAB : 20VC x SaaStr
?AI is just a feature we?
-
Databricks融资记:想融10亿,投资者塞了150亿,最后拿了50亿
?烧到连Databricks这种明?
-
OpenAI推“Ultrafast”模式,GPT-5.6 Sol提速14倍,企业市场这场仗不好打
?模型GPT-5.6 Sol加了个?
-
微软砍掉失败AI功能,合并Copilot应用,AI泡沫开始挤水了?
?和Deep Research都是去年才高调推出的?
-
英伟达五千亿美元新算盘:老GPU不贬值,AI基建继续烧钱
英伟达又出招了。这次不是新芯片,而是一套价值5000亿美元的金融玩法——让华尔街的“金主们”继续给AI基建输血,同时保证自家老GPU不沦为废铁。往好听了说,这是产业链协同创新;往坏了说,这招够狠,直接…
-
英伟达的新$ 5000B计划风险高,但非常出色,特别是对于老化的GPU
Nvidia has a plan to make sure its GPUs won’t lose value. It wants to convince a new crop of financi…
-
英伟达5000亿美元新算盘:让老GPU继续生钱,这招狠但聪明
英伟达又出招了,这次不是卖更多芯片,而是给已经卖出去的GPU“续命”。说白了,它要让金融圈相信,AI算力建设值得继续砸钱,哪怕用的是上一代的老卡。这步棋,往好听了说是商业模式创新,往坏了说,是怕GPU…
-
腾讯528亿算力账:模型优先,出租是退路,但退路有多宽?
2026年Q2营收2047.9亿元
-
详解腾讯Q2财报:为何宁可现金流干到负也要“锁算力”?
文 | 明晰野望腾讯Q2财报?
-
腾讯从来不是赌徒
?中国大模型的API和订阅收入将从2026年的350亿元
-
Google重组DeepMind,Gemini被OpenAI和Anthropic逼到墙角
?Gemini被Anthropic和OpenAI打得有?
-
把大模型推理成本打下来:一份“全球最便宜Token”的实操指南
非实时场景的低成本LLM推理架构设计方法论
-
降低大模型推理成本:架构师如何通过硬件与算法协同实现数量级优化
通过硬件选型、推理运行时优化、投机解码与队列重排序的协同设计,软件架构师可以在高吞吐非实时场景下实现大模型推理成本的数量级下降。
-
OpenAI的AI速度保卫战:当智能体让代码变更量暴增,性能优化成了新战场
?化成了新战场 Martin Spier在?
-
OpenAI工程师详解:智能体工作流如何支撑ChatGPT在大规模AI开发下的性能稳定
当AI开发加速时,代码变更量的激增正成为比GPU算力更隐蔽的系统性能瓶颈。