云计算
-
月之暗面拟赴港IPO 目标融资50亿美元 估值或达500亿美元
按照部分指标衡量,Kimi K3的表现几乎可以与OpenAI、Anthropic等公司的领先模型相匹敌。
-
AMD发布Threadripper Halo Station工作站,面向本地运行超万亿参数大模型
Threadripper Halo Station基于96核心锐龙Threadripper PRO处理器,配备2块Instinct MI350P显卡加速器,支持2TB系统内存。
-
微软将GitHub Copilot代码审查扩展至Azure Repos 按次计费并支持成本管理
微软承认许多Azure DevOps客户尚未准备好迁移至GitHub,因此将Copilot代码审查功能扩展至Azure Repos。
-
阿里云上线企业级Agent协作平台万有无界,多团队Agent产品赛马格局持续
当Agent真正进入企业预算,这个问题会比模型参数重要得多。
-
智谱入驻天猫开设官方旗舰店,大模型Token首次作为标准零售商品上架电商平台
智谱正从“把模型部署进客户机房、签一单确认一笔收入”,转向“把模型放上云、按调用量持续收费”。
-
英伟达发布开源工具PAIR聚合家庭闲置算力构建个人AI推理网?
PAIR会根据用户家用电脑是否处于闲置状态去决定利用其算力,如果用户在电脑上玩游戏,那么该设备将会退出PAIR的网络。
-
四大AI模型服务同时中断 云基础设施未现异常
虽然前沿模型时不时会发生故障,但四款AI服务同时在短时间内出现中断则相当罕见。
-
AI基础设施进入Token分层竞争时代 三层架构重塑产业格?
AI Infra的算力规模决定Token产能上限,资源调度能力决定Token流转效率,服务适配能力决定Token使用体验。
-
月之暗面冲刺港股IPO,Kimi年化收入超3亿美元仍加速融资
模型能力已经制造需求,算力还没有准备好承接所有需求。
-
国科亿道联合后摩智能发布FN008 AI笔电,搭载国产飞腾处理器与160TOPS算力NPU
后摩漫界M50以10W典型功耗实现160 TOPS INT8算力,可在本地运行35B参数大模型,为全栈国产化AI终端提供了新的算力选择。
-
腾讯WorkBuddy一年实践复盘:从亏损开发者工具到千万月活AI智能体
所有的现象级突围其实都不是凭空出现,它需要一个在寒冬里活下来的技术底座,以及一个愿意给它时间的组织。
-
OpenAI、Anthropic、xAI同日发生服务中断,头部AI模型集体宕机暴露底层算力集中风险
头部AI公司共用同一批底层算力,模型层面的竞争再激烈,地基是共享的。
-
两天三场模型发布背后:大模型智能正从稀缺品变为可复制的商品
当智能提升从“范式突破”退化为“算力堆叠”,前沿模型的军备竞赛便沦为边际收益递减的内卷。
-
智谱与MiniMax收入结构生变,To B Token销售成核心增长引擎
卖Token本身并不难,难的是Token的长期定价权。
-
智谱推出GLM Coding Plan夜间免费活动 GLM-5.3-Flash错峰时段额度全免
活动期间,GLM Coding Plan 套餐中的 GLM-5.3-Flash 模型额度消耗规则如下:通过智谱官方编程工具 ZCode 使用时,额度消耗为 0,实现完全免费畅用。
-
Shopify推出Gisting技术 将LLM系统提示词压缩为可学习令牌以降低推理成本
该技术通过将冗长的系统提示词压缩为少量可学习的“要点”令牌,在保持输出质量的同时显著提升吞吐量并降低推理成本。
-
AI数据中心用电需求激增推动公用事业公司与聚变初创企业合作 Realta Fusion成最新受益方
电网在AI数据中心的新增负荷下承压,这促使公用事业公司开始向聚变初创企业示好。
-
沙特主权基金旗下HUMAIN发布阿拉伯语大模型humain-m3,由MiniMax受托开发
阿拉伯语的使用人口达数亿,但在人工智能前沿领域,它的代表性仍然严重不足。