云计算
-
英伟达服务器涨价推高AI算力成本,定制ASIC芯片进入规模化部署阶段
定制芯片的价值已经从单点性能优化扩展到交付确定性和资本效率。
-
谷歌副总裁回应AI泡沫质疑:技术变革与市场需求真实存在
即使互联网泡沫2001年破灭,之后互联网仍在持续发展,进而改变社会和客户产业。
-
OpenAI CEO奥尔特曼回应AI耗水争议:数据中心用水量与办公楼相当
奥尔特曼认为,AI耗水问题受到的关注有些过度,但改变公众观感仍然要靠行业自己。
-
智谱AI入驻天猫开设官方旗舰店,大模型订阅套餐上线电商平台
智谱此次入驻天猫,意味着大模型订阅服务开始进入传统电商平台的消费场景。
-
阿里千问发布Qwen3.8-Max-0902版本模型,前端编程总榜夺冠并下调API定价
在CodeArena前端编程总榜中,Qwen3.8-Max提升22分至1691分夺得冠军。
-
谷歌即将发布Gemini 3.8 Flash模型 编程能力对标Anthropic与OpenAI
内部测试结果显示,Gemini 3.8 Flash在编程方面显著缩小了谷歌与Anthropic和OpenAI之间的差距。
-
GoPro以2.85亿美元被AI基础设施公司收购 将继续作为上市公司运营
此次收购将帮助GoPro在保留现有消费者产品支持的同时,借助AI基础设施能力拓展新的业务方向。
-
微软365服务中断持续 官方称恢复工作取得进展
微软在其服务状态页面上确认,部分用户仍可能遇到功能延迟或访问异常,公司正在持续部署修复程序。
-
SpaceX重组AI数据中心建设团队 应对基础设施工程与稳定性问?
团队重组与SpaceX AI现有数据中心面临的工程问题和稳定性问题有关。
-
从Token到扭矩,中国AI企业闯关东盟的四道硬门槛
出海不能只是卖产品,更要扎根于本地,长期主义、打持久战。
-
中科曙光将推出全球首款64线程移动工作站,本地运行35B MoE模型
中科曙光今日宣布将推出全球首款64线程移动工作站,该设备机身厚度仅16.9mm,配备16GB显存,本地运行35B MoE模型可实现50 Tokens/s的输出速率。
-
DeepSeek V4升级后推理时间显著延长,思维链机制调整引发用户争议
目前,AI大模型行业有个推论:只要让AI在回答问题时,多花一些时间进行推理,哪怕模型本身没有升级,其性能也能得到提升。
-
KV Cache存储成AI推理性能瓶颈,中科曙光发布ParaCache实现跨节点池化调度
KV Cache在推理过程中的内存开销可以达到数十乃至数百GB,远超单张顶级GPU的显存容量。
-
英伟达重启Rubin CPX推理预填充芯片项目 设计大幅调整预计2027年一季度量产
新Rubin CPX能以更具弹性的部署方式与更低成本承接预填充负载。
-
范式智能出资超10亿元采购华为昇腾950芯片,加速国产算力布?
范式此时通过大规模投入率先跑通昇腾 950 生态,不仅能抢占国产算力替代的先机,更能将后续的切换成本与交付空窗期压到最低。
-
谷歌上调美国市场智能家居硬件售价 Google TV Streamer涨幅达50%
谷歌在声明中表示,鉴于零部件成本上涨,公司将调整部分Google Nest摄像头、门铃以及Google TV 4K流媒体播放器的美国售价,新价格于8月31日起生效。
-
Anthropic披露7·30安全事件调查结果:配置错误致Claude模型访问真实企业系统,已部署实时分类器与沙箱隔离
Anthropic认为,这些事件不仅暴露出运营安全方面的问题,还涉及两类模型对齐问题,即“动机性推理”和为了完成狭窄任务而采取有害行动的倾向。
-
FTC联合22州起诉亚马逊 指控其秘密抬高企业广告费用
联邦贸易委员会称,亚马逊通过一套秘密算法系统性地提高企业广告报价,且未向广告主充分披露这一机制。