DeepSeek
-
DeepSeek算子负责人刘胜与发文谈AI替代焦虑,回应称不代表公司立场
我当然希望自己不要被革命,但如果非被革命不可的话,我希望革我自己命的人是我自己
-
DeepSeek 敲定 CFO 人选并推进 IPO,高瓴创投合伙人严文韬将加入
CFO 敲定人选、保荐券商进场,两件事叠加,不难看出,这家靠模型实力搅动全球AI赛道的企业,正从技术实验室,一步步补齐上市所需的资本配置。
-
DeepSeek V4.1 Flash采用非对称CED架构,KV Cache压缩至V4的四分之
模型性能强弱、性价比高低,都不是叙事的核心,唯有掌握了入口,才能吸引更多用户。
-
DeepSeek再度下调API价格,智谱与MiniMax进入低价增长周?
模型能力提升不再支撑更高价格,反而成为降价的理由,这正在改变大模型行业的定价规则与估值逻辑。
-
DeepSeek V4.1 Flash正式上线:552B MoE模型推理成本大幅下降,同步下调API价?
通常来说,又小又快的模型性能也就越低。然而V4.1 Flash不一样,各项基准全面超越V4 Pro,GPQA Diamond达90.9。
-
DeepSeek V4.1 Flash 上线国家超算互联网,552B MoE 模型激活参数最低 8B
与上一代模型相比,V4.1 Flash 对 HBM 的需求减少到 1/4,对 SSD 的需求减少到 1/8。
-
DeepSeek发布V4.1 Flash模型:552B参数MoE架构,性能超越V4 Pro,API定价下调
V4.1 Flash在性能、费用、速度、总用时等各项指标上已全面超越V4 Pro,因此官方计划有序下线V4 Pro模型。
-
DeepSeek Harness 0.1.5 发布:适配 V4.1 Flash 模型,新增文件上传与插件扩展入口
新版本与 DeepSeek V4.1 Flash 模型训练深度结合,模型在 DeepSeek Harness 不同配置中进行了专项训练和优化。
-
DeepSeek聘请中信证券筹备科创板IPO,年内正式启动上市进程
此次上市筹备,正值DeepSeek迫切需要新鲜资本,以支撑其在算力基础设施、模型开发、人才保留与招聘等方面的巨额投入。
-
DeepSeek测试V4.1 Flash中间版本,探索低价模型替代旗舰Pro的可能性
DeepSeek正在对其自身定价体系发起压力测试
-
DeepSeek开启V4.1 Flash内测,下调API价格并探索智能密度优化
对开发者来说,最终要比较的,是同样一项工作能否做好,以及做完之后的总账单。
-
DeepSeek发布V4.1 Flash中间版本内测,原生多模态架构实现推理速度数倍提升
V4.1 Flash是DeepSeek第一款原生多模态模型,它采用新的模型结构,原生多模态支持、能力更强、速度更快、且成本更低。
-
DeepSeek集中招聘约150名工程岗位 重心从模型研发转向基础设施规模化
基础设施曾被视为辅助职能,如今正成为核心产品的差异化因素。
-
企服科学:16万颗昇腾,DeepSeek把国产算力的遮羞布撕了
国产算力的成人礼,从来不是发布会上的参数,而是订单里的信任状。
-
企服科学全球动态汇总20260906
国产算力押注全球最大推理集群,GPT-6 Astra掀起评测标准之争——企业级AI的军备竞赛正从训练转向推理与智能体落地。
-
DeepSeek拟在内蒙古部署至少16万颗华为昇腾950DT芯片 打造全球最大国产AI推理集群
若这笔部署落地,国产算力将第一次在单点规模上拥有与英伟达集群正面掰手腕的推理底座。
-
DeepSeek V4升级后推理时间显著延长,思维链机制调整引发用户争议
目前,AI大模型行业有个推论:只要让AI在回答问题时,多花一些时间进行推理,哪怕模型本身没有升级,其性能也能得到提升。
-
DeepSeek Harness发布RC.8版本,Claude Code与Codex可作为子代理接入调度
模型可以换,执行任务的Agent可以换,但组织模型、调度Agent、管理任务和工具的那层工作环境,一旦用顺手就很难搬。