AI
-
从晶圆厂到Token:半导体瓶颈如何重塑AI软件架构
芯片制造、数据中心扩张与网络瓶颈正在从底层重新定义AI软件系统的设计边界。
-
Cloudflare推出WriteGuard私有测试版 为MCP服务器提供细粒度安全控制
WriteGuard旨在通过控制AI智能体对可修改数据或执行操作的工具的访问权限,而非仅仅读取信息,来提升AI智能体的安全性。
-
Netflix开源因果推断智能体工作流,降低因果分析工程负担
该智能体采用actor-critic循环架构,能够根据观测数据和用户分析计划自动完成因果估计、报告撰写及后续步骤建议。
-
欧盟AI法案强制水印条款生效 主流大模型厂商采用统计水印技术
统计水印技术通过在自然语言生成过程中嵌入可检测的统计特征,在不影响模型性能的前提下实现机器可识别的输出标记。
-
SpaceXAI推出Grok Bot 支持持久化AI智能体在云端独立运行
Grok Bot的核心在于其持久化运行机制,智能体不再依赖用户实时发起请求,而是部署在专用云计算机上,持续监控并响应来自网站、应用程序、收件箱及其他工具的事件。
-
Grab借助AI智能体将机械性分析工作占比从44%降至30%
通过将智能体自主性、认证数据、上下文管理和人工监督相结合,自助式分析正在越来越多地处理指标、数据和SQL请求,而无需分析师的介入。
-
智能体适应度函数:将演化架构治理从确定性规则扩展至语义判断
智能体适应度函数将AI代理与版本化评估标准相结合,用于评估边界保真度、语义契约漂移和过时ADR假设等复杂且依赖判断的架构关切。
-
Jendrik Jördening分享LLM生产管线集成策略:从非确定性到系统可靠性
通过将语义文本提取与确定性代码分离,并用判别器模型验证选择结果,工程团队可以在保持数据库完整性的同时,显著降低LLM输出不可控带来的风险。
-
AWS开源Dogwood策略语言,扩展Cedar以管理AI智能体工具调用序列
Dogwood通过引入时间条件扩展了Cedar策略语言,使规则能够基于智能体先前的工具调用序列而非单次请求进行推理。
-
AWS为DynamoDB推出原生向量搜索功能
该功能支持过滤相似性搜索和可配置的向量索引,用于语义搜索工作负载。
-
开源工具PGSimCity将PostgreSQL运行机制转化为3D虚拟城市模拟
该工具通过交互式元素帮助后端开发者和站点可靠性工程师理解SQL及内核执行动态。
-
DoorDash弃用传统预测模型,转向Agentic推荐平台:上下文感知的消费AI如何落地
何落地 DoorDash正在?
-
DoorDash披露Agentic推荐平台架构:从单次预测转向上下文感知的消费级AI
从模型到智能体,DoorDash正在将推荐系统从单次预测范式升级为具备上下文感知能力的智能体平台,以应对消费级AI规模化部署的挑战。
-
Cloudflare上线Agent Tracing:默认截断、计费规则不一,开发者别高兴太早
这次是Agent Tracing
-
Cloudflare推出Agent Tracing功能,为AI代理调用提供全链路可观测性
从2026年10月1日起,每个span都将被视为计费事件,这意味着企业在享受AI代理可观测性能力的同时,也需要为更细粒度的监控成本做好准备。
-
上下文工程:300个精准Token胜过10万个噪音,编码Agent失败的技术真相
把上下文窗口撑到10万Token
-
上下文工程正成为大模型应用落地的关键:300个精准Token胜过10万个噪声Token
当开发者试图通过无限扩大上下文窗口来解决问题时,反而引入了更多噪声,导致模型输出质量急剧下降。
-
Meta开源30B本地智能体模型,这是要革云计算的命?
?Meta AI Research发布的这个Muse Glimmer