OpenAI
-
安全团队利用Claude发现OpenAI SSO配置错误及Discourse漏洞,获6500美元赏金
整个AI辅助bug发现和辅助攻击消耗的token支出不到3000美元,AI智能体花费了数天时间,而研究人员投入的人工时间仅仅数小时,凸显了AI时代黑客攻击成本的低廉。
-
美国AI巨头呼吁放缓开发节奏 欧洲业界与政界质疑其动机
法国财政部长罗兰·莱斯屈尔直言:“让所有落在他们后面的人都放慢速度,好让他们继续保持第一,我当然看得出这里面的自身利益。
-
安全研究人员利用Anthropic的Claude攻破OpenAI系统并获取内部代码库访问权限
安全研究人员利用Anthropic的Claude对OpenAI的系统漏洞进行利用,成功接管了员工账户并获取了一个内部代码仓库的访问权限,随后才将相关漏洞上报。
-
AI评估机构论坛发布公开信 为第三方风险评估划定最低准入条件
要具备公信力,驻场第三方评估人员必须保持科学客观性、透明度和独立性,并得到充分保护,免受被评估企业干预。
-
Anthropic与OpenAI转向20至30兆瓦小型数据中心合作,算力争夺进入精细化阶段
在当前的AI发展浪潮下,锁定规模更小的算力资源,有助于企业大幅缩短工作负载的落地交付周期。
-
前OpenAI研究员创立TypeSafe AI,发布非生成式结构化决策模型Jev
它不做文本生成,只输出确定性的结构化决策。
-
OpenAI在深圳试制无屏AI硬件,计划2027年上市
OpenAI近日正在深圳秘密试制一款无屏AI硬件产品,该产品计划在2027年上市。
-
OpenAI披露6起Agent异常行为:上下文压缩与外部工具形成跨实例状态传播链
当状态既能写进Compaction,又能借工具跨域移动,只观察当前一步就很难看出完整风险。
-
安全团队借助Anthropic Claude发现Discourse漏洞,获OpenAI 6500美元赏金
我不觉得我们比他国威胁者更聪明。我们只是三个拥有 Claude 和 Codex 订阅的人。
-
OpenAI发布模型失准披露框架及案例研究
该框架允许员工在模型生命周期内标记潜在问题,并由技术人员对事件进行标注和分类。
-
OpenAI推出法律专用AI平台Astra for Law,法律研究基准正确率54%
该服务并非“AI律师”,主要服务于律师和法律软件公司,帮助其区分法院判决中的核心裁判理由与附带评论,寻找不利判例,分析合同条款如何分配风险等,从而在庭审中提高案件胜诉率。
-
纽约时报诉OpenAI案新文件披露:内部曾称AI对出版商构成生存威胁
这起案件是版权持有人针对 AI 公司提起的数十起诉讼中最受关注的案件之一。
-
OpenAI披露GPT-5.6 Sol训练异常:模型通过摘要向后续版本传递隐瞒指令
如何识别这类跨任务、跨模型传递的异常指令,以及如何确保监控机制本身能够发现模型试图隐藏的问题,仍是 AI 安全研究需要进一步解决的问题。
-
吴恩达批AI灭绝论属科幻小说,称新一波造势或意在影响监管
吴恩达表示,AI确实存在风险,包括网络安全方面的风险,但有关AI导致人类灭绝的担忧“更像是科幻小说,而非科学”。
-
Google DeepMind成立AGI公共讨论研究所,推动通用人工智能议题开放对
该研究所的成立反映出AI行业正在试图将AGI的讨论从实验室内部扩展到更广泛的公共领域。
-
OpenAI披露GPT-5.6 Sol曾指示后续模型隐藏错误行为
随着能力日益增强的AI模型学会隐藏自身的不对齐行为,检测难度正在不断上升。
-
微软内部文件称AI数据抓取为“人类历史上最大规模劳动力窃取
最新解封的法庭文件显示,微软内部曾将OpenAI的数据抓取行为称为“窃取”,与此同时两家公司都在抓取《纽约时报》的付费墙内容并据此构建数据集。
-
消息称OpenAI接近攻克霍奇猜想,数学或成大模型下一试验场
部分OpenAI研究人员认为,继软件工程之后,数学是大模型最自然的下一块试验场。