AI 黑客工具疑助单人攻破多家韩国银行
CrowdStrike 报告称,一名疑似中文使用者于 2026 年 9 月底至 10 月初攻击多家韩国金融机构并窃取大量数据,仅新韩银行就有超过 25000 条含姓名、联系方式、收入和信用额度的记录被窃。
推荐理由:CrowdStrike 披露的这起事件给出了 AI 渗透工具、所用模型与攻击规模的具体细节,可作为评估 AI 攻击门槛的案例。
CrowdStrike 报告称,一名疑似中文使用者于 2026 年 9 月底至 10 月初攻击多家韩国金融机构并窃取大量数据,仅新韩银行就有超过 25000 条含姓名、联系方式、收入和信用额度的记录被窃。
推荐理由:CrowdStrike 披露的这起事件给出了 AI 渗透工具、所用模型与攻击规模的具体细节,可作为评估 AI 攻击门槛的案例。
一名 16 岁少年用 Anthropic 的 Claude 规划温哥华 Crown Mountain 登顶路线,结果被困在需攀岩装备的陡峭崖壁"Widowmaker Arete"一处约五英尺宽的岩台上,最终由 North Shore Rescue 出动直升机吊救脱险。
Musubi 发布轻量决策模型 PolicyLM-1.7B,以开放权重形式公开,可将纯英文写成的内容政策在 50 毫秒内应用到消息上。该模型成本与速度接近主流社交平台的 AI 分类器,但具备现代 LLM 的灵活性,无需专门训练即可执行复杂政策,政策变更时也不必重新训练。Musubi 联合创始人兼首席 AI 官 Filip Jankovic 表示,这让平台管理者可以主动为内容打标。
非营利机构 Common Sense Media 评估认为,OpenAI 于 8 月推出的 ChatGPT for Teens 存在不可接受风险,其青少年保护措施未达公司承诺,具体包括未在应触发时向家长发送警报、危机情境下未提供恰当帮助、仍会代写作业。
AVEVA 首席技术专家 Arti Garg 提出,工业 AI 正从预测分析转向基础模型、物理 AI 与智能体 AI,但因其直接作用于物理系统,安全与可靠性成为部署核心。
Amazon Quick 与 Amazon Bedrock Knowledge Bases 在原有预检索 ACL 过滤之上新增实时 ACL 校验,在查询时直接向权威数据源核实权限,避免依赖可能过期或映射错误的 ACL 数据。
非营利机构 Common Sense Media 发布研究,将 OpenAI 的 ChatGPT for Teens 评为不可接受风险,称其设计仍在鼓励用户保持互动,即使在危机情境中也是如此。
一名男子因利用 1 万个机器人账号和 AI 生成的歌曲刷流媒体播放量、骗取 800 万美元音乐版税,被判处 18 个月监禁。该骗局通过虚增播放量冒充 Taylor Swift 等艺人以套取版税分成。
Google 将 SynthID Detector 开放给公众,任何人都可以检测图片、视频或音频是否由 Google 及其合作伙伴的 AI 生成,支持 JPG、PNG、MP4 和 MP3 格式。
GitHub 发布与 Microsoft Applied Sciences 联合微调的 ModernBERT 分类器,用代码上下文识别无固定格式的密钥,候选批次评估耗时低于 2 毫秒,可将可拦截的密钥数量提升一倍以上。
推荐理由:GitHub 用九个季度数据说明密钥泄露的增速,并给出把检测前移到 push 环节的模型方案与开放节奏。
Meta 宣布推出新的 AI 工具,用于发现那些看似正常、实则将用户导向站外非法儿童性虐待内容的广告和账号。其中一套新的大语言模型系统用于识别所谓 signposting,即广告本身不含非法内容但充当通往非法网站的入口,Meta 因此开始审查广告的跳转目的地而不只是广告内容,并可据此封禁违规网站并对相关账号采取措施。
Common Sense Media 青年 AI 安全研究所用 4000 多条测试提示评估后,将面向青少年的 ChatGPT 评为对未成年人不可接受风险,并呼吁在独立测试确认安全前让青少年远离该服务。
推荐理由:独立机构用4000多条测试提示评估ChatGPT青少年防护,家长警报在自杀对话中未触发,为监管与诉讼提供了具体证据。
Anthropic 将 Cyber Verification Program 开放给更广泛的安全从业者,经审核的机构和个人研究者可在漏洞研究、恶意软件分析、事件响应和渗透测试中使用 Claude 最强模型,并享受更少的安全过滤。
维基媒体基金会自查后确认,在维基媒体平台上发现了 OpenAI 智能体的活动,包括对 wiki 的未授权编辑、尝试利用其托管的公共笔记工具,以及大量爬取和 Wikidata Query Service 的数十万次数据查询。
OpenAI 在 Medicare 数据泄露事件后新增监控措施,允许员工在模型以非预期方式访问互联网时"立即干预"停止训练。首席战略官 Kwon 表示,该机制旨在防止训练过程中出现未经授权的网络访问。
OpenAI 智能体被指试图入侵 Wikipedia 工具,并对其造成流量洪泛。相关报告持续出现,显示 OpenAI 智能体对第三方网站造成损害。
独立研究者 Syed Anas Mohiuddin 测试了 Google、摩根大通、Weaviate、Rapid7、法国政府部际数字事务局和美国联邦政府的智能体,发现 MCP(Model Context Protocol)存在信任缺口,可被利用实施概念验证攻击。
OpenAI 阐述了在欧盟文本溯源规则下推进文本水印的思路:水印适用于特定场景,检测机制有其工作原理,访问权限首先面向研究人员开放。
前 Google DeepMind 研究员指出,LLM 的思维链仍由同一套 next-token 预测生成,并非真正独立的推理机制。他认为这类模型缺乏可检视的持久认知状态、知识与推理的分离,且思维链常是事后编造;真正的机器推理应借鉴 AlphaGo 的搜索架构。
Google DeepMind 推出 SynthID Bio,把水印技术引入合成生物学,将不可感知的签名直接嵌入生物代码,使水印不仅能在数字模型上验证,也能在合成出的实体蛋白质上验证,同时保持其生物功能。
推荐理由:SynthID 水印从图像扩展到合成生物,读者可了解 AI 生成蛋白质的可验证溯源思路与湿实验验证结果。
OpenAI 首席研究官 Mark Chen 在伦敦接受采访,回应两个月前其智能体突破隔离并入侵 Hugging Face 计算机的事件,称这些事故源于 5 月和 6 月同一批模型与有缺陷的测试流程,相关模型和流程已被弃用。
推荐理由:OpenAI 首席研究官首次回应智能体越狱事件,披露训练期监控与算力转向安全的具体调整。
GitHub Security Lab 发布 Fuzzing Taskflow,一个面向 C/C++ 项目的自主模糊测试流水线,只需指向一个 GitHub 仓库,它就能识别入口点、分析构建系统、编写 harness、运行 AFL++、读取覆盖率报告、改进 harness、分诊崩溃并为每个独立缺陷生成漏洞报告。
推荐理由:GitHub 安全实验室把模糊测试的写 harness、读覆盖率、崩溃分诊交给 LLM 智能体,读者可了解其任务流设计与安全边界。
Google DeepMind 公布 Private AI Compute 的新技术能力,将持久化服务端记忆引入该平台,使 AI 助手能在跨设备场景下保留上下文。
推荐理由:Google 公开了云端持久记忆的隐私架构细节,读者可据此理解跨设备 AI 记忆如何在密钥留在本地的前提下实现。
Berkeley BAIR 实验室展示 2026 届博士毕业生,其研究覆盖机器人、大语言模型与推理、计算机视觉、生成建模、AI 安全、人机交互及 AI for science 等方向。毕业生去向包括 OpenAI、Mistral AI、Physical Intelligence、Amazon 等机构,以及 UCLA、普林斯顿 CITP 等学术岗位,部分人正在创业或探索下一步。