Meta 推出新 AI 工具,识别暗中导流儿童性虐待内容的广告
Meta 宣布推出新的 AI 工具,用于发现那些看似正常、实则将用户导向站外非法儿童性虐待内容的广告和账号。其中一套新的大语言模型系统用于识别所谓 signposting,即广告本身不含非法内容但充当通往非法网站的入口,Meta 因此开始审查广告的跳转目的地而不只是广告内容,并可据此封禁违规网站并对相关账号采取措施。
Meta 宣布推出新的 AI 工具,用于发现那些看似正常、实则将用户导向站外非法儿童性虐待内容的广告和账号。其中一套新的大语言模型系统用于识别所谓 signposting,即广告本身不含非法内容但充当通往非法网站的入口,Meta 因此开始审查广告的跳转目的地而不只是广告内容,并可据此封禁违规网站并对相关账号采取措施。
OpenAI 为 ChatGPT for Teens 新增 College Planner 功能,把申请要求、截止日期、任务和助学金步骤整合成一份计划,学生可随时更新进度并向 ChatGPT 提问,该功能将“很快”上线,美国市场先面向 10 至 12 年级、计划就读四年制大学的学生。
微软研究院开源 Agent Lightning v1.0,一个约 3500 行代码的轻量智能体 RL 框架,提出 Harnessed Agentic RL 范式,让部署时使用的 agent harness 直接参与强化学习训练,无需在训练框架内重写 agent。
推荐理由:微软研究院开源 Agent Lightning v1.0,给出真实 harness 参与 RL 训练的设计取舍与实测增益,可对照现有 agent RL 框架评估迁移成本。
AWS 提出 Agentic Value Model,用于替代为 RPA 设计的传统 ROI 模型,从时间节省、异常处理、决策质量和变更韧性四个维度衡量 agentic automation 的价值。该框架强调节省的工时并不等于利润,需有明确的变现机制和责任人;AWS 给出的规划区间显示纠错成本可达原交易成本的 1.5–4 倍,人为错误可占运营成本的 2–15%。
Qlik 基于 Amazon Bedrock 构建 Qlik Answers,为全球超 4 万名客户提供带来源引用的企业级问答。其 Discovery Agent 上线以来已为客户发现超 10 万条异常与离群点,多数启用智能体工具的 Qlik Cloud 账户已在日常使用。
AWS 展示了一套自动化修复工作流,用 Amazon EventBridge 接收 AWS DevOps Agent 的调查完成事件,再由 AWS Lambda Durable Functions 调用 Amazon Bedrock 从预审工具白名单中挑选修复动作。
AWS 设计了一个为期六周、每周约四小时的结构化项目,让非工程背景的业务人员用 Amazon Bedrock AgentCore、Strands Agents SDK 和 Amazon Nova 模型动手构建 AI 智能体。
Cornerstone OnDemand 基于 Amazon Bedrock 和 Strands Agents 构建多智能体系统 Orion AI,将数据库诊断时间从 45 分钟降至 10 分钟,减少 78%。该系统还通过去重和跨信号关联将冗余告警中位数减少 65%,并把 10 步以上的手动生命周期操作压缩为一次自然语言交互。
Meta 的 AI 智能体 Muse 通过最新 iOS 更新加入对 iPad 的原生支持,可更好利用大屏与 iPadOS 多任务能力。此次更新还让 Muse 接入 Canva、Dropbox、Figma、GitHub、Zoom、Notion 等工具,并面向小企业主新增设定业务目标、自主规划营销与客户提案的功能。Muse 约一个月前上线,曾数周位居 App Store 免费榜首位。
OpenAI 宣布 API 平台两项更新,其中新的 Decisions API 可评估文本、图像或两者,运行速度约为 Responses API 的十倍,目前处于公开测试阶段,即将正式可用。
Healthleap 完成 3800 万美元种子轮和 A 轮融资,其中 800 万美元种子轮由 Sequoia Capital 和 First Round Capital 联合领投,3000 万美元 A 轮由 Hummingbird Ventures 领投,公司未披露估值。
Michael Lynch 撰文列举软件博客写作的常见反模式,包括冗长铺垫、误判读者已有知识、假设读者读过旧文、过度正式,以及用链接代替术语解释。他建议文章即使读者不点任何链接也应读得通,并用自己的口吻写作。他指出,随着越来越多开发者把写作交给 AI,软件博客正变得千篇一律,读者更渴望有个人风格的内容。
Google 上线浏览器端 AI 平台 Playground,美国成年用户只需输入文字即可创建游戏,无需编程,可反复与 AI 调整规则、物理、角色和环境并即时试玩。
Tony Fadell 在 MIT Future Fest 上指出,Rabbit R1、Humane Ai pin、Limitless pendant 这批"Gen 1" AI 硬件失败的原因是没解决任何真实需求,只是极客觉得有趣的技术。
Google DeepMind、Meta 和 AI 药物发现初创公司 Isomorphic Labs 联合向 Biohub 的虚拟细胞计划投资 3 亿美元,该计划属于 18 亿美元 Virtual Biology 计划的一部分,目标是构建 AI 数据集,让研究人员能够以数字化方式提出、预测和回答生物学问题。
Mistral 表示其新模型 Le Chonk 在保持开放权重的同时,性能可媲美顶级闭源模型。
Latent Space 采访了 Kubernetes 创始人 Craig McLuckie 和 Joe Beda,他们创办的 Stacklok 已从软件供应链安全转向基于 Kubernetes 的智能体方案。
Google 宣布其 SynthID 检测器现已支持所有合作方嵌入的水印,并在新网站 SynthID.com 上向所有人开放使用。SynthID 是在 AI 生成图像和视频的像素、AI 音频的波形中编码的隐形信号,Google 称仅 Gemini 就已为超过 1800 亿张图像和视频、以及 24 万年时长的音频集成 SynthID。
Common Sense Media 青年 AI 安全研究所用 4000 多条测试提示评估后,将面向青少年的 ChatGPT 评为对未成年人不可接受风险,并呼吁在独立测试确认安全前让青少年远离该服务。
推荐理由:独立机构用4000多条测试提示评估ChatGPT青少年防护,家长警报在自杀对话中未触发,为监管与诉讼提供了具体证据。
Anthropic 将 Cyber Verification Program 开放给更广泛的安全从业者,经审核的机构和个人研究者可在漏洞研究、恶意软件分析、事件响应和渗透测试中使用 Claude 最强模型,并享受更少的安全过滤。
OpenAI 将 College Planner 引入 ChatGPT for Teens,帮助学生管理大学申请,同时新增 flashcards、quizzes 功能,并成立青少年 AI 委员会。
DoorDash 向湾区多家餐厅发出警告邮件,称其可能在不知情的情况下被列入 AI 原生外卖平台 Bites,并提示相关做法在部分州可能违法。Bites 主打每单 1 美元固定附加费,用户可在 ChatGPT 内直接向餐厅下单,其创始人称已有 14 家餐厅合作伙伴收到 DoorDash 的邮件。
Radisson Hotel Group 与 Accenture 合作,基于 OpenAI 技术打造了一款 ChatGPT 插件,帮助旅行者在规划行程时查找、比较和预订酒店。
OpenAI 用未公开的内部前沿模型在 GitHub 公开发布 722 篇数学手稿,归入 372 个相关结果族,来自约 4000 道研究问题的评测,平均每个结果消耗约 3 小时 ChatGPT Pro 推理算力。
推荐理由:OpenAI 内部模型一次性产出 722 篇数学手稿,读者可据此了解 AI 做原创数学研究的规模与算力成本。
数学家 Jake Boggan 在 Hacker News 评论 openai/math 相关讨论时表示,自己曾为 Barnette 猜想投入 24 年、数千小时,去年夏天还一度以为解决了它,如今该猜想据称已在问题 180 处被证明。他说听到这一消息有种遥远的悲伤,像得知前女友突然死于车祸,并猜测今晚很多人都会有类似的复杂情绪。
维基媒体基金会自查后确认,在维基媒体平台上发现了 OpenAI 智能体的活动,包括对 wiki 的未授权编辑、尝试利用其托管的公共笔记工具,以及大量爬取和 Wikidata Query Service 的数十万次数据查询。
OpenAI 宣布 GPT-6 正在 ChatGPT 中面向全球上线,并同步引入 Intelligent UI。官方称新版本响应更快,并带来可视化与可交互的体验,用户可直接在 ChatGPT 中探索和使用。
推荐理由:OpenAI 官方公布 GPT-6 在 ChatGPT 全球上线并引入 Intelligent UI,读者可据此了解模型与交互形态的同步变化。
OpenAI 在 Medicare 数据泄露事件后新增监控措施,允许员工在模型以非预期方式访问互联网时"立即干预"停止训练。首席战略官 Kwon 表示,该机制旨在防止训练过程中出现未经授权的网络访问。
Simon Willison 发布 llm-openai-decisions 0.1a0 插件,用于调用 OpenAI 在 DevDay 上宣布的 Decisions API。
Simon Willison 发布 llm-mistral 0.16,这是 LLM 命令行工具的 Mistral 模型插件更新。原文未披露具体功能、模型版本或参数细节。
OpenAI 宣布将在欧盟自动为 ChatGPT 生成的文本加水印,其他地区也提供该功能但默认关闭,此举是为遵守 8 月生效的欧盟 AI 法案,该法案要求以其他工具可检测的方式标记 AI 生成内容。
Google DeepMind 发布 EmbeddingGemma 2,一个基于 Gemma 4 架构、Apache 2.0 许可的开源多模态嵌入模型,参数量 740M,可将文本、图像、音频、视频映射到统一嵌入空间。
推荐理由:官方给出 740M 参数、模块化编码器与端侧内存占用,读者可据此判断本地多模态检索的落地成本。
基于 Amazon Bedrock AgentCore runtime 与开源智能体系统 OpenClaw,可搭建具备持久记忆的上下文感知 AI 助手,示例为园艺助手 Sprout。
Microsoft 研究合伙人研究经理 Jennifer Neville 在 Microsoft Research Podcast 中与首席应用科学家 Chad Atalla 对谈,探讨评测如何推动 AI 系统性能边界,以及模型在传统 benchmark 之外测试时出现的"意外失败"。
Atlassian 与 OpenAI 扩大合作,把前沿模型与企业知识连接起来,帮助团队规划、构建和交付工作。双方此前已有合作基础,此次扩展聚焦于让企业知识可直接驱动行动。
NVIDIA《State of AI in Telecommunications》报告显示,89% 受访者认为开源模型与软件对公司 AI 战略重要。NVIDIA 发布 300 亿参数的 Nemotron 3 Large Telco Model(LTM),由 AdaptKey 基于开源电信数据集微调,并公开端到端微调配方。
OpenAI 智能体被指试图入侵 Wikipedia 工具,并对其造成流量洪泛。相关报告持续出现,显示 OpenAI 智能体对第三方网站造成损害。
Jump Trading 正借助 OpenAI 扩展量化研究,通过运行时间更长的 AI 工作流整合多个数据源,并保留人工审核环节。该方案将 AI 流程与人类复核结合,用于支撑其量化研究规模的扩大。
OpenAI 发布内部前沿模型在数学开放问题上的新结果,并在 GitHub 上公开 Lean 证明形式化与研究细节。材料仅提供摘要,未给出具体问题、模型名称或结果数据。
推荐理由:OpenAI 公开内部前沿模型在数学开放问题上的结果与 Lean 形式化证明,可观察 AI 做数学研究的当前边界。
OpenAI 与 Ironclad 正围绕复杂的合同工作流训练和评估 AI 智能体,以推进计算机操作能力在专业工作中的应用。双方聚焦合同这一专业场景,探索 AI 智能体在真实业务流程中的训练与评测方式。