跳到正文
今天10月8日周四43 条
  1. TechCrunch · AI58

    Meta 推出新 AI 工具,识别暗中导流儿童性虐待内容的广告

    Meta 宣布推出新的 AI 工具,用于发现那些看似正常、实则将用户导向站外非法儿童性虐待内容的广告和账号。其中一套新的大语言模型系统用于识别所谓 signposting,即广告本身不含非法内容但充当通往非法网站的入口,Meta 因此开始审查广告的跳转目的地而不只是广告内容,并可据此封禁违规网站并对相关账号采取措施。

  2. Microsoft Research71

    微软研究院开源 Agent Lightning v1.0:3500 行代码的轻量智能体 RL 框架

    微软研究院开源 Agent Lightning v1.0,一个约 3500 行代码的轻量智能体 RL 框架,提出 Harnessed Agentic RL 范式,让部署时使用的 agent harness 直接参与强化学习训练,无需在训练框架内重写 agent。

    推荐理由:微软研究院开源 Agent Lightning v1.0,给出真实 harness 参与 RL 训练的设计取舍与实测增益,可对照现有 agent RL 框架评估迁移成本。

10月7日周三
  1. AWS Machine Learning Blog22

    如何为 agentic automation 构建商业论证:超越节省工时

    AWS 提出 Agentic Value Model,用于替代为 RPA 设计的传统 ROI 模型,从时间节省、异常处理、决策质量和变更韧性四个维度衡量 agentic automation 的价值。该框架强调节省的工时并不等于利润,需有明确的变现机制和责任人;AWS 给出的规划区间显示纠错成本可达原交易成本的 1.5–4 倍,人为错误可占运营成本的 2–15%。

  2. AWS Machine Learning Blog22

    Qlik 如何用 Amazon Bedrock 打造企业级可信 AI

    Qlik 基于 Amazon Bedrock 构建 Qlik Answers,为全球超 4 万名客户提供带来源引用的企业级问答。其 Discovery Agent 上线以来已为客户发现超 10 万条异常与离群点,多数启用智能体工具的 Qlik Cloud 账户已在日常使用。

  3. The Verge · AI38

    Meta 的 AI 智能体 Muse 登陆 iPad

    Meta 的 AI 智能体 Muse 通过最新 iOS 更新加入对 iPad 的原生支持,可更好利用大屏与 iPadOS 多任务能力。此次更新还让 Muse 接入 Canva、Dropbox、Figma、GitHub、Zoom、Notion 等工具,并面向小企业主新增设定业务目标、自主规划营销与客户提案的功能。Muse 约一个月前上线,曾数周位居 App Store 免费榜首位。

  4. Simon Willison12

    Michael Lynch 谈软件博客写作的反模式

    Michael Lynch 撰文列举软件博客写作的常见反模式,包括冗长铺垫、误判读者已有知识、假设读者读过旧文、过度正式,以及用链接代替术语解释。他建议文章即使读者不点任何链接也应读得通,并用自己的口吻写作。他指出,随着越来越多开发者把写作交给 AI,软件博客正变得千篇一律,读者更渴望有个人风格的内容。

  5. The Decoder82

    Common Sense Media 将 ChatGPT 青少年版评为不可接受风险,家长警报在自杀对话中未触发

    Common Sense Media 青年 AI 安全研究所用 4000 多条测试提示评估后,将面向青少年的 ChatGPT 评为对未成年人不可接受风险,并呼吁在独立测试确认安全前让青少年远离该服务。

    推荐理由:独立机构用4000多条测试提示评估ChatGPT青少年防护,家长警报在自杀对话中未触发,为监管与诉讼提供了具体证据。

  6. Latent Space88

    OpenAI 内部模型发布 722 篇数学手稿,称解决 500 个公开数学难题中的 90 个

    OpenAI 用未公开的内部前沿模型在 GitHub 公开发布 722 篇数学手稿,归入 372 个相关结果族,来自约 4000 道研究问题的评测,平均每个结果消耗约 3 小时 ChatGPT Pro 推理算力。

    推荐理由:OpenAI 内部模型一次性产出 722 篇数学手稿,读者可据此了解 AI 做原创数学研究的规模与算力成本。

  7. Simon Willison22

    Jake Boggan 谈 Barnette 猜想被 AI 证明:24 年心血与复杂情绪

    数学家 Jake Boggan 在 Hacker News 评论 openai/math 相关讨论时表示,自己曾为 Barnette 猜想投入 24 年、数千小时,去年夏天还一度以为解决了它,如今该猜想据称已在问题 180 处被证明。他说听到这一消息有种遥远的悲伤,像得知前女友突然死于车祸,并猜测今晚很多人都会有类似的复杂情绪。

  8. OpenAI News82

    OpenAI 在 ChatGPT 全球上线 GPT-6 与 Intelligent UI

    OpenAI 宣布 GPT-6 正在 ChatGPT 中面向全球上线,并同步引入 Intelligent UI。官方称新版本响应更快,并带来可视化与可交互的体验,用户可直接在 ChatGPT 中探索和使用。

    推荐理由:OpenAI 官方公布 GPT-6 在 ChatGPT 全球上线并引入 Intelligent UI,读者可据此了解模型与交互形态的同步变化。

10月6日周二
  1. OpenAI News62

    OpenAI 公布前沿模型在数学开放问题上的进展

    OpenAI 发布内部前沿模型在数学开放问题上的新结果,并在 GitHub 上公开 Lean 证明形式化与研究细节。材料仅提供摘要,未给出具体问题、模型名称或结果数据。

    推荐理由:OpenAI 公开内部前沿模型在数学开放问题上的结果与 Lean 形式化证明,可观察 AI 做数学研究的当前边界。