Hark 发布主打隐私的 AI 个人助手 Hark Pro
创业公司 Hark 正式发布 AI 个人助手 Hark Pro,用户可免费使用,重度用户可选订阅档。该产品基于专门为电脑操作训练的模型,可接入邮件、日历、硬盘和信用卡等信息代为执行数字任务,并在小窗口中展示智能体浏览网页的过程以建立信任。
创业公司 Hark 正式发布 AI 个人助手 Hark Pro,用户可免费使用,重度用户可选订阅档。该产品基于专门为电脑操作训练的模型,可接入邮件、日历、硬盘和信用卡等信息代为执行数字任务,并在小窗口中展示智能体浏览网页的过程以建立信任。
Google 周二上线新网站,任何人都可以验证图像、视频或音频是否由 AI 生成。该工具此前在 Google I/O 上仅向部分记者、媒体从业者和研究人员开放测试,现在向所有人开放,支持 JPG、PNG、MP4、MOV、WAV、MP3 等图像、视频和音频格式。
Google Labs 推出 AI 游戏创作平台 Playground,用户用简单文本提示即可构建浏览器游戏,无需编程经验。创作者可选择问答、竞速等类型,指定 2D 或 3D、单人或多人,并描述玩法机制与视觉风格,还能上传素材由 AI 转成符合整体美术风格的游戏资产。
Artcraft 品牌从可控 AI 图像视频编辑转向推出七款开源应用,复刻 Photoshop、Illustrator、Premiere、Lightroom、After Effects、InDesign 和 Acrobat Pro 的界面与工具。
微软在旧金山 Tech Week 活动上公布新款 Surface Laptop Ultra 的规格与价格,两个基础型号分别 2600 美元和 3700 美元起。
OpenAI 在 ChatGPT 上线 Intelligent UI 功能,让回答可以结合图表、示意图、表单和可点击按钮等交互式视觉内容,该更新与 GPT-6 一同向所有用户推送。
NVIDIA 与 Microsoft 在旧金山 Windows AI and Surface 活动上宣布为 Windows PC 的 AI 智能体共同设计软硬件,Microsoft 宣布 OS 级基础设施 Microsoft Execution Containers(MXC)正式可用,让智能体在系统控制下安全持久地在后台运行。
推荐理由:NVIDIA 与 Microsoft 把智能体运行所需的系统级容器和本地算力一并给出,读者可据此判断本地智能体工作流的硬件门槛。
Meta 周三宣布其 Muse 助手推出独立 iPad 应用,距 9 月 8 日在 iOS 和 Android 上线仅一个月。据 Sensor Tower 估算,Muse 上线以来安装量已超过 660 万次。
在 Windows 与 Surface 活动上,微软展示了 Copilot 的升级,将可访问 PC 本地文件并在系统内执行操作,这一思路被命名为 Hybrid Intelligence,由本地与云端模型混合完成任务。
OpenAI 推出名为 Intelligent UI 的新界面,随新 GPT-6 模型于周三开始推送,在对话中大量加入可交互的按钮、定制计算器、交互式图表和可编辑图形等元素。
Google 将 SynthID Detector 开放给公众,任何人都可以检测图片、视频或音频是否由 Google 及其合作伙伴的 AI 生成,支持 JPG、PNG、MP4 和 MP3 格式。
微软面向开发者的高端 AI 迷你主机 Surface RTX Spark Dev Box 开启预售,售价约 6000 美元,11 月开始发货。该机采用 Nvidia Arm 架构 RTX Spark 平台和 128GB 统一内存,针对本地 AI 优化,可运行超过 120B 参数的模型,用于测试 AI 模型、原型开发 AI 智能体或在本地运行 AI 编码工具。
GitHub 发布与 Microsoft Applied Sciences 联合微调的 ModernBERT 分类器,用代码上下文识别无固定格式的密钥,候选批次评估耗时低于 2 毫秒,可将可拦截的密钥数量提升一倍以上。
推荐理由:GitHub 用九个季度数据说明密钥泄露的增速,并给出把检测前移到 push 环节的模型方案与开放节奏。
OpenAI 为 ChatGPT for Teens 新增 College Planner 功能,把申请要求、截止日期、任务和助学金步骤整合成一份计划,学生可随时更新进度并向 ChatGPT 提问,该功能将“很快”上线,美国市场先面向 10 至 12 年级、计划就读四年制大学的学生。
微软研究院开源 Agent Lightning v1.0,一个约 3500 行代码的轻量智能体 RL 框架,提出 Harnessed Agentic RL 范式,让部署时使用的 agent harness 直接参与强化学习训练,无需在训练框架内重写 agent。
推荐理由:微软研究院开源 Agent Lightning v1.0,给出真实 harness 参与 RL 训练的设计取舍与实测增益,可对照现有 agent RL 框架评估迁移成本。
Meta 的 AI 智能体 Muse 通过最新 iOS 更新加入对 iPad 的原生支持,可更好利用大屏与 iPadOS 多任务能力。此次更新还让 Muse 接入 Canva、Dropbox、Figma、GitHub、Zoom、Notion 等工具,并面向小企业主新增设定业务目标、自主规划营销与客户提案的功能。Muse 约一个月前上线,曾数周位居 App Store 免费榜首位。
OpenAI 宣布 API 平台两项更新,其中新的 Decisions API 可评估文本、图像或两者,运行速度约为 Responses API 的十倍,目前处于公开测试阶段,即将正式可用。
Google 上线浏览器端 AI 平台 Playground,美国成年用户只需输入文字即可创建游戏,无需编程,可反复与 AI 调整规则、物理、角色和环境并即时试玩。
Latent Space 采访了 Kubernetes 创始人 Craig McLuckie 和 Joe Beda,他们创办的 Stacklok 已从软件供应链安全转向基于 Kubernetes 的智能体方案。
Google 宣布其 SynthID 检测器现已支持所有合作方嵌入的水印,并在新网站 SynthID.com 上向所有人开放使用。SynthID 是在 AI 生成图像和视频的像素、AI 音频的波形中编码的隐形信号,Google 称仅 Gemini 就已为超过 1800 亿张图像和视频、以及 24 万年时长的音频集成 SynthID。
OpenAI 将 College Planner 引入 ChatGPT for Teens,帮助学生管理大学申请,同时新增 flashcards、quizzes 功能,并成立青少年 AI 委员会。
Simon Willison 发布 llm-openai-decisions 0.1a0 插件,用于调用 OpenAI 在 DevDay 上宣布的 Decisions API。
Simon Willison 发布 llm-mistral 0.16,这是 LLM 命令行工具的 Mistral 模型插件更新。原文未披露具体功能、模型版本或参数细节。
Jump Trading 正借助 OpenAI 扩展量化研究,通过运行时间更长的 AI 工作流整合多个数据源,并保留人工审核环节。该方案将 AI 流程与人类复核结合,用于支撑其量化研究规模的扩大。
NVIDIA 将于本月通过 Acer、ASUS、Dell、Gigabyte、HP 和 MSI 推出 64GB 统一内存版 DGX Spark,10 月 23 日开售,起售价 4,999 美元,保留 GB10 Grace Blackwell 超级芯片、DGX OS 与完整 NVIDIA AI 软件栈,单机支持最高 1000 亿参数模型。
推荐理由:原文给出 64GB 新配置的定价、上市时间与双机集群方式,读者可据此判断本地跑大模型的硬件门槛。
Earendil 旗下 Pi 发布 1.0 与 Pi Durable 两个版本,同时登上 Hacker News 首页。Pi 1.0 带来 Codemode(原生支持 MCP、Jev 与图像模型)、虚拟模型扩展、延迟工具加载、Anthropic 模型缓存预热、对话中途系统消息、新 TUI 主题和默认全屏模式。
OpenAI 的 GPT-6 Astra Ultrafast 已在 OpenAI API 上线,并向符合条件的 ChatGPT Work 和 Codex 用户开放,运行在 NVIDIA Blackwell GPU 上。
推荐理由:原文给出 Ultrafast 模式相对标准模式的加速倍数与开放入口,读者可据此判断它对编码智能体循环的实际影响。
微软研究院发布 Quine,一个面向生物学复杂性的 AI 研究系统,由跨序列、结构、功能、细胞状态和成像等多模态数据训练的生物世界模型,以及连接模型、科学工具、文献和实验人员的交互式 harness 组成。
推荐理由:微软研究院公开 Quine 的生物世界模型与实验闭环,并给出胰腺癌化合物筛选的湿实验验证结果。
GitHub Security Lab 发布 Fuzzing Taskflow,一个面向 C/C++ 项目的自主模糊测试流水线,只需指向一个 GitHub 仓库,它就能识别入口点、分析构建系统、编写 harness、运行 AFL++、读取覆盖率报告、改进 harness、分诊崩溃并为每个独立缺陷生成漏洞报告。
推荐理由:GitHub 安全实验室把模糊测试的写 harness、读覆盖率、崩溃分诊交给 LLM 智能体,读者可了解其任务流设计与安全边界。
Google DeepMind 发布 Gemini 3.8 Live with Live Avatar,在 Gemini 3.8 Live 基础上为原生实时对话模型加入近实时视频生成,实现带唇形同步、表情和自然轮次切换的动态视觉形象。
推荐理由:官方给出 Live Avatar 的实时音视频能力、97 种语言切换与企业定制入口,可据此判断多模态对话的产品化边界。
Google DeepMind 公布 Private AI Compute 的新技术能力,将持久化服务端记忆引入该平台,使 AI 助手能在跨设备场景下保留上下文。
推荐理由:Google 公开了云端持久记忆的隐私架构细节,读者可据此理解跨设备 AI 记忆如何在密钥留在本地的前提下实现。
Google DeepMind 发布 AlphaGenome Atlas,一个包含人类基因组 90 亿个单核苷酸变异效应预测的平台,规模达 1PB,是 AlphaFold Database 的 30 倍以上,今日起通过网站门户、AlphaGenome API 和 Google Antigravity 中的 skill 向学术研究免费开放。
推荐理由:AlphaGenome Atlas 把全基因组变异预测做成可检索资源,读者可了解其数据规模与在罕见病研究中的验证案例。