AI 智能体遇新障碍:网站拦截与开放标准之争
TechCrunch 报道,Meta 的 Muse、ChatGPT 的 Dots 等个人 AI 智能体在代用户下单、订票时频繁被网站拦截,亚马逊已明确阻止 Muse 访问其零售站点,沃尔玛、达美航空、Yelp、eBay 等也出现类似情况。
TechCrunch 报道,Meta 的 Muse、ChatGPT 的 Dots 等个人 AI 智能体在代用户下单、订票时频繁被网站拦截,亚马逊已明确阻止 Muse 访问其零售站点,沃尔玛、达美航空、Yelp、eBay 等也出现类似情况。
Google 周二上线新网站,任何人都可以验证图像、视频或音频是否由 AI 生成。该工具此前在 Google I/O 上仅向部分记者、媒体从业者和研究人员开放测试,现在向所有人开放,支持 JPG、PNG、MP4、MOV、WAV、MP3 等图像、视频和音频格式。
Google Labs 推出 AI 游戏创作平台 Playground,用户用简单文本提示即可构建浏览器游戏,无需编程经验。创作者可选择问答、竞速等类型,指定 2D 或 3D、单人或多人,并描述玩法机制与视觉风格,还能上传素材由 AI 转成符合整体美术风格的游戏资产。
扎克伯格与 Priscilla Chan 支持的 nonprofit Biohub 正协调一项 18 亿美元的计划,用 AI 模型预测细胞行为,以加速药物研发。
Google 将 SynthID Detector 开放给公众,任何人都可以检测图片、视频或音频是否由 Google 及其合作伙伴的 AI 生成,支持 JPG、PNG、MP4 和 MP3 格式。
Google 上线浏览器端 AI 平台 Playground,美国成年用户只需输入文字即可创建游戏,无需编程,可反复与 AI 调整规则、物理、角色和环境并即时试玩。
Google DeepMind、Meta 和 AI 药物发现初创公司 Isomorphic Labs 联合向 Biohub 的虚拟细胞计划投资 3 亿美元,该计划属于 18 亿美元 Virtual Biology 计划的一部分,目标是构建 AI 数据集,让研究人员能够以数字化方式提出、预测和回答生物学问题。
Google 宣布其 SynthID 检测器现已支持所有合作方嵌入的水印,并在新网站 SynthID.com 上向所有人开放使用。SynthID 是在 AI 生成图像和视频的像素、AI 音频的波形中编码的隐形信号,Google 称仅 Gemini 就已为超过 1800 亿张图像和视频、以及 24 万年时长的音频集成 SynthID。
OpenAI 用未公开的内部前沿模型在 GitHub 公开发布 722 篇数学手稿,归入 372 个相关结果族,来自约 4000 道研究问题的评测,平均每个结果消耗约 3 小时 ChatGPT Pro 推理算力。
推荐理由:OpenAI 内部模型一次性产出 722 篇数学手稿,读者可据此了解 AI 做原创数学研究的规模与算力成本。
Google DeepMind 发布 EmbeddingGemma 2,一个基于 Gemma 4 架构、Apache 2.0 许可的开源多模态嵌入模型,参数量 740M,可将文本、图像、音频、视频映射到统一嵌入空间。
推荐理由:官方给出 740M 参数、模块化编码器与端侧内存占用,读者可据此判断本地多模态检索的落地成本。
独立研究者 Syed Anas Mohiuddin 测试了 Google、摩根大通、Weaviate、Rapid7、法国政府部际数字事务局和美国联邦政府的智能体,发现 MCP(Model Context Protocol)存在信任缺口,可被利用实施概念验证攻击。
MIT Technology Review 的 EmTech Future 2026 活动探讨 AI 与生物学、基础设施、制造业和科学的交叉融合,Google Research 负责人 Yossi Matias 分享了 AI 如何开始重塑这些领域。
OpenAI 发布 GPT-6.1 Sol,定价 $2/$10 per million input/output tokens,比 Astra 的 $10/$50 大幅降低,在 DeepSWE v1.1 上超 GPT-6 Sol 6.4 分。
前 Google DeepMind 研究员指出,LLM 的思维链仍由同一套 next-token 预测生成,并非真正独立的推理机制。他认为这类模型缺乏可检视的持久认知状态、知识与推理的分离,且思维链常是事后编造;真正的机器推理应借鉴 AlphaGo 的搜索架构。
Google DeepMind 发布新前沿模型 Gemini 4 Argon,先通过 Fairwind Program 向受信任的网络安全防御者开放,随后逐步扩展至开发者、企业和消费者。
推荐理由:官方给出 Gemini 4 Argon 在编码、企业知识与网络安全防御上的基准表现和分阶段开放路径,可据此判断前沿模型的能力边界与获取节奏。
Google DeepMind 推出 SynthID Bio,把水印技术引入合成生物学,将不可感知的签名直接嵌入生物代码,使水印不仅能在数字模型上验证,也能在合成出的实体蛋白质上验证,同时保持其生物功能。
推荐理由:SynthID 水印从图像扩展到合成生物,读者可了解 AI 生成蛋白质的可验证溯源思路与湿实验验证结果。
Google DeepMind 发布 Gemini 3.8 Live with Live Avatar,在 Gemini 3.8 Live 基础上为原生实时对话模型加入近实时视频生成,实现带唇形同步、表情和自然轮次切换的动态视觉形象。
推荐理由:官方给出 Live Avatar 的实时音视频能力、97 种语言切换与企业定制入口,可据此判断多模态对话的产品化边界。
Google DeepMind 公布 Private AI Compute 的新技术能力,将持久化服务端记忆引入该平台,使 AI 助手能在跨设备场景下保留上下文。
推荐理由:Google 公开了云端持久记忆的隐私架构细节,读者可据此理解跨设备 AI 记忆如何在密钥留在本地的前提下实现。
Google DeepMind 推出 Gemini 3.8 Flash TTS 和 Gemini 3.8 Flash-Lite TTS 两款语音生成模型,前者面向角色设计与逐行表演指导,后者面向高并发配音与语音智能体。
推荐理由:官方给出两款 TTS 模型的语音定制能力、基准排名与开放渠道,可据此判断语音生成在配音与有声内容上的可用边界。
Google DeepMind 发布 Gemini 3.8 Live 和 Gemini 3.8 Live Extended Thinking 两款实时对话模型,分别面向规模化成本效率与高复杂度任务。
推荐理由:官方给出两款语音模型的基准成绩与开放渠道,读者可据此判断语音智能体的能力与成本取舍。
Google DeepMind 发布 AlphaGenome Atlas,一个包含人类基因组 90 亿个单核苷酸变异效应预测的平台,规模达 1PB,是 AlphaFold Database 的 30 倍以上,今日起通过网站门户、AlphaGenome API 和 Google Antigravity 中的 skill 向学术研究免费开放。
推荐理由:AlphaGenome Atlas 把全基因组变异预测做成可检索资源,读者可了解其数据规模与在罕见病研究中的验证案例。