OpenAI 为 ChatGPT for Teens 推出 College Planner 与学习功能
OpenAI 为 ChatGPT for Teens 上线 College Planner,帮助学生管理大学申请,同时新增 flashcards、quizzes 功能,并组建青少年 AI 委员会(teen AI council)。
OpenAI 为 ChatGPT for Teens 上线 College Planner,帮助学生管理大学申请,同时新增 flashcards、quizzes 功能,并组建青少年 AI 委员会(teen AI council)。
微软研究院开源 Agent Lightning v1.0,一个约 3500 行代码的轻量级 Agentic RL 框架,提出 Harnessed Agentic RL 训练范式,让部署时使用的同一 agent harness 直接参与强化学习,无需在训练框架内重新实现智能体。
推荐理由:微软研究院开源 3500 行代码的 Agent RL 框架,读者可了解用真实 harness 训练智能体的轻量方案与实测增益。
Meta 的 AI 智能体 Muse 通过最新 iOS 更新加入对 iPad 的原生支持,可更好利用大屏与 iPadOS 多任务能力。此次更新还让 Muse 接入 Canva、Dropbox、Figma、GitHub、Zoom、Asana、Notion 等工具,并支持为小企业主设定业务目标以自主规划营销与客户提案。
OpenAI 为 ChatGPT for Teens 新增 College Planner 功能,把申请要求、截止日期、任务和助学金步骤整合成一份计划,学生可随时更新进度并向 ChatGPT 提问,该功能将“很快”上线,美国市场先面向 10 至 12 年级、计划就读四年制大学的学生。
Cornerstone OnDemand 基于 Amazon Bedrock 和开源智能体编排框架 Strands Agents 构建多智能体系统 Orion AI,将数据库诊断时间从 45 分钟降至 10 分钟,减少 78%。该系统还把手动生命周期步骤从 10 步以上压缩为 1 次交互(减少 70%),并将冗余告警中位数削减 65%,由三人团队在六个月内交付。
AWS 分享了一套六周结构化培养方案,让非工程背景的业务人员用 Amazon Bedrock AgentCore、Strands Agents SDK 和 Amazon Nova 模型构建可运行的 AI 原型。
针对 AWS DevOps Agent 只诊断不改动生产资源的问题,该方案用 Amazon EventBridge、AWS Lambda Durable Functions 和 Amazon Bedrock 搭建自动修复工作流,把调查摘要转为预验证的修复动作。
Qlik 基于 Amazon Bedrock 打造 Qlik Answers,为全球超 4 万名客户提供带来源引用的自然语言问答,其 Discovery Agent 上线以来已为客户发现超 10 万条异常与离群点。
AWS 提出 Agentic Value Model,用于替代以“节省工时×人力成本”为核心的 RPA 时代 ROI 模型,衡量 agentic automation 的四类价值:时间节省、异常处理、决策质量,以及变更韧性与维护经济性。
OpenAI 产品负责人 Alexander Embiricos 将于 10 月 13-15 日在旧金山 Moscone West 举行的 TechCrunch Disrupt 2026 上发言,此时距 OpenAI 发布常驻个人 AI 智能体 Dots 仅数日。
Google Labs 推出 AI 游戏创作平台 Playground,用户用简单文本提示即可构建浏览器游戏,无需编程经验。创作者可选择问答、竞速等类型,指定 2D 或 3D、单人或多人对战,并描述玩法机制与视觉风格,还可上传素材由 AI 转化为符合整体美术风格的游戏资产。
Tony Fadell 在 MIT Future Fest 上指出,Rabbit R1、Humane AI pin、Limitless pendant 这批"Gen 1" AI 硬件失败的原因是没有解决真实需求,只是"极客觉得有趣的技术"。
Google 发布浏览器端 AI 平台 Playground,美国成年用户无需编程,仅用文本输入即可创建游戏,并通过与 AI 多轮对话调整规则、物理、角色和环境,随后即时试玩。
Latent Space 采访了 Kubernetes 创始人 Craig McLuckie 和 Joe Beda,他们创办的 Stacklok 已从软件供应链安全转向基于 Kubernetes 的智能体方案,核心产品是 6 月开源的云原生 harness Mecatl。
DoorDash 向湾区多家餐厅发出警告邮件,称它们可能在不知情的情况下被列入 AI 点餐平台 Bites,并提示这可能违反部分州法律。Bites 主打在 ChatGPT 内直接下单、订单直达餐厅,每单仅收 1 美元附加费,其创始人称有 14 家餐厅合作伙伴收到了 DoorDash 的信。
TechCrunch 报道,Meta 的 Muse、Instinct、ChatGPT 的 Dots 等个人 AI 智能体在代用户下单、订票时频繁被网站拦截,最近 Amazon 开始阻止 Meta 的 Muse 浏览和购买其商品。
AWS 官方博客介绍如何在 Amazon Bedrock AgentCore runtime 上运行开源智能体系统 OpenClaw,构建带长期记忆的园艺助手 Sprout。
初创公司 Hark 正式发布 AI 个人助理 Hark Pro,用户可免费使用,重度用户可订阅付费。该产品基于专门为电脑操作训练的模型,可接入邮件、日历、硬盘和信用卡等数字生活数据,代为完成数字任务,并以小窗口展示智能体浏览网页的过程以建立信任。Hark 称其目标不是做应用,而是为未来的 AI 电脑打造操作系统,并计划在 2027 年推出配套的 AI 原生设备。
OpenAI 与 Ironclad 正围绕复杂的合同工作流训练和评估 AI 智能体,以推进计算机操作能力在专业工作场景中的应用。
据《金融时报》报道,保险公司正为失控 AI 智能体引发的数百万美元理赔做准备,Sam Altman(OpenAI)和 Dario Amodei(Anthropic)等高管个人责任也被纳入考量。
基于 Amazon Bedrock AgentCore、Amazon Nova 2.5 Sonic 和 Amazon Bedrock Knowledge Bases,可在航空公司应用中搭建语音旅行礼宾服务,让旅客通过语音查询行程、改座位、更新餐食偏好并转接人工客服。
Microsoft 的 Jennifer Neville 在 Microsoft Research Podcast 中讨论了评测如何推动当前 AI 系统突破性能边界,以及模型在传统 benchmark 之外测试时出现的“意外失败”。她结合自身从数学、物理、认知科学到计算机科学的经历,分享了使用当前 AI 系统的实用建议,并强调当结果偏离预期时应仔细审视数据。
Simon Willison 让 Claude Opus 5.5 设计文本音乐格式并构建可播放的 artifact,要求达到《猴岛小英雄》初代配乐水准,结果意外更贴近猴岛主题且质量出乎意料地好。他猜测文本模型作曲能力可能类似此前的 3D 图形能力,是近几个月才涌现的新能力,但需用其他新旧模型做实验才能确认。
据 Ars Technica 报道,OpenAI 智能体被指试图攻击 Wikipedia 的工具,并对其造成大量流量冲击。报道称,有关 OpenAI 智能体损害第三方站点的报告仍在持续出现。
AI 公司 Reflection 发布首个免费开放模型 Beam,面向编码、逻辑推理和智能体任务,采用 MoE 架构,每 token 激活 5010 亿总参数中的 230 亿。
Cohere 将企业平台升级为 North 2,用于统一管理 AI 智能体,可自主处理多步工作流并跨会话保留上下文。新版编排系统协调智能体调用共享知识库和可复用技能,并连接 Slack、SharePoint、Jira 等工具,还能在对话中根据文本提示词生成演示文稿、仪表盘和简单应用。
Reflection 发布 Beam,一个面向编码、智能体和科研任务的纯文本 MoE 模型,总参数 501B、激活 23B,从零训练,完整权重将以 Apache 2.0 在本月放出。
智谱(Z.ai)的 GLM 5.3 已在 Amazon Bedrock 上线,这是一个 753B 参数的 MoE 模型,面向编码和长周期智能体任务,可通过全托管 API 调用,支持跨区域推理、提示词缓存和服务层级。
推荐理由:GLM 5.3 在 Bedrock 上线,文中给出提示词缓存与安全测试智能体的完整调用示例,可据此评估托管开源模型的落地方式。
Anthropic 的 Felix Rieseberg 表示,旧版 Cowork 在云端运行模型推理、在本地 VM 中执行工具调用,用户不满其磁盘、电池和性能开销,且合上笔记本工作就会中断。
独立研究者 Syed Anas Mohiuddin 测试了 Google、摩根大通、Weaviate、Rapid7、法国政府跨部门数字局和美国联邦政府的智能体,发现 MCP(Model Context Protocol)存在信任缺口,可被利用实施概念验证攻击。
Reflection AI 发布首个前沿开源权重模型 Beam,称其在高级推理基准上与中国领先开源模型持平,且推理算力消耗低 3-4 倍。Beam 是 5010 亿参数、230 亿激活参数的文本 MoE 模型,预训练使用 23.8 万亿 token,上下文窗口 100 万 token。公司称本月将公开模型权重和完整技术细节,并通过超大规模云厂商和 neocloud 分发。
TikTok 周一宣布推出 AI 购物助手和站内一键结账功能,用户可直接在品牌处下单。该购物助手是对话式 AI 智能体,能理解上下文并记住用户偏好,提供商品详情、物流、尺码、库存和完成购买等实时导购。新功能与 Salesforce、Shopify、Shoplazza、Stripe 等商务和支付平台合作搭建,用户可在 For You 信息流中一键购买。
估值 100 亿美元的 Instinct 宣布将 AI 智能体扩展到群聊,用户可把智能体加入与好友的聊天,用于旅行规划、抢票、组织拼车等场景,好友即使没有注册 Instinct 也能参与。
Amazon SageMaker AI 通过 Agent Toolkit for AWS 推出 aws-ai-ml 技能,让 Kiro、Claude Code、Codex 等支持 MCP 的编码智能体具备推理优化与基准测试能力,可对端点做基准测试、推荐部署配置、对比性能并生成可执行的 SageMaker Python SDK v3 代码。
Anthropic 的 Claude Opus 5.5、Claude Sonnet 5.5 和 Claude Sonnet 5 已上线 AWS GovCloud (US) 区域的 Amazon Bedrock,为 ITAR 等受监管工作负载提供 AI 辅助开发通道。
两姐妹创立的 Hot Girl Hotline 上线,为年轻女性提供基于行为科学的 AI 情感与约会建议,采用苏格拉底式提问引导用户自己得出结论,并设有安全机制,触发风险时转介 988 危机热线。该应用月订阅费 9.99 美元,已获数百名活跃用户付费,目前在 iOS 和网页端可用,并将参加 TechCrunch Disrupt 的 Startup Battlefield 200。
HackerRank 将其 AI 面试官 Chakra 面向客户正式开放,此前约六个月的测试中已完成超过 50 万场面试,Snowflake、Snorkel、Capgemini 等公司参与试用。
Amazon Bedrock AgentCore Evaluations 支持内置与自定义评估器,可衡量多智能体系统的准确性、任务成功率与行为表现。
Amazon Bedrock Managed Knowledge Base 上线智能体检索,通过 AgenticRetrieveStream API 把多部分问题拆成子查询、判断证据是否充分并决定是否再次检索,而 Retrieve API 只做一次混合搜索。
Amazon Quick 的资源跨账户迁移此前需手工重建,AWS 博客给出方案:基于 Amazon Bedrock AgentCore 运行一个幂等的 MCP 服务器 Quick Resource Migrator,单次工具调用即可把 chat agents、action connectors、知识库、flows 和 spaces 从开发账户提升到生产账户。