Pinterest 推出 Beauty Guides:用 AI 把美妆 Pin 图变成沙龙行动方案
Pinterest 推出 Beauty Guides,依托其视觉智能与生成式 AI 技术 Pinterest Intelligence,把发型、发色、美甲等美妆类 Pin 图转化为可带去沙龙的行动方案。
Pinterest 推出 Beauty Guides,依托其视觉智能与生成式 AI 技术 Pinterest Intelligence,把发型、发色、美甲等美妆类 Pin 图转化为可带去沙龙的行动方案。
Cohere 将企业平台升级为 North 2,用于统一管理 AI 智能体,可自主处理多步工作流并跨会话保留上下文。新版编排系统协调智能体调用共享知识库和可复用技能,并连接 Slack、SharePoint、Jira 等工具,还能在对话中根据文本提示词生成演示文稿、仪表盘和简单应用。
Google 的 Gemini「Call for Me」AI 功能可能从商务通话扩展到亲友通话。Android Authority 在 APK 拆解中发现「Gemini Calling」引导页,示例包括「打电话给妈妈说我晚到 15 分钟」和「打电话问 John 是否来吃晚饭」,功能预计仍限于类似短信的简短通话。
智谱(Z.ai)的 GLM 5.3 已在 Amazon Bedrock 上线,这是一个 753B 参数的 MoE 模型,面向编码和长周期智能体任务,可通过全托管 API 调用,支持跨区域推理、提示词缓存和服务层级。
推荐理由:GLM 5.3 在 Bedrock 上线,文中给出提示词缓存与安全测试智能体的完整调用示例,可据此评估托管开源模型的落地方式。
Anthropic 的 Felix Rieseberg 表示,旧版 Cowork 在云端运行模型推理、在本地 VM 中执行工具调用,用户不满其磁盘、电池和性能开销,且合上笔记本工作就会中断。
一款命令行工具能从 macOS 27 中快速移除 Apple Intelligence,并可释放超过 12GB 存储空间。
TikTok 周一宣布推出 AI 购物助手和站内一键结账功能,用户可直接在品牌处下单。该购物助手是对话式 AI 智能体,能理解上下文并记住用户偏好,提供商品详情、物流、尺码、库存和完成购买等实时导购。新功能与 Salesforce、Shopify、Shoplazza、Stripe 等商务和支付平台合作搭建,用户可在 For You 信息流中一键购买。
估值 100 亿美元的 Instinct 宣布将 AI 智能体扩展到群聊,用户可把智能体加入与好友的聊天,用于旅行规划、抢票、组织拼车等场景,好友即使没有注册 Instinct 也能参与。
Amazon SageMaker AI 通过 Agent Toolkit for AWS 推出 aws-ai-ml 技能,让 Kiro、Claude Code、Codex 等支持 MCP 的编码智能体具备推理优化与基准测试能力,可对端点做基准测试、推荐部署配置、对比性能并生成可执行的 SageMaker Python SDK v3 代码。
OpenAI 正在为 ChatGPT 和 Codex 的文本输出加入不可见、机器可读的水印,名为 textGrain,初期仅面向欧盟用户,未来几周覆盖欧盟所有套餐。
HackerRank 将其 AI 面试官 Chakra 面向客户正式开放,此前约六个月的测试中已完成超过 50 万场面试,Snowflake、Snorkel、Capgemini 等公司参与试用。
OpenAI 在 ChatGPT 广告产品线中新增视觉展示广告,广告将出现在用户要求生成图片的结果旁,本月晚些时候先在美国上线,面向首批测试广告主。广告会明确标注,且不会影响 ChatGPT 给出的回答。
OpenAI 宣布将在美国测试新的视觉广告形式,广告会以赞助商品和服务的图片形式出现,初期在用户用 ChatGPT 生成图片时展示。此前 ChatGPT 的广告只显示公司名称、logo 和产品链接,位于对话下方的赞助区域;视觉广告同样与生成的图片分离,且不会影响 ChatGPT 给出的回答。
开源命令行工具 RemoveMacAI 能一键关闭 Apple Intelligence 的 Siri、Writing Tools、Genmoji、Image Playground、ChatGPT 扩展及各类摘要功能,删除其基础模型并阻止 macOS 再次下载,释放约 12GB 空间。
OpenAI 将在美国测试新的展示广告,出现在 ChatGPT 生成图像时的加载界面下方,以轮播或一排商品图的形式呈现,广告与生成图像分开并带有广告标识,本月晚些时候面向首批广告主上线。
OpenAI 在 ChatGPT 中引入新的视觉广告形式,并扩展了面向广告主的衡量工具、归因合作与品牌适配能力。
从 2026 年 10 月起,Google 将限制个人账户用户对 Gemini 模型的访问:无订阅用户只能使用最小的 Flash-Lite,不再包含更强的 Flash 和 Pro,而当前免费档位提供 3.6 Flash 和部分 3.1 Pro 访问权限。
Meta 宣布开源项目 Muse Gadgets,提供 ESP32 开发板固件和 Linux SDK,让爱好者把自制设备接入其 AI 智能体 Muse,代码采用 Apache 2.0 许可。
一批 AI 智能体正绕过独立 App,直接以短信方式提供服务,可记忆上下文、连接已有应用并代为完成任务,如安排日程、订餐、购物和发邮件。Instinct 在 9 月完成 10 亿美元融资、估值达 100 亿美元,并开始为用户分配专属邮箱地址、支持代打电话,目前仍处内测。
Meta 推出开源项目 Muse Gadgets,提供开源固件和 Linux SDK,让开发者用 Raspberry Pi、ESP32 等低成本硬件搭建连接 Muse 的个人设备,并给出彩色电子墨水屏、HDMI 电视棒等项目思路,还开设了 Discord 支持频道。
Meta 开源了让用户自制 Muse AI 硬件的代码,Muse 是其新的 AI 智能体。官方建议的玩法包括把 Muse 装到彩色 E Ink 屏上显示提醒、装到 HDMI 棒上投到大屏,或装到小触摸屏上做成类似 DIY Muse Charm 的设备,用户可用现成 ESP32 板或 Raspberry Pi 配合其 SDK 连接屏幕、按钮和传感器。
NVIDIA 将于 10 月 23 日通过 Acer、ASUS、Dell、Gigabyte、HP 和 MSI 推出 64GB 统一内存版 DGX Spark,起售价 4,999 美元,保留 GB10 Grace Blackwell 超级芯片、DGX OS 和完整 NVIDIA AI 软件栈,单机支持最高 1000 亿参数模型。
推荐理由:原文给出 64GB 新配置的定价、上市时间和双机集群性能数据,可据此判断本地跑大模型的门槛变化。
Earendil 旗下 Pi 发布 Pi 1.0 与 Pi Durable,两者同时登上 Hacker News 首页。Pi 1.0 带来 Codemode(原生支持 MCP、Jev 和图像模型)、虚拟模型扩展、延迟工具加载、Anthropic 模型缓存预热、对话中系统消息、新 TUI 主题和默认全屏模式。
GPT-6 Astra Ultrafast 已在 OpenAI API 上线,并向符合条件的 ChatGPT Work 和 Codex 用户开放,运行在 NVIDIA Blackwell GPU 上。
推荐理由:原文给出 Ultrafast 模式相对标准模式的生成速度提升与开放入口,读者可据此判断它对编码智能体循环的实际影响。
Amazon Quick 为 AI 构建的 Quick Apps 推出 Live Data in Apps,应用每次打开都会实时查询受治理的 Quick Sight 数据集,而非发布时的静态快照,查询以查看者身份执行,自动沿用现有 RLS 和 CLS 规则。
社交俱乐部 The Den 在新店开业之际,用 ChatGPT Work 把拨款申请的准备时间从 3 天压缩到 2 小时,酒牌材料从 4 天缩短到 3 小时,每周因此省出 10-15 小时用于业务增长。
Simon Willison 用 GPT-6 Astra 构建了实验性工具 Photo Scrubber,可自动识别人脸并模糊处理。该工具基于 Google 的 MediaPipe C++ 库,通过 @mediapipe/tasks-vision 编译为 WebAssembly,并使用 BlazeFace 人脸检测模型,同时支持移除照片元数据。
微软研究院发布 Quine,一个面向生物学复杂性的 AI 研究系统,由跨序列、结构、功能、细胞状态和成像等多模态数据训练的生物世界模型,以及连接模型、科学工具、文献与实验人员的交互式 harness 组成。
推荐理由:微软研究院公开 Quine 的多模态生物世界模型与实验闭环,并给出胰腺癌化合物筛选的湿实验验证结果。
GitHub Security Lab 发布 Fuzzing Taskflow,一个面向 C/C++ 项目的自主模糊测试流水线,只需指向一个 GitHub 仓库,智能体就会识别入口点、分析构建系统、编写 harness、运行 AFL++、读取覆盖率报告并改进 harness,最后对每个崩溃做分诊并生成漏洞报告。
推荐理由:GitHub Security Lab 把模糊测试的 harness 编写、覆盖率追踪与崩溃分诊交给 LLM 智能体,并公开了完整实现与运行方式。
Google DeepMind 发布 Gemini 3.8 Live with Live Avatar,在原生实时对话模型上加入近实时视频生成,实现带口型同步、自然表情和流畅轮次的视觉化对话,已在 Gemini Enterprise 上线。
推荐理由:官方给出 Live Avatar 的实时视频对话能力、异步工具调用与 97 种语言切换等具体细节,可据此判断企业级多模态交互的落地形态。
Remedy Entertainment 的 CONTROL Resonant 已在 GeForce NOW 首发上线,Ultimate 会员可以 GeForce RTX 5080 级性能串流游玩,支持 DLSS 4、光线追踪与最高 5K HDR,无需 100GB 本地安装。
Google DeepMind 发布 AlphaGenome Atlas,一个包含人类基因组 90 亿个单核苷酸变异效应预测的平台,规模达 1PB,是 AlphaFold Database 的 30 多倍,今日起通过网站门户、AlphaGenome API 和 Google Antigravity 中的 skill 向学术研究免费开放。
推荐理由:AlphaGenome Atlas 把 90 亿个单核苷酸变异的预测结果做成可检索平台,读者可了解基因组变异解读的规模化路径。