AI 日报 · 2026 年 10 月 8 日 · 星期四
MYHOT
Claude Haiku 5.5 上线 Amazon Bedrock 与 Claude Platform on AWS
AWS 宣布 Claude Haiku 5.5 在 Amazon Bedrock 和 Claude Platform on AWS 上可用。
- Anthropic 发布 Claude Haiku 5.5,价格最高下调 90%The Decoder
模型发布/更新
Google DeepMind 发布 EmbeddingGemma 2 开源多模态嵌入模型
Google DeepMind 发布 EmbeddingGemma 2,一个基于 Gemma 4 架构、采用 Apache 2.0 许可的开源多模态嵌入模型,参数量 740M,可将文本、图像、音频和视频映射到统一嵌入空间。
产品发布/更新
OpenAI 随 GPT-6 推出 Intelligent UI,ChatGPT 界面转向可视化交互
OpenAI 推出名为 Intelligent UI 的新界面,随新模型 GPT-6 于周三开始推送,把大量可视化内容整合进对话,其中不少可交互,例如可点击按钮、针对特定任务的定制计算器、交互式图表和可编辑图形。
NVIDIA 与 Microsoft 发布 RTX Spark 笔记本和 Windows 智能体基础设施
在旧金山 Microsoft 活动上,NVIDIA 与 Microsoft 宣布为 Windows PC 上的 AI 智能体共同设计软硬件,并推出 RTX Spark 笔记本与紧凑台式机。
微软研究院开源 Agent Lightning v1.0:3500 行代码的轻量级 Agentic RL 框架
微软研究院开源 Agent Lightning v1.0,一个约 3500 行代码的轻量级 Agentic RL 框架,提出 Harnessed Agentic RL 训练范式,让部署时使用的同一 agent harness 直接参与强化学习,无需在训练框架内重新实现智能体。
GitHub 推出基于 ModernBERT 的密钥检测模型,扩展 push protection
GitHub 发布与 Microsoft Applied Sciences 合作微调的 ModernBERT 分类器,用代码上下文识别无固定格式的密钥,可在 2 毫秒内评估一批候选密钥,据称能把可拦截的密钥数量提升一倍以上。
行业动态
Common Sense Media 将 ChatGPT 青少年版评为不可接受风险,家长警报在自杀对话中未触发
Common Sense Media 青年 AI 安全研究所用 4000 多条测试提示评估 ChatGPT 青少年版,将其评为对未成年人的不可接受风险,并呼吁在独立测试确认安全前禁止青少年使用。
论文研究
OpenAI 公布内部前沿模型在数学开放问题上的进展
OpenAI 发布内部前沿模型在数学开放问题上取得的新结果,并在 GitHub 上公开 Lean 证明形式化及研究细节。
- OpenAI 发布内部模型产出的 722 篇数学论文,覆盖 500 个开放问题中的 90 个Latent Space