Copilot 整合 Home、Code 与 Autopilot,分阶段开放办公智能体
新版 Copilot 将聊天、Cowork 与可编辑的 Office 文件集中到 Home,Code 用于在受管理的环境中构建应用,Autopilot 则面向持续运行的云端任务。Home、Code 将分批进入 Frontier,Autopilot 月底扩大私人预览,并非全部功能已经向所有用户开放;智能体工作另按用量计费。
345 篇选读/52 个来源
新版 Copilot 将聊天、Cowork 与可编辑的 Office 文件集中到 Home,Code 用于在受管理的环境中构建应用,Autopilot 则面向持续运行的云端任务。Home、Code 将分批进入 Frontier,Autopilot 月底扩大私人预览,并非全部功能已经向所有用户开放;智能体工作另按用量计费。
新版 Copilot 将聊天、Cowork 与可编辑的 Office 文件集中到 Home,Code 用于在受管理的环境中构建应用,Autopilot 则面向持续运行的云端任务。Home、Code 将分批进入 Frontier,Autopilot 月底扩大私人预览,并非全部功能已经向所有用户开放;智能体工作另按用量计费。
DeepSeek Harness 桌面开发者预览版 V0.1.7-rc.2 支持 Windows x64 与苹果芯片 Mac,不必先安装 Node.js 或从终端启动 WebUI。标准模式处理代码、文件和资料,PTC 模式面向批量工具结果整理,创造模式可定制插件与界面。当前仍是预览版本,不能等同于稳定版或无人监督的安全执行环境。
LongCat 官方日志宣布 2.5-Preview 上线,新增图片理解与跨模态问答,并加强代码生成、代码理解和多步骤任务,可对接 Claude Code、OpenClaw、OpenCode 等开发环境。API 与网页体验面向服务调用,仍属于预览模型;提供在线入口不等于已经开放模型权重或可以无限免费使用。
Anthropic 邀请物理学作者介绍 Claude Science 如何组织代码与计算,完成特定 N=4 超杨–米尔斯理论中的九圈振幅任务,结果由 Lance Dixon 复核。文章也记录了何颂团队借助 AI 得到相关结果,并强调使用的是已知方法。这不是发现新的物理定律,也不是所有科研问题都能无人监督完成的证明。
LangSmith Fine-Tuning 公测将成功任务的消息、工具调用与结果整理成训练样本,借助 smithtune 完成筛选、训练集拆分、微调和对比评估。训练通过 Fireworks 或 Baseten 执行,需要相应账号与密钥。它适合反复出现的特定任务;数据选择不当也可能降低效果,不能把微调视为必然升级。
腾讯将 Hy-MT2 模型做成独立翻译 App,支持语音、拍照及 33 种语言互译,并覆盖部分民族语言与方言。离线使用前需下载端侧模型;本次 App 先在 12 个国家和地区上线,同时还有小程序、插件与 PC 体验,不能假定所有地区应用商店同步提供。
QClaw 于 9 月 24 日停止新注册及订阅购买、续费,计划在 2026 年 12 月 24 日关闭主要服务,已注册用户此前仍可使用。用户可备份配置、记忆和对话,或授权迁移到个人版 WorkBuddy;停运后备份窗口保留至 2027 年 3 月 24 日。
WorkBuddy 5.6.1 起可通过自然语言生成小程序,并按需接入数据库、登录和文件存储。无自有账号可先创建 14 天试用版;长期运营仍需绑定自己的小程序账号,完成微信审核后发布正式版,生成代码不等于免审核上线。
Google 将原生实时对话与低延迟视频结合,让虚拟形象随语音呈现表情和口型,用于交互讲解等企业场景。发布文章说明该能力进入 Gemini Enterprise,不能据此推断所有个人版账号已可使用。
Sarvam AI 更新文档视觉模型,加入更强的多页表格、表单键值提取和印度语言手写识别,并优化推理服务。文章公开评测口径与弱项,提醒读者不要把英文榜单成绩直接等同于本地语言实用性。
Anthropic 让 201 名员工向 Claude 说明阅读偏好,再由智能体在受控市场里交换书籍,比较集中分配和相互协商的效果。实验发现,准确理解人的喜好比完成讨价还价更困难。研究讨论偏好表达、交易规则与履约问题,不是已经上线的自动购物或交易产品。
作者“Ai学习的老章”介绍了自己的 Qwen Audio Studio,本地界面按播客、广告、有声书等场景组织脚本,可设置角色、参考音色和环境声,并试听、下载及对比版本;还展示了配套自动化 Skill。它是调用 Qwen 音频能力的社区工具,不是阿里官方新客户端,也不代表底层模型在本地离线运行。
鸿蒙版元宝上线后可使用 Hy4 preview 和专家模式,提供写作、语音通话、图片识别、拍照翻译与文档阅读,并支持 Hy Image3.5 preview 生图。搜索可引用公众号与视频号内容,用户可通过微信、QQ 登录延续账号记录;此前仅用手机号注册的用户需要先绑定相应账号。
Meta 在 Connect 介绍 Ray-Ban Meta Audio,将开放式听音、通话和语音助手放进约 43 克的镜架,并更新带相机的 Gen 3 系列。Audio 当天开启预订,计划 10 月 13 日发货;Muse 个人智能体接入眼镜仍是后续方向,不能把预告功能当成当前已经可用。
Anthropic 分享新生命科学研究团队的早期工作:智能体从 DNA 数据中发现带有类似 CRISPR 重复结构的酶系统,并由实验室继续研究。文章明确该系统的功能尚不清楚,不能将其表述为已验证的治疗或基因编辑工具。
Cursor 推出 Rollouts 和 Security Review,帮助团队检查代码合并之后的部署情况、性能变化及安全问题。它们补充开发流程中较耗时的检查工作,但不能取代代码审查、测试和发布责任。
Cursor 说明其如何调整智能体上下文的组装与管理,减少较长运行过程中的重复开销。文章给出生产流量下的成本观察,重点在工作流实现和缓存效率,而不是发布一款新的基础模型。
Google 介绍 Gemini 3.8 Flash TTS 与 Flash-Lite TTS,支持更灵活地控制声音、情绪和对话表现。文章覆盖开发者接口及部分创作产品中的应用,并同时说明声音生成的安全措施。
Google 为 Gemini 增加新一批连接应用,涵盖设计、项目管理和日常安排。用户按需授权后可在对话中使用相应服务;这是逐步推出的集成,不意味着系统会自动获得所有外部账号的访问权限。
Epoch AI 用三套家具的 60 张组装照片及说明书测试模型能否定位装配错误。9 月 23 日报告中,GPT-6 Astra 的得分为 80%,单张照片分析的中位耗时约三分钟。研究呈现了视觉推理进步,也指出样本有限、响应仍慢,不能由此推断已经能够可靠地实时指导各种维修任务。
Ming-Image-0.1-Design 与 Design-Layer 均为 6B 模型,分别面向 UI、海报等文字密集设计的生成,以及将设计图拆成可编辑透明图层。配套 Design Skill、PPT Skill 连接页面和演示文稿工作流。复杂遮挡、精细反光和图层划分仍可能出错,图层粒度也需按实际设计目的调整。
千问发布 ASR、ASR-Next、TTS、TTS-Next 和 Realtime 五款音频模型。更新覆盖转写润色、说话人与时间戳识别、可控语音合成,以及将对白、音效和环境声一并生成的声景创作;实时模型支持双向语音和工具调用。官方账号称 API 已上架千问平台,具体模型和使用额度以服务入口为准。
Copilot for JetBrains 1.18.0 可重新编辑早先的请求,同时回退对应对话与文件改动,并在本地及智能体会话中使用组织共享技能。辅助审批进入公测,低风险工具调用可自动通过,高风险操作仍需确认;还新增 Codex 计划模式和持久化 MCP 工具控制,远程环境的内联聊天入口则暂时隐藏。
Anthropic 发布 Claude Opus 5.5,介绍其在跨代码库修改、计算机使用和知识工作中的改进,同时调整成本、速度与安全防护。性能和节省幅度属于发布方评测,实际效果仍取决于任务及运行环境。
混元 Hy Image3.5 preview 支持文生图、图生图及连续对话编辑,单次最多使用五张参考图,最高输出 2K 图像。模型接入元宝、WorkBuddy、ima、Miora、WorkRally 和 OnSolo 等应用,并提供云 API;这些应用是不同创作入口,不应各算一款新模型。
Hugging Face 将高效运行 GGUF 量化模型的能力接入 Transformers,让开发者沿用熟悉的 Python 接口进行本地推理。首批支持有架构和设备限制,不能理解为全部模型和硬件都已具备相同性能。
OpenAI 介绍长对话和智能体工作流的提示词缓存改进,包括缓存诊断、显式断点,以及调整推理强度或工具可用性时保留可复用上下文。文章侧重集成方法,不代表所有请求都会命中缓存。
OpenAI 为 GPT-6 系列增加 Sol 和 Luna,面向不同成本与延迟要求的工作任务。发布时接入 ChatGPT Work、Codex 和 API;原文明确它们尚未进入普通 Chat,不应混同所有聊天场景的可用状态。
阿里在云栖大会介绍从芯片、模型到智能体的全栈路线,Agent Native Cloud 面向部署与运行管理,Agent Context 连接企业资料、业务系统与长期记忆。公告同时明确 Qwen 4 尚在训练,Qwen-Image 3.1 计划年内推出。已介绍的服务、研究进展与未来目标分开看,不能将整张路线图当作全部正式上线。
小米团队提出 HySparse2,通过两级 KV 共享、按 token 选择历史信息,以及缩短预填充路径,减少长程智能体处理大量工具返回内容的开销。论文在 80B 总参数、3B 激活参数的实验模型上比较检索与推理成本。这是架构研究与预印本结果,不是 MiMo-V3 完整模型已经发布。
MiMo-V2.6 发布 Pro 与 Flash 两款原生多模态模型,结合长上下文处理文字、图像、视频和音频,面向代码、设计与跨工具任务。小米同步公开技术报告、训练环境和强化学习代码,并推进 UltraSpeed 版本开放。模型卡中的总参数、激活参数与部署需求不能混为一谈,开放权重也不代表普通电脑可直接运行。
Hugging Face 介绍即将到来的 tokenizers v1,分析编码、解码和并行扩展方面的优化,减少大规模工作流中 CPU 分词的等待。文章包含候选版本进展,不能把所有提到的优化都视为已完成稳定发布。
OpenAI Academy 增加面向开发者、管理者、教师和学生的课程路径,围绕真实任务练习指令、上下文和结果检查。完成课程考核可获得相应徽章;这与学历或通用职业资格认证不同。
Strands Harness 将文件、终端与网页工具、上下文压缩、会话恢复、长期记忆和子任务协作预先组合,开发者可选不同模型并通过 Python 或 TypeScript 使用,再部署到支持 Linux 容器的环境。它是运行框架而非新模型;厂商给出的节省比例来自特定测试,实际成本还取决于模型、任务和权限配置。
元宝 2.85.0 起可在录音时拍摄板书或幻灯片,将照片、转写和总结聚合为一条记录,并支持录制设备内部声音。用户可修改转写与总结、批量管理录音,再发送到腾讯文档协作,或交给 WorkBuddy 继续制作方案和 PPT。
有明确时刻的资讯按所选时区归档;仅标日期的文章保留原日期。同日仅日期条目列在有明确时刻的条目之后,不虚构先后顺序。核对日期使用 UTC。