EasyHub工具与知识
站点导航
中文

网站外观

主色与风格,自由搭配

主色调玫瑰粉
视觉风格不改变内容与功能

柔和渐变 · 立体图标

已应用:玫瑰粉 · 灵感,自动保存到此浏览器。

EASYHUB JOURNAL / 2026-08

2026年8月 AI 资讯

29 篇选读,按原文日期从新到旧。点击标题查看摘要、配图及原文链接。

  1. Ollama

    Ollama 介绍新的用量计费方式

    Ollama 说明套餐包含的用量与按 token 计费方式。具体价格和额度以其当前官方页面为准。

  2. Tencent

    腾讯 Hy4 preview 开放,推进长上下文智能体能力

    Hy4 preview 将混元扩展到 770B 总参数、49B 激活参数和百万级上下文,重点处理编码、跨文档办公与科研任务。权重已开放,也可通过 WorkBuddy、CodeBuddy、元宝、ima、TokenHub 和 OpenRouter 使用;此次仍是预览版,不能把发布时限时体验视为永久免费。

  3. Anthropic

    Anthropic 扩大面向科学研究者的支持

    官方介绍面向研究者的订阅与研究支持计划,以及申请资格和开放范围。

  4. Cohere

    Cohere Parse 发布,处理企业文档中的表格与图像

    Cohere 推出 Parse,将复杂文档、表格和图像转成可供检索与智能体使用的结构化内容,并输出 Markdown。服务覆盖多种部署渠道;成本与准确性数据来自公告中说明的测试条件。

  5. Google

    Gemini Omni 1.1 Flash 增加视频延展与关键帧控制

    Google 更新 Gemini Omni 1.1 Flash,提供场景延展、首尾帧控制、4K 放大和较轻量的草稿生成,便于开发者迭代视频创作流程。4K 放大属于后处理能力,不应改写为所有视频均原生生成 4K。

  6. Anthropic

    Model Hardware Standard 开启研究预览

    Anthropic 向部分研究实验室和先进制造伙伴开放 Model Hardware Standard 研究预览,探索让智能体通过共同接口操作仪器。它仍是合作测试中的规范,不是已普遍部署或正式完成的开放标准。

  7. Alibaba Cloud

    Qwen3.8-Flash-Next 开放权重并预览下一代架构

    Qwen 团队开放 Qwen3.8-Flash-Next 权重,介绍注意力、残差、嵌入和优化方法的变化,面向多模态及工具驱动任务。它也用于提前展示下一代架构方向,不等于完整 Qwen4 系列已经发布。

  8. Google

    Gemini 3.5 Transcribe 增强实时语音转写与文本整理

    Google 介绍 Gemini 3.5 Transcribe,面向实时转写、字幕及语音应用,处理背景噪声、专业术语和口语停顿,并输出较有结构的文本。准确度仍会受音频质量、语言和实际场景影响。

  9. Alibaba Cloud

    QwenWork 国际版开启网页与桌面公开测试

    QwenWork 国际版以公开测试形式提供网页和桌面入口,整合跨应用执行、网页构建及多模态创作。用户可在授权后让智能体处理多步工作,并将有效流程保存为可复用技能。

  10. Z.ai / 智谱

    GLM-5.3-Flash 发布,结合原生多模态与推理效率

    智谱推出重新训练基座的 GLM-5.3-Flash,将多模态输入、混合注意力与成本优化结合,并提供开放权重和本地推理支持。它不是把文本版 GLM-5.3 简单改价,促销价格也不应当作长期定价。

  11. Ollama

    Ollama 介绍 Claude Desktop 连接方式

    Ollama 官方说明如何作为第三方网关接入 Claude Desktop,让开放模型参与现有桌面工作流。

  12. Sarvam AI

    Sarvam 发布 Saaras V4,面向多语言语音识别

    印度 Sarvam AI 推出新一代语音识别模型 Saaras V4,介绍自研编码与语言建模、输出模式和真实语音场景评测。重点覆盖印度语言与英语,不能据此推断所有语言都具有相同识别效果。

  13. Adobe

    Adobe Firefly 扩展音乐、语音与音效生成工作流

    Adobe 将 Firefly 的音乐、语音和音效生成进一步开放,并扩展创作助手及合作模型选择,减少视频与音频制作中的来回切换。生成内容的适用条款需要另行查看,不能据此推断新闻配图也获得转载授权。

  14. Alibaba Cloud

    Qwen3.8-27B 与旗舰模型权重开放,扩展部署选择

    阿里云在这篇公告中介绍 Qwen3.8-27B 及旗舰权重的开放情况。27B 版本面向多模态和较轻量部署,旗舰版本适合更大规模场景;本条使用公告日期,不将其误当成各仓库文件首次出现的精确时刻。

  15. Anthropic

    Claude 文本水印如何工作?

    Anthropic 解释计划用于未来 Claude 模型的文本水印原理,以及输出质量、检测概率和隐私方面的考虑。文章描述的是计划和机制,不能据此认定所有当前 Claude 输出已经添加该水印。

  16. Z.ai / 智谱

    智谱 GLM-5.3 发布,强化复杂编程和长程任务

    智谱介绍 GLM-5.3,沿用 GLM-5.2 基座并扩大后训练,重点提升复杂代码与长程任务。公告同时讨论安全评测,并把权重开放安排在发布之后,不能直接写成当天已经全面开放下载。

  17. Cursor

    Cursor Builds 预先准备云端智能体开发环境

    Cursor Builds 在后台准备代码仓库、依赖和安装脚本执行后的环境,减少云端会话启动等待。环境更新失败时可继续使用上一份成功构建;标题中的提速是发布方报告,不是每个项目的保证。

  18. DeepSeek

    DeepSeek V4 Pro 正式版上线,扩展智能体接口兼容

    DeepSeek 宣布 V4 Pro 正式版同步进入应用、网页和 API,增强智能体工作流,并介绍 Responses API 兼容与 Codex 接入。计费调整在公告中另列生效时间,不能把公布日当成执行日。

  19. Google

    Gemini 3.7 Flash 聚焦编程、智能体和工作效率

    Google 发布 Gemini 3.7 Flash,介绍软件工程、知识工作和网页开发场景中的改进,以及能力和成本之间的取舍。文章的阶段性价格与评测结果反映发布时条件,使用前应查看当前接口说明。

  20. MiniMax

    MiniMax Music 3.0 发布,面向完整歌曲创作

    MiniMax 推出 Music 3.0,可根据创意描述和可选歌词完成作曲、编曲、人声与制作。技术文章介绍如何兼顾长歌曲结构、乐器细节与自然演唱;效果说明来自发布方展示,本站未独立复现。

  21. IT之家

    WorkBuddy 同步电脑与手机任务,支持远程授权和停止

    PC、App 与小程序可同步任务、对话和产物,手机也能批准或停止电脑端任务,并查看不同工作空间。连接电脑模式要求电脑保持开机、两端使用同一账号;此次功能要求 App 1.2.0、PC 5.3.8 或更高版本,电脑锁屏时仍支持远程连接。

  22. Ollama

    Ollama 上线 Nemotron 3.5 Lightning 本地智能体模型

    Ollama 增加 NVIDIA Nemotron 3.5 Lightning,面向本地工具调用、上下文收集和多步任务。文章也介绍 Apple Silicon 的 MLX 运行方式;能否流畅部署仍需结合模型大小和本机内存评估。

  23. Sarvam AI

    Indic DiarBench 开放,评测印度语言多人语音转写

    Sarvam AI 发布面向印度语言的联合语音识别与说话人区分数据集,覆盖多人交谈、打断和重叠语音等情景。音频、标注与评测协议开放获取,帮助检查谁说了什么,而不只比较单人朗读转写。

  24. Ollama

    Muse Glimmer 通过 Ollama 支持本地多模态智能体

    Ollama 接入 Meta 的 Muse Glimmer 开放模型,面向本地编程和长期智能体任务,并支持图像输入。发布说明还介绍 Apple Silicon 上的 MLX 加速与相关运行选项,适合关注本地模型工作流的用户。

  25. Cursor

    Cursor 解释自动模型路由如何平衡能力与成本

    Cursor 介绍 Auto Intelligence 与 Auto Balance 的模型选择机制,以及如何利用任务和生产反馈调整路由。文章发表于八月,但说明该功能此前已推出,因此应将它归为机制解析与后续改进。

  26. ByteDance Seed

    SeedRealtime 发布,探索音视频全双工交互

    字节 Seed 发布 SeedRealtime,在统一模型中处理连续音频、视频和文本,探索边看、边听、边说及主动交互。文章介绍豆包中的应用与实验效果,模型能力不等于对所有设备或服务的无限操作权限。

  27. Tencent

    腾讯扩大 Hy3 国际访问,覆盖产品与云端工作流

    腾讯扩大七月已发布 Hy3 的国际访问渠道,连接 WorkBuddy、创意工作室 Miora 与 TokenHub。Miora 面向图形、视频、3D 和界面产物,TokenHub 提供多模型 API 管理与路由;本次改变的是产品接入和国际分发范围,而非另一款 Hy3 模型。

  28. MiniMax

    MiniMax H3 开放模型资产与推理配套

    MiniMax 宣布开放 H3 视频模型,提供面向不同生成任务的检查点及相关推理资源。权重获取、运行条件与可用任务以发布仓库说明为准,不把模型开放理解为所有在线服务免费。

  29. Alibaba Cloud

    阿里云发布 Qwen3.8-Max,覆盖多模态与长任务

    阿里云介绍 Qwen3.8-Max 的多模态理解、编程、研究与长时间任务能力,并开放所列 API 和产品入口。发布当日提到的模型权重属于后续开放计划,本条不把计划日期写成已完成状态。