AGENT PULSEAI 行业证据与趋势
Star235
EVIDENCE TIMELINE

事件时间线

按月查看已核验的行业事件和重要研究,可按领域或内容类型筛选。

340 个事件
135 个事件
最近进展 2026年8月9日 · Langfuse

v4.5.0

Langfuse 发布 v4.5.0,新增提示词批量导入导出、结构仪表盘、计费解析器、工具静默模式、并发后台运行限制等功能,并修复多项问题。Cline 发布 v4.1.6,新增 meta/muse-spark-1.2-contributor 模型,并修复属性错误遥测。OpenAI Java SDK 发布 v4.50.0,新增 GPT-5.5 模型和可选工具名称/命名空间字段。

open-sourceLangfusev4.5.0Cline
6 次进展多方报道
最近进展 2026年8月18日 · LiteLLM

v1.97.0

LiteLLM 发布 v1.97.0,所有 Docker 镜像均使用 cosign 签名,每个版本使用同一密钥(首次引入于 commit 0112e53)。用户可通过固定 commit hash 或 release tag 验证签名。该版本新增功能:在 /cursor/chat/completions 上解析 Cursor thinking/fast 模型名称后缀;修复 team-callbacks 中 disable_logging 调用时停止日志记录的问题。

open-sourceLiteLLMv1.97.0cosign
4 次进展多方报道
最近进展 2026年8月19日 · MS-SWIFT

v4.5.2

MS-SWIFT 发布 v4.5.2 版本,修复了 Qwen3.8-35B-A3B 模型的错误尺寸配置,该配置在开发过程中从之前的 Qwen3.5/3.6 系列错误复制而来。社区报告了此问题。

bug-fixMS-SWIFTv4.5.2Qwen3.8-35B-A3B
8 次进展多方报道
最近进展 2026年8月5日 · Cline

v4.1.3

Cline 发布 v4.1.3 版本,修复了组合发布包中两个 bundle 相互使对方 Cline 账户会话失效的问题;升级后的旧窗口刷新 token 会消耗共享 refresh token 导致“Unauthorized”提示和意外登出,现在升级后的旧窗口保持当前会话并显示一次性 Reload Window 提示。迁移到新扩展无法识别的模型 id 时回退到默认 Cline 模型,而非让 provider 未配置。恢复可靠的检查点:检查点一致创建,恢复时回滚整个工作区而非部分文件。保留 provider 配置加载完成前的设置编辑(base URL、API key、Qwen/Moonshot API 行不再被静默丢弃)。修复自定义 base URL 字段丢失按键的问题,并在清除失败后保留自定义 URL 复选框状态。推理时使用 AskSage 自定义 API URL 而非忽略。编辑消息替换会话时,待处理的工具审批会被解决。

bug-fixClinev4.1.3bug fix
8 次进展多方报道
最近进展 2026年8月15日 · Cline

Desktop v0.0.12

Cline 发布 Desktop v0.0.12,为每个工具调用在 transcript 中分配独立行,包含图标、状态和可展开详情;命令以终端风格显示(如 $ bun test),编辑以逐 hunk 的 diff 内联展示;运行中的工具行以品牌紫色高亮,完成后变灰,错误保持红色;文件 diff 通过共享的语法高亮渲染器呈现,跟随应用主题而非浏览器主题;刷新了会话 transcript 布局、消息表面和 composer,采用新的 Inter 和 Geist Mono 字体;思考指示器在工具参数流式传输等安静时段保持显示;消息操作(复制、分叉、时间戳)不再拥挤消息文本,展开面板以全不透明度渲染;欢迎屏幕聊天输入居中并顶部对齐,提示建议暂时隐藏;新会话首轮不再卡在“Agent is working...”状态;计划运行不再出现在 transcript 中。Xiaomi MiMo 发布 v0.1.12,包含 CLI 新增 --yolo 权限绕过别名、bash 临时作用域删除豁免强制确认、会话重试 GPT 服务器过载错误、技能搜索黑名单提醒模型、认证停止向子进程传递用户凭据、Compose Next 模型可调用等修复。

desktop-apptool-calltranscriptdiff
4 次进展多方报道
近 7 天 · 最近进展 2026年8月24日 · Claude Code

v2.1.241

Anthropic 发布了 Claude Code 的 v2.1.241 版本,更新内容为 bug 修复和可靠性改进。Cherry Studio 发布了 v2.0.8 版本,包含多项修复和新功能,如技能全局启用控制、代理浮动任务进度胶囊等。

developer-toolsClaude CodeCherry Studiobug fixes
3 次进展多方报道
近 7 天 · 最近进展 2026年8月21日 · FastGPT

v4.16.1

FastGPT 发布 v4.16.1,更新 Agent Sandbox 环境变量和运行态镜像,并引入迁移工具将 MCP/HTTP 工具的 JSON Schema 统一为字符串存储。

open-sourceFastGPTv4.16.1Agent Sandbox
2 次进展多方报道
最近进展 2026年8月19日 · MiMo-Code

v0.1.13

MiMo-Code 发布 v0.1.13,包含多项修复与功能:运行时使用 Node API 进行哈希和 FTS 查询;移除死开发分支和 beta 发布路径;MIMOCODE_AUTO_APPROVE_DELETE 标志改为惰性读取;删除询问豁免改为实例级;重放空的 Anthropic thinking 块;yolo 自动批准删除;checkpoint 增加禁用开关;标识符时间戳扩展至 64 位;隐藏禁用生命周期提示;稳定 MCP 工具排序;动态系统提示内容受标志控制;新增 MIMOCODE_DISABLE_AGENTS_SKILLS 标志;技能目录去重。

open-sourceMiMo-Codev0.1.13runtime
3 次进展多方报道
最近进展 2026年8月13日 · Claude Code

v2.1.231

Claude Code v2.1.231 修复了 MCP OAuth 登录时因重定向 URI 不匹配而失败的问题,该问题影响使用预注册 OAuth 客户端的服务器(如 Slack)。

developer-toolsMCPOAuthClaude Code
2 次进展多方报道
近 7 天 · 最近进展 2026年8月23日 · LiteLLM

v1.98.0

LiteLLM 发布 v1.98.0,所有 Docker 镜像均使用 cosign 签名,并提供了通过固定 commit hash 或 release tag 验证签名的方法。修复了 Bedrock 中 Claude Sonnet 5 的 toolSpec.strict 问题,以及 Vertex passthrough 批次的成本归属问题。

open-sourceLiteLLMcosignDocker
2 次进展多方报道
最近进展 2026年8月19日 · LMDeploy

v0.16.0

LMDeploy 发布 v0.16.0,新增支持 Interns2 mobius、GLM-5.2、Intern-S2-Mobius meta-MoE、MoE gate v2、CP attention 修复、TurboMind ViT(InternVL 和 Qwen VL 模型)、Hy3、MTP 和 FP8 优化;改进包括 SM90 原生 BF16/FP8 GEMM kernels、fused-SiLU 量化、SSM prefix caching 优化、guided-decoding 异步 D2H 拷贝和 xgrammar v0.2.1、Gluon blocked FP8 GEMM for Hopper、opt-in torch.compile for decode CUDA graphs。OpenAI Agents SDK for JavaScript 发布 v0.16.1,新增模型调用超时、run-scoped sandbox 工作目录、Docker sandbox 禁用网络、Modal sandbox 资源选项。

open-sourceLMDeployv0.16.0FP8
2 次进展多方报道
最近进展 2026年8月10日 · Cline

Desktop v0.0.11

Cline 发布 Desktop v0.0.11,支持从剪贴板粘贴图片到 composer;打开非 git 仓库文件夹不再显示 git 术语;欢迎建议根据文件夹内容自适应;文件夹选择器报告失败并提供手动路径输入;打开已有会话不再覆盖所选模型;diff 面板根据会话工作目录解析文件路径;/team 提示词通过核心运行时执行;失败回合在转录中显示错误;空安装目录的插件不再列为已安装;插件设置和贡献集中管理并支持原子切换;修复启动脚本加载错误;webview 错误归因于来源 URL;登出作为正常状态处理;浏览器上下文菜单在应用界面被抑制,文本字段保留。

desktop-appclipboardgitdiff
2 次进展多方报道
最近进展 2026年8月7日 · MiMo-Code

v0.1.10

Xiaomi MiMo 发布 MiMo-Code v0.1.10,重点改进编排器与多会话可靠性:编排器路由到现有会话而非新建,子进程存活状态基于最近活动而非最近完成步骤,spawn 成为 actor 工具提示中的默认选项。工作树和 bash 提交继承仓库真实 git 身份。上下文与检查点处理修复包括:按模型早期压缩预算、遵守配置的上下文限制、消除重复上下文重建、手动 /rebuild 即时重建并显示等待界面,检查点写入器用故障分类替代盲目失败计数器。提供商韧性改进:不发送空内容消息(修复 Bedrock/Anthropic 400)、重放未签名的 Anthropic 推理、重试 OpenAI 流服务器错误和内部请求超时、DeepSeek 推理努力变体、OpenAI 函数工具使用 strict: false。

open-source-agent-reliabilityorchestratormulti-sessionreliability
2 次进展多方报道
最近进展 2026年8月14日 · Langfuse

v3.225.3

Langfuse 发布 v3.225.3,修复了公开评论创建时的 authorUserId 验证问题(#16026),并忽略用户配置中的密码属性(#16027)。此前 v3.225.2 修复了 OIDC 发现验证中的内部目标阻止(#15988)、项目角色更新范围限定到组织(#15987)以及防止正则回溯拒绝服务(#15985)。OpenAI Python SDK 发布 v3.0.0,默认 HTTP 客户端改为 HTTPX2,不再自动安装 httpx,并提供临时运行时 legacy HTTPX 逃生舱。

open-sourceLangfusev3.225.3安全修复
4 次进展多方报道
最近进展 2026年8月9日 · Cline

SDK v0.0.71

Cline 发布 SDK v0.0.71,包含 @cline/llms、@cline/agents、@cline/shared 等包。该版本改进了推理设置的可移植性,使 effort 级别和启用/禁用标志映射到 AI SDK 的原生推理设置(包括 Ollama),并优先处理显式禁用推理的请求。sdk.error 遥测现在归因于实际使用的模型,并从事件属性中去除未定义值。模型目录从 models.dev 刷新,并为 Cline provider 增加了 meta/muse-spark-1.2-contributor。

open-sourceSDK推理设置遥测
8 次进展多方报道
最近进展 2026年8月14日 · vLLM

v0.27.1

vLLM 发布 v0.27.1 补丁版本,基于 v0.27.0,支持量化 DSpark Markov heads(PR #50424)。

open-sourcevLLMv0.27.1DSpark
2 次进展多方报道
最近进展 2026年8月9日 · Cline

CLI v3.0.50

Cline 发布 CLI v3.0.50,为交互式 TUI 添加用户可选颜色主题,内置主题包括 Auto、Cline Dark、Cline Light、Tokyo Night、Gruvbox Dark、Nord、Dracula、Catppuccin Mocha、One Dark、Solarized Dark 和 Solarized Light。主题可实时预览,CLINE_THEME 环境变量可在启动时覆盖持久化选择。此外,git 分支显示现在会随其他终端或编辑器中的分支切换而更新;Telegram 斜杠命令(如 /clear)现在能到达连接器命令主机;竞态连接器启动不再冲突,实例在打开 socket 模式前被声明,hub 监督连接器进程,doctor/connect 跳过已启动的连接器;连接器工具默认启用;Slack 问候语在重连时不再重播;自动批准设置现在优先于 ACP。

open-sourceCLITUIcolor themes
4 次进展多方报道
近 7 天 · 最近进展 2026年8月22日 · Cline

Desktop v0.0.14

Cline 发布 Desktop v0.0.14,新增原生 macOS 通知、语音输入、命令流式输出、图像生成、折叠工作摘要、动画推理轨迹等功能。beta 版引入云会话预览、头像叠加预览和 SSH 远程环境概念验证。

desktop-appClineDesktopv0.0.14
4 次进展多方报道
最近进展 2026年8月16日 · OpenHands

v1.13.0

OpenHands 于 2026-08-13 发布 v1.13.0,包含对话归档、内联 Markdown 工件预览、就绪问题门控、上下文窗口用量计量器与手动压缩等新功能,以及多项修复。

open-source-agentOpenHandsv1.13.0对话归档
2 次进展多方报道
最近进展 2026年8月11日 · LiteLLM

v1.94.2

LiteLLM 发布了 v1.94.2 版本,该版本的所有 Docker 镜像均使用 cosign 签名,签名密钥在提交 0112e53 中引入。用户可以通过固定的提交哈希或发布标签验证签名。该版本还包含对 #35835 和 #35844 的 backport。

open-sourceLiteLLMcosignDocker
3 次进展多方报道
近 7 天 · 最近进展 2026年8月26日 · Cline

sdk/core/v0.0.81

Cline 于 2026-08-26 发布了 @cline/core@0.0.81、@cline/llms@0.0.81 和 @cline/shared@0.0.81 三个 SDK 包的新版本,时间分别为 09:37:48、09:37:45 和 09:37:42 UTC。此前在 08:45:41 UTC 发布了 @cline/core@0.0.80。

sdk-releaseClineSDKrelease
4 次进展公开报道
近 7 天 · 最近进展 2026年8月26日 · CUTLASS

CUTLASS 4.7.1

NVIDIA 发布了 CUTLASS 4.7.1,修复了多个 bug,包括 setmaxnreg 与特定 warp-specialized 模式一起使用时的内核编译失败、jit/kernel 装饰器泄漏、cutlass.jax.cutlass_call 中的张量别名和可选张量处理问题、IKET profiler 的 protobuf 版本要求从 6.30 降低到 4.21、导入时写入 CUTE_DSL_LIBS、export_to_c 对 i64 输入输出 i32 动态形状、从 Python 值构造 cutlass.Numeric 的性能、TVM-FFI 环境流检测和字节偏移错误。该版本已针对 FlashAttention、Quack、FlashInfer、cuDNN-Frontend 和 PyTorch 进行了测试。

open-sourceCUTLASSNVIDIAbug fix
2 次进展公开报道
近 7 天 · 最近进展 2026年8月26日 · Cline

sdk/llms/v0.0.80

Cline 发布了 @cline/llms@0.0.80 和 @cline/shared@0.0.80 两个 SDK 包的新版本。

sdk-releaseClineSDKllms
2 次进展公开报道
最近进展 2026年8月7日 · RAGFlow

dev-20260807-2

RAGFlow 于 2026-08-07 发布了 dev-20260807 和 dev-20260807-2 两个版本。dev-20260807 修复了表单字段中 embd_name 的显示,使其在缺少时回退到 embd_id。dev-20260807-2 改进了流式 agent 的 TTS 功能(issue #18004)。

open-sourceRAGFlowembd_nameembd_id
2 次进展公开报道
最近进展 2026年8月6日 · RAGFlow

dev-20260806-2

RAGFlow 在 2026-08-06 发布了 dev-20260806-2 版本,新增了 HTML 文件类型图标(issue #17925)。

open-sourceRAGFlowHTML文件类型图标
2 次进展公开报道
最近进展 2026年8月2日 · Cline

sdk/agents/v0.0.68

Cline 于 2026-08-01 发布了 @cline/agents@0.0.68、@cline/shared@0.0.68 和 @cline/llms@0.0.68 三个 SDK 包的新版本。

open-sourceClineSDKagents
4 次进展公开报道
最近进展 2026年8月16日 · RAGFlow

dev-20260817: fix: stop three recurring errors on doc delete (#17685) (#17686)

RAGFlow 发布 dev-20260817 版本,修复文档删除时三个重复出现的错误。该版本是 #17526("Refactor: merge dataset scope graph")的后续,该重构引入了两个代码路径,触及部署 schema 未声明的 Infinity 列。此 PR 使运行时对旧 schema 具有鲁棒性,同时向新 schema 添加新列,以确保新创建的表正确。

open-sourceRAGFlowbug fixschema
2 次进展公开报道
最近进展 2026年8月14日 · Cline

sdk/core/v0.0.74

Cline 于 2026-08-13 发布了 @cline/core、@cline/llms、@cline/agents 和 @cline/shared 四个包的 v0.0.74 版本。

open-sourceClineSDKrelease
5 次进展公开报道
近 7 天 · 最近进展 2026年8月25日 · @ai-sdk/deepgram

@ai-sdk/deepgram@3.1.0

@ai-sdk/deepgram@3.1.0 是 Vercel AI SDK 的一个版本,发布于 2026-08-23。该版本修复了转录选项(keyterm、paragraphs、intents、sentiment、replace)被静默丢弃的问题,现在这些选项作为查询参数发送到 /v1/listen 请求。提供者调用签名从 'nova-3' 扩展到任何转录模型 ID。行为变更:diarize 不再默认设为 true,仅在显式设置时发送。语音方面,裸语音族 ID(aura-2、aura)通过 generateSpeech 的 voice 和 language 选项组合上游模型 ID,完整语音 ID 保持不变。DeepgramSpeechModelId 联合类型被缩减为族 ID 加字符串转义。providerMetadata.deepgram 携带使用元数据、速度透传和错误解析。

open-sourceAI SDKDeepgramtranscription
2 次进展公开报道
最近进展 2026年8月14日 · Arize Phoenix

arize-phoenix: v20.1.0

Arize Phoenix 发布 v20.1.0(2026-08-12),新增 JWT client assertion 支持 OAuth2 登录、评估指标图表布局优化、POST /traces/transfer 端点;修复导出会话 ID 冲突,并将 OpenAI 推理模型路由到 Responses API 客户端。v20.0.0(2026-08-11)引入 agent session persistence、语义着色工具提示、google-genai 替代 google-generativeai、span filter DSL 支持 trace_annotations。

open-source-observabilityArize Phoenixv20.1.0agent session
4 次进展公开报道
最近进展 2026年8月10日 · OpenAI Codex

0.148.0-alpha.2

OpenAI Codex 于 2026-08-07 发布了 0.148.0-alpha.1 和 0.148.0-alpha.2 两个预发布版本。

open-sourceOpenAI Codexalpharelease
6 次进展公开报道
最近进展 2026年8月11日 · Cline

sdk/agents/v0.0.72

Cline 发布了 @cline/agents@0.0.72、@cline/shared@0.0.72 和 @cline/llms@0.0.72 三个 SDK 包的新版本,时间均在 2026-08-09 02:33 UTC 左右。

open-sourceClineSDKagents
4 次进展公开报道
最近进展 2026年8月5日 · Cline

SDK v0.0.69

Cline 发布 SDK v0.0.69(含 @cline/llms@0.0.69 与 @cline/shared@0.0.69)。Ollama 的 response-start 超时默认值从 30 秒改为 5 分钟;完全空的 Ollama 响应(无文本、推理或工具调用)改为在模型边界重试;VS Code 与 CLI 中重新创建检查点,运行边界检测现在能跨进程重启与压缩存活;检查点恢复成为真正的工作区回滚,任务期间创建的文件被恢复至检查点时刻内容,检查点后创建的文件被移除,.gitignore 路径(如 build output、node_modules、.env)不受影响,并提供恢复前快照。

developer-toolsSDKOllama超时
4 次进展公开报道
最近进展 2026年8月12日 · CUTLASS

CUTLASS 4.6.2

NVIDIA 于 2026-08-08 发布 CUTLASS 4.6.2,包含 CuTe DSL 的 bug 修复与改进:回退了 4.6.0 中 TMA bulk copy elect_one 的变更以对齐 4.5.x 行为;修复了向量化 fp32->f8 转换问题、CuTe DSL fp8 grouped_gemm_dglu 内核编译问题、ptxas 的 opt-level 设置问题;set_name_prefix 现支持完全自定义编译内核名称;将每次 cute.compile 的 JIT 编译开销减少约 50 ms;在安装 Torch 时导入 cutlass.cute 速度提升 3.8 倍,未安装时提升 1.25 倍。该版本已针对 FlashAttention、Quack、FlashInfer 的特定提交进行测试。

open-sourceCUTLASSCuTefp8
2 次进展公开报道
最近进展 2026年8月9日 · Cline

sdk/core/v0.0.70

Cline 发布了 @cline/core、@cline/shared、@cline/agents 和 @cline/llms 四个包的 v0.0.70 版本,时间均在 2026-08-05 09:15 左右。

open-sourceClineSDKv0.0.70
6 次进展公开报道
近 7 天 · 最近进展 2026年8月24日 · Cline

sdk/core/v0.0.77

Cline 发布了 @cline/core@0.0.77、@cline/shared@0.0.77、@cline/agents@0.0.77 和 @cline/llms@0.0.77 四个 SDK 包,版本号均为 0.0.77,发布时间在 2026-08-21 04:56:19 至 04:56:23 UTC 之间。此外,@cline/core@0.0.76 于 2026-08-21 02:39:05 UTC 发布。

open-sourceClineSDKrelease
7 次进展公开报道
近 7 天 · 最近进展 2026年8月24日 · OpenAI Codex

0.150.0-alpha.2

OpenAI Codex 发布了两个版本:0.150.0-alpha.1(2026-08-20)和 0.150.0-alpha.2(2026-08-21)。

open-sourceOpenAI Codexreleasealpha
8 次进展公开报道
最近进展 2026年8月15日 · OpenAI Codex

0.148.0-alpha.9

OpenAI Codex 发布了三个连续的 alpha 版本:0.148.0-alpha.7(2026-08-11T15:33:21Z)、0.148.0-alpha.8(2026-08-11T18:47:56Z)和 0.148.0-alpha.9(2026-08-12T01:38:28Z)。这些版本在 GitHub 上以标签 rust-v0.148.0-alpha.7、rust-v0.148.0-alpha.8 和 rust-v0.148.0-alpha.9 发布。

open-sourceOpenAI Codexalpha releaseversion 0.148.0
8 次进展公开报道
最近进展 2026年8月14日 · Vercel AI SDK

@ai-sdk/vue@3.0.248

Vercel 于 2026-08-11 发布了 @ai-sdk/vue@3.0.248、@ai-sdk/rsc@2.0.248 和 @ai-sdk/svelte@4.0.248 三个补丁版本,均更新了依赖 ai@6.0.248 和 @ai-sdk/provider-utils@4.0.44,其中 @ai-sdk/rsc 还更新了 @ai-sdk/provider@3.0.15。

sdk-releaseVercelAI SDKVue
8 次进展公开报道
近 7 天 · 最近进展 2026年8月26日 · Transformers

v5.16.0

Hugging Face Transformers 发布了 v5.16.0 版本,通过 GitHub 标签发布。

open-sourcev5.16.0Transformersrelease
1 次进展公开报道
近 7 天 · 最近进展 2026年8月26日 · llama.cpp

b10635

llama.cpp 发布 b10635 版本,为 MoE 在 sm_60 上解除 mmq 阻塞,并为 dp4a 和旧版 cuda 复制 mmq-config-pascal,同时降低非 dp4a pascal 上 Q2_K、Q4_K、Q5_K、Q6_K 的占用。该版本提供多种平台构建,包括 macOS、Linux、Windows、Android 等。

open-source-optimizationllama.cppMoEmmq
1 次进展公开报道
近 7 天 · 最近进展 2026年8月26日 · Langfuse

v4.20.0

Langfuse 发布 v4.20.0 版本,包含多项功能更新与修复。功能方面:在搜索栏中复用规则过滤器(#16554)、为评分添加内联类别并支持在新标签页打开配置(#16271)、添加评估器执行 SLO 指标(#16589)、在 Web 端将 trace-table 的 facet 列表折叠在“Show N more”控件后(#16071)。修复方面:澄清评估器保存对话框标题(#16557)、在 HIPAA 部署中隐藏产品反馈(#16526)、要求审计日志访问权限才能进行审计日志批量导出下载(#16567)、通过标签点击切换列可见性(#16276)、将过大的 tRPC 查询作为 POST 发送以避免 HTTP 414/431 错误(#16268)、在表格中将观察级别标注为状态(#16269)、为缺失的观察成本显示破折号(#16287)、从 Sentry 中移除无堆栈的浏览器扩展 import() 噪声(#16367)、丢弃预期的陈旧工具批准冲突(#16384)、解析单消息输入(#16565)以及处理格式错误的输入。

open-sourceLangfusev4.20.0evals
1 次进展公开报道
近 7 天 · 最近进展 2026年8月26日 · llama.cpp

b10632

llama.cpp 发布 b10632 版本,为 Mamba-2 预填充添加了分块 SSD MMA 优化,并新增了 FC_SSM_SCAN 常量。

open-sourcellama.cppMamba-2SSD MMA
1 次进展公开报道
近 7 天 · 最近进展 2026年8月25日 · llama.cpp

b10622

llama.cpp 发布 b10622 版本,修复了 Metal 后端在内存不足时因未检查 ggml_metal_buffer_init 返回值而导致的空指针解引用崩溃(OOM crash)。修复后,分配失败会记录错误并返回 NULL,避免硬崩溃。

bug-fixllama.cppMetalOOM
1 次进展公开报道
近 7 天 · 最近进展 2026年8月25日 · MLX

v0.32.2

MLX 发布 v0.32.2 版本,包含多项修复与改进:保留非规格化浮点数转 bool、支持裸 Ellipsis 索引赋值、修复 divmod 对浮点商的截断、为 scaled_dot_product_attention 增加 force_fused 选项、拒绝归一化层中的负 eps、约束 GGUF 元数据字符串/数组值、gqa-8 解码注意力中每 K/V 字节只读一次、修复 fft vmap 和 jvp、修复 median 丢弃 NaN、修复 CPU 扫描、验证优化器 betas、修复 RMSNormVJP 反向传播、为 take_along_axis 的 axis 参数添加默认值、为 NAX 设备 head_dim 256 添加融合全注意力路径、更新 nanobind 至 2.15.0、跳过不必要的 simdgroup 计算。

open-sourceMLXv0.32.2bug fix
1 次进展公开报道
近 7 天 · 最近进展 2026年8月25日 · llama.cpp

b10621

llama.cpp 发布了版本 0.3.0(标签 b10621),更新内容包括版本号提升、CI 更新默认发布描述、添加生成发布摘要的脚本提示。该版本提供了多种平台的构建产物,包括 macOS、iOS、Linux、Android、Windows 和 openEuler,支持多种后端(如 Vulkan、ROCm、OpenVINO、SYCL、CUDA、OpenCL)。

open-source-releasellama.cpp0.3.0release
1 次进展公开报道
近 7 天 · 最近进展 2026年8月25日 · Langfuse

v4.18.0

Langfuse 发布 v4.18.0,包含多项功能、修复和价格调整。功能包括:基于 payload 的评估规则过滤器、刷新全大写/精确匹配/关键词重叠模板、记录编码请求体大小、在事件流中记录工具审批来源。修复包括:GPT-5.4 推理 token 定价、评分分页、评估器搜索模态、过滤器、自动化 token、OTLP 请求体限制、LLM 判断重试、布尔测试结果渲染、媒体标签、sandbox MCP 工具提示。价格调整:降低 gpt-5.6-sol 价格。

open-sourceLangfusev4.18.0evaluation
1 次进展公开报道
近 7 天 · 最近进展 2026年8月25日 · llama.cpp

b10620

llama.cpp 项目发布了 b10620 版本,该版本提供了针对 macOS、Linux、Android、Windows 和 openEuler 等多个平台的构建产物,包括 CPU、Vulkan、ROCm、OpenVINO、SYCL、CUDA、OpenCL 等后端支持,并提供了 UI。

open-sourcellama.cppb10620release
1 次进展公开报道
近 7 天 · 最近进展 2026年8月25日 · Cline

Desktop v0.0.17

Cline 发布 Desktop v0.0.17,将 Plugins、MCP、Skills、Rules、Hooks 和 Tools 整合为一个 Customize 中心,包含标签页和实时计数;目录标签显示已安装内容,并内联 Browse 区域,安装后立即显示,独立的 Marketplace 页面被移除。Models 页面重新设计,提供商按 Connected、Popular 和 All 分组,显示认证类型和配置状态;OAuth 提供商支持浏览器登录,并提供手动密钥选项和明确的连接/断开/退出操作。语音输入移至 Settings → Voice 页面,仅提供支持转录的提供商并预选默认模型;作曲器的麦克风按钮仅在配置语音模型后出现。侧边栏会话按项目分组,置顶会话位于每组前,计划会话有内联时钟标记;收藏操作更名为 Pin,New、Schedule 和 Customize 各有标签行。

developer-toolsClineDesktopCustomize
1 次进展公开报道
近 7 天 · 最近进展 2026年8月24日 · llama.cpp

b10605

llama.cpp 发布 b10605 版本,其中 mamba2 的 in/out projections 被扁平化以调度 GEMM 而非 GEMV,并移除了冗余的 output reshape。该版本支持多种平台,包括 macOS、iOS、Linux、Android、Windows 和 openEuler,并启用了多种后端如 Vulkan、ROCm、OpenVINO、SYCL、CUDA 和 OpenCL。

open-sourcellama.cppmamba2GEMM
1 次进展公开报道
近 7 天 · 最近进展 2026年8月24日 · llama.cpp

b10604

llama.cpp 发布 b10604 版本,包含 Deepseek 4 的 sm tensor 支持,设置更细粒度的 head splits,修复 dspark,添加 dsv4 模型保存,允许 dflash 在特定设备返回,添加 dsv4 seq_rm 注释,简化共享专家延迟 allreduce,移除 dsv4 特殊测试。该版本提供多平台构建,包括 macOS、iOS、Linux、Android、Windows 和 openEuler,并支持多种后端如 Vulkan、ROCm、OpenVINO、SYCL、CUDA 等。

open-sourcellama.cppDeepseek 4sm tensor
1 次进展公开报道
近 7 天 · 最近进展 2026年8月23日 · llama.cpp

b10593

llama.cpp 发布 b10593 版本,包含 DeepseekV4 的多序列回滚修复、模型加载修复、压缩比断言、图拓扑静态化等改动,并提供多平台构建产物。

open-sourcellama.cppDeepseekV4rollback
1 次进展公开报道
近 7 天 · 最近进展 2026年8月23日 · Cline

v4.1.14

Cline 发布 v4.1.14 版本,更新了内置模型目录,新增 Claude Fable 5、Grok 4.6 on Vertex、DeepSeek V4 Flash 变体(含 vision preview)、MiMo v2.5、Qwen3.8 27B、Gemma 4 26B、LongCat 2.0、Nemotron 3.5 Lightning 和 Thinking Machines 的 Inkling 模型。修复了交互式会话完成遥测问题,确保每个会话报告一次完成。

developer-toolsClinev4.1.14模型目录
1 次进展公开报道
近 7 天 · 最近进展 2026年8月23日 · llama.cpp

b10590

llama.cpp 发布了 b10590 版本,更新了 subprocess.h,并提供了多种平台和硬件加速的构建产物,包括 macOS、iOS、Linux、Android、Windows 和 openEuler。

open-sourcellama.cppb10590subprocess
1 次进展公开报道
近 7 天 · 最近进展 2026年8月23日 · llama.cpp

b10589

llama.cpp 发布 b10589 版本,新增 CUDA 的 POOL_1D 支持,并修复了 editorconfig 合规性缺失的尾部换行。该版本提供 macOS、Linux、Android、Windows、openEuler 等多个平台的构建产物,涵盖 CPU、Vulkan、ROCm、OpenVINO、SYCL、CUDA、OpenCL 等后端。

open-sourcellama.cppb10589POOL_1D
1 次进展公开报道
近 7 天 · 最近进展 2026年8月22日 · llama.cpp

b10581

llama.cpp 发布 b10581 版本,新增对 DSpark 的支持,用于 bailingmoe3 模型。该版本提供 macOS、iOS、Linux、Android、Windows 及 openEuler 等多平台构建,并包含 UI 组件。

open-sourcellama.cppDSparkbailingmoe3
1 次进展公开报道
近 7 天 · 最近进展 2026年8月22日 · llama.cpp

b10580

llama.cpp 发布 b10580 版本,新增对 dots3-note 的 vision+audio 支持(PR #27524),并包含文本转换初始化实现、mtmd 转换实现及 C++ 实现,更新了 gguf-py/gguf/tensor_mapping.py。该版本提供多种平台构建,包括 macOS Apple Silicon、Linux(CPU、Vulkan、ROCm、OpenVINO、SYCL)、Android、Windows(CPU、CUDA、Vulkan、OpenCL、OpenVINO、SYCL、ROCm)等。

open-sourcellama.cppb10580dots3-note
1 次进展公开报道
近 7 天 · 最近进展 2026年8月22日 · llama.cpp

b10578

llama.cpp 发布 b10578 版本,优化了 ggml 的 concat 操作,将逐元素 memcpy 替换为行级 memcpy,并修复了行级拷贝的 concat 偏移,添加了 concat 行连续性和块大小断言。该版本支持多种平台,包括 macOS、Linux、Android、Windows 等。

open-sourcellama.cppggmlconcat
1 次进展公开报道
近 7 天 · 最近进展 2026年8月22日 · llama.cpp

b10577

llama.cpp 发布 b10577 版本,修复了 draft-mtp 与 embeddings 的兼容性问题(#26352、#27299、#27400),并提供了多平台构建产物,包括 macOS、Linux、Windows、Android 等。

bug-fixllama.cppdraft-mtpembeddings
1 次进展公开报道
近 7 天 · 最近进展 2026年8月22日 · llama.cpp

b10576

llama.cpp 发布了 b10576 版本,重新添加了 Q2_K reordered MMVQ 和 ESIMD kernels(PR #27490),并恢复了之前被回滚的提交。该版本支持多种平台,包括 macOS、iOS、Linux、Android、Windows 和 openEuler,并提供了 SYCL FP32/FP16 等构建选项。

open-sourcellama.cppQ2_KMMVQ
1 次进展公开报道
近 7 天 · 最近进展 2026年8月21日 · Google DeepMind

From Atari to EVE Online: Building on 15 Years of AI Research in Games

Google DeepMind 宣布与游戏工作室合作,基于 15 年的游戏 AI 研究,原型化突破性的 AI 游戏玩法。

ai-gaming-partnershipAIgamesGoogle DeepMind
1 次进展公开报道
近 7 天 · 最近进展 2026年8月21日 · vLLM

v0.28.0rc2: [Spec Decode] DFlash2: local convolution + candidate selector (#52816)

vLLM 项目发布了 v0.28.0rc2 版本,其中包含一个名为 DFlash2 的 Spec Decode 功能,该功能涉及局部卷积和候选选择器。此版本是从提交 b389ac2 中 cherry-pick 而来,由 khluu 签署。

open-sourcevLLMSpec DecodeDFlash2
1 次进展公开报道
近 7 天 · 最近进展 2026年8月20日 · llama.cpp

b10514

llama.cpp 发布 b10514 版本,新增 GraniteSWAForCausalLM 和 GraniteMoeSWAForCausalLM 模型转换支持,包括 rope_pattern 数组转换基础设施、SWA 模式逻辑修复、非 rope 层支持,以及 llama_hparams 的 has_rope 和架构常量。

open-source-model-supportllama.cppGraniteSWAGraniteMoeSWA
1 次进展公开报道
近 7 天 · 最近进展 2026年8月20日 · llama.cpp

b10509

llama.cpp 发布 b10509 版本,新增 ggml_rope_set_offset 算子,并支持 Metal、CUDA、Vulkan 后端,同时提供多种平台构建。

open-sourcellama.cppggml_rope_set_offsetMetal
1 次进展公开报道
最近进展 2026年8月19日 · RAGFlow

v0.27.0

RAGFlow 发布 v0.27.0 版本,包含多项功能更新与修复,如新增模型提供商、聊天与搜索页面过滤器、任务执行器迁移至 Go 语言,以及修复内存错误显示、技能搜索、内置元数据等问题。

open-sourcev0.27.0RAGFlowGo 迁移
1 次进展公开报道
最近进展 2026年8月17日 · Google

Get closer to the game with Gemini and Pixel

Google 宣布与五家全球足球俱乐部合作,利用 Gemini 和 Pixel 提升球迷的 matchday 体验。

consumer-partnershipGeminiPixelfootball
1 次进展公开报道
最近进展 2026年8月17日 · llama.cpp

b10456

llama.cpp 发布 b10456 版本,修复 SYCL 后端量化拷贝内核的线程/块数量,使其与量化大小成比例,减少过度/不足订阅。在 Arc 70 上,q4_0 到 f32 路径的吞吐量从 20.21 GB/s 提升到 158.19 GB/s,其余量化类型性能提升持平。该版本同时提供多平台构建,包括 macOS、Linux、Windows、Android 等,部分平台(如 macOS Intel、ROCm 7.14、openEuler)标记为 DISABLED。

open-source-optimizationllama.cppSYCL量化
1 次进展公开报道
最近进展 2026年8月16日 · llama.cpp

b10452

llama.cpp 发布 b10452 版本,重构了 supports_string_content / supports_typed_content 处理(#27130),改进了 supports_string_content 能力检测,新增测试中的 "skip" 消息,并更新了网站与 UI。该版本支持 macOS(Apple Silicon arm64,含 KleidiAI 启用与禁用)、iOS、Linux(多种 CPU/GPU 后端)、Android、Windows(多种 CUDA/Vulkan/OpenVINO/SYCL/ROCm 后端)及 openEuler(部分禁用)。

open-source-releasellama.cppb10452supports_string_content
1 次进展公开报道
最近进展 2026年8月16日 · llama.cpp

b10451

llama.cpp 发布 b10451 版本,包含对 LoRA 张量数据是否在文件边界内的检查更新,修改了 src/llama-adapter.cpp,并提供了多种平台构建选项。

open-sourcellama.cppLoRAtensor
1 次进展公开报道
最近进展 2026年8月13日 · CUTLASS

CUTLASS 4.7.0

NVIDIA 发布了 CUTLASS 4.7.0,引入了 CuTe DSL 的 Primitives API,这是一个基于 SIMT 的 Tensor Core 编程的低层抽象,作为过渡性 API 直到 CUDA Python 类似方案可用。同时引入了任务调度框架,用于 warp 特化内核的静态分析,检测并发问题并提供可视化工具。编译器诊断改进,可在编译时报告寄存器溢出和本地内存使用,并带有源代码行号。该版本已针对 FlashAttention 和 Quack 等包进行了测试。

open-sourceCUTLASSCuTePrimitives API
1 次进展公开报道
最近进展 2026年8月13日 · llama.cpp

b10405

llama.cpp 发布 b10405 版本,移除 ggml-hip 中的 -funsafe-math-optimizations 编译选项,该选项启用 -fassociative-math,会重关联浮点归约,可能导致 RDNA3.5 上贪心 argmax 结果翻转(如 MTP 推测解码与非推测基线产生分歧)。移除后 HIP 构建符合 IEEE 标准。该版本同时列出多平台构建状态,包括 macOS、Linux、Windows、Android 等,部分平台标记为 DISABLED。

open-sourcellama.cppHIP浮点运算
1 次进展公开报道
最近进展 2026年8月12日 · llama.cpp

b10375

llama.cpp 发布 b10375 版本,主要变更包括为 Qwen 模型收紧 bare function 解析(#26793),并更新了各平台的构建支持矩阵。

open-sourcellama.cppQwenbare function parsing
1 次进展公开报道
最近进展 2026年8月12日 · ONNX Runtime

ONNX Runtime v1.29.0

ONNX Runtime v1.29.0 发布,宣布弃用 onnxruntime-web 的 WebGL 和 JSEP,推荐使用原生 WebGPU EP;POSIX 遥测现可在 Linux、macOS、Android 和 iOS 上使用(需启用遥测构建),不改变公共 ABI,WebAssembly 保持无遥测,设置 ORT_DISABLE_TELEMETRY=1 可禁用非 Windows 遥测;移除了未使用的内部 onnxruntime/python/tools/tensorrt 仪表板工具,不影响 TensorRT Execution Provider API;修复了 TensorRT 和 NvTensorRTRTX 引擎重拟合中的路径遍历漏洞,使外部数据路径验证无条件化;验证了 CPU MoE k 属性与专家数量,修复了 CPU TensorScatter 安全问题;为 pooling、LSTM、DynamicQuantizeLSTM、Sampling、FeatureVectorizer、SkipLayerNorm、QLinearConv、Whisper 解码等添加了缺失的 rank、shape 和参数验证。

open-sourceONNX RuntimeWebGPUWebGL
1 次进展公开报道
最近进展 2026年8月11日 · llama.cpp

b10359

llama.cpp 发布 b10359 版本,修复 CI 错误,新增 flash_attn 测试,为 cpy 添加 i32 支持,并启用所有 ops 测试。该版本提供多种平台构建,包括 macOS、Linux、Android、Windows 等,支持 CPU、Vulkan、ROCm、OpenVINO、SYCL、CUDA 等后端。

open-sourcellama.cppb10359flash_attn
1 次进展公开报道
最近进展 2026年8月11日 · llama.cpp

b10358

llama.cpp 发布了 b10358 版本,更新了各平台的构建支持,包括 macOS、iOS、Linux、Android、Windows 和 openEuler,并提及了 PR 25532 的评审意见。

open-source-releasellama.cppb10358release
1 次进展公开报道
最近进展 2026年8月10日 · llama.cpp

b10338

llama.cpp 发布 b10338 版本,修复了 MoE 模型保存/加载时共享专家 FFN 长度键被覆盖的问题。修复前,保存器两次调用 add_kv 写入 LLM_KV_EXPERT_SHARED_FEED_FORWARD_LENGTH,第二次覆盖第一次,导致 shared_feed_forward_length 被错误保存为 n_ff_chexp,且 expert_chunk_feed_forward_length 从未写入。这导致 qwen2moe、qwen3-next、granite-moe、hunyuan-moe、ernie4.5、bailingmoe2、nemotron-h 等共享专家 MoE 模型在保存后加载失败。修复后,第二次调用改为写入 LLM_KV_EXPERT_CHUNK_FEED_FORWARD_LENGTH,并更新测试以验证所有架构的往返加载。

bug-fixllama.cppMoEGGUF
1 次进展公开报道
最近进展 2026年8月10日 · MultiverseComputingCAI

Making Knowledge Distillation Cheap Enough to Run at Scale

Hugging Face 博客发布了一篇题为“Making Knowledge Distillation Cheap Enough to Run at Scale”的文章,作者为 MultiverseComputingCAI,发布于 2026-08-10。文章讨论了如何使知识蒸馏的成本足够低以支持大规模运行。

model-compressionknowledge distillationefficiencyscalability
1 次进展公开报道
最近进展 2026年8月10日 · llama.cpp

b10336

llama.cpp 发布 b10336 版本,重构了多个 WGSL 文件并简化了 flash_attn 的 WGSL 实现。该版本提供 macOS、iOS、Linux、Android、Windows 和 openEuler 等多个平台的构建产物,其中部分平台(如 macOS Intel、openEuler)被标记为 DISABLED。

open-sourcellama.cppWGSLflash_attn
1 次进展公开报道
最近进展 2026年8月9日 · llama.cpp

b10333

llama.cpp 发布 b10333 版本,修复了 SpaceMiT 后端中缺失的 Q5_0 调度问题。该版本支持多种平台,包括 macOS、iOS、Linux、Android、Windows 和 openEuler,并提供了 CPU、Vulkan、ROCm、OpenVINO、SYCL、CUDA、OpenCL、HIP 等后端。

open-sourcellama.cppb10333Q5_0
1 次进展公开报道
最近进展 2026年8月9日 · llama.cpp

b10332

llama.cpp 发布 b10332 版本,移除了 GGML_HIP_ROCWMMA_FATTN 相关代码。该版本支持多种平台,包括 macOS、iOS、Linux、Android、Windows 和 openEuler,并提供了 CPU、Vulkan、ROCm、OpenVINO、SYCL、CUDA、HIP、OpenCL 等后端。

open-sourcellama.cppb10332GGML_HIP_ROCWMMA_FATTN
1 次进展公开报道
最近进展 2026年8月7日 · NVIDIA NeMo Speech

NVIDIA NeMo Speech 3.0

NVIDIA NeMo Speech 3.0 是仓库拆分并更名为 NVIDIA-NeMo/Speech 后的首个主要版本。该版本聚焦 ASR、TTS、音频处理、说话人任务和 SpeechLM。非语音组件(如框架、LLM、VLM、扩散、导出/部署、评估器)已移至 NVIDIA-NeMo 组织下的独立仓库。该版本移除了 80 万行废弃代码,迁移到 uv 包管理器,增强了模型测试覆盖,减少了依赖数量,改进了文档,提供了更轻量的容器,并添加了 AGENTS.md 和代理技能。

open-source-releaseNeMo SpeechNVIDIAASR
1 次进展公开报道
最近进展 2026年8月7日 · llama.cpp

b10305

llama.cpp 发布 b10305 版本,为 SYCL 后端新增对 DSv4 操作(LIGHTNING_INDEXER、DSV4_HC_COMB、DSV4_HC_POST、DSV4_HC_PRE)的支持,并更新了 ops.md 文档。该版本同时提供了覆盖 macOS、Linux、Android、Windows 及 openEuler 等多平台的构建选项,包括 CPU、Vulkan、ROCm、OpenVINO、SYCL、CUDA、HIP 等后端。

open-source-softwarellama.cppSYCLDSv4
1 次进展公开报道
最近进展 2026年8月7日 · llama.cpp

b10303

llama.cpp 发布 b10303 版本,修复了 SYCL 后端在 Arc770 上出现的 'Error OP FLASH_ATTN_EXT' 错误。该版本同时列出了 macOS、Linux、Android、Windows、openEuler 等多个平台的构建支持情况,其中 macOS Intel 和 openEuler 部分构建被标记为 DISABLED。

open-sourcellama.cppSYCLArc770
1 次进展公开报道
最近进展 2026年8月7日 · llama.cpp

b10301

llama.cpp 发布 b10301 版本,修复了 CUDA 中未使用变量/函数的警告(#26688)。该版本提供多种平台的构建选项,包括 macOS、iOS、Linux、Android、Windows 和 openEuler,并支持多种后端如 Vulkan、ROCm、OpenVINO、SYCL、HIP、OpenCL 等。

open-sourcellama.cppCUDAbug fix
1 次进展公开报道
最近进展 2026年8月7日 · HSP GRUPPE

How HSP GRUPPE builds AI capabilities for tax advisory

HSP GRUPPE 使用 ChatGPT Enterprise 来提高生产力、改善工作质量,并为税务咨询和客户服务创造更多容量。

enterprise-ai-adoptionChatGPT Enterprisetax advisoryproductivity
1 次进展公开报道
最近进展 2026年8月7日 · llama.cpp

b10299

llama.cpp 发布 b10299 版本,修复了 MSL 中 threadgroup matrix 数组实例化导致的编译错误。修复方式是将 threadgroup half4x4 数组改为 POD threadgroup half 数组,并转换为 threadgroup half4x4 * 进行矩阵索引。该版本支持 macOS Apple Silicon (arm64)、Linux Ubuntu x64 (CPU)、Android arm64 (CPU)、Windows x64 (CPU) 等多种平台。

open-source-llm-runtimellama.cppMSLthreadgroup
1 次进展公开报道
最近进展 2026年8月6日 · llama.cpp

b10295

llama.cpp 发布 b10295 版本,修复了量化张量重塑后的 strides 问题(#26672)。该版本支持 macOS(Apple Silicon arm64,含 KleidiAI 启用/禁用)、iOS XCFramework、Linux(多种 CPU/GPU 后端)、Android、Windows(多种后端)、openEuler 等平台,并包含 UI 组件。

open-sourcellama.cppb10295quantized tensor
1 次进展公开报道
最近进展 2026年8月6日 · Semantic Kernel

dotnet-1.79.0

Semantic Kernel 发布 dotnet-1.79.0 版本,包含多项更新:将 .NET SDK 从 10.0.301 升级到 10.0.302;更新 Microsoft.AspNetCore.OData 至 9.5.0;修复 CosmosDB 向量存储 bug;将 VectorStoreRAG 和 Concepts 示例迁移到 CommunityToolkit.VectorData 包;为 TimePlugin 添加 TimeProvider 注入以实现确定性测试;拒绝混合分隔符的 UNC 路径;升级 Prompty.Core 至 2.0.0-beta.3 以解决 NU1903 漏洞;修复 Ollama 的 Think 属性等。

open-sourceSemantic Kernel.NETrelease
1 次进展公开报道
最近进展 2026年8月6日 · Semantic Kernel

python-1.44.1

2026-08-06,Semantic Kernel 发布 python-1.44.1 版本,包含多项变更:编码 OpenAPI 服务器变量值、整合 Dependabot 依赖更新、抑制内部 HTTP 工具中的 CodeQL 误报、为 Azure AI Agent 添加 MCP 工具审批回调(破坏性变更)、整合 Python 和 .NET 依赖更新、跳过规范化名称冲突的 MCP 工具和提示、更新 ProcessFrameworkWithSignalR React 前端的 form-data 依赖、在 Copilot Studio agent 中记录 x5t 证书指纹哈希、将 Python 版本提升至 1.44.1。

agent-frameworkSemantic KernelPythonMCP
1 次进展公开报道
最近进展 2026年8月6日 · llama.cpp

b10293

llama.cpp 发布 b10293 版本,包含针对 AMD ROCm 的 CI 修复,支持 gfx1151(Strix Halo)集成 GPU,并修复了调试断言问题。

open-sourcellama.cppAMDROCm
1 次进展公开报道
最近进展 2026年8月6日 · llama.cpp

b10291

llama.cpp 发布 b10291 版本,修复 Vulkan 提交批处理大小问题,添加调试工具以诊断 DeviceLost 驱动错误,并修复提交阈值应用过晚的问题。该版本支持多种平台和硬件后端,包括 macOS、Linux、Windows、Android 等。

open-sourcellama.cppVulkanDeviceLost
1 次进展公开报道
最近进展 2026年8月5日 · Cloudflare

The Agent Access Model

Cloudflare 于 2026-08-05 发布博客文章《The Agent Access Model》,提出一种用于保护任务级 Agent 的新架构,核心包括严格身份代理、持续中介和状态化信任。

agent-securityAgent安全身份代理
1 次进展公开报道
最近进展 2026年8月5日 · Cloudflare

Catching rogue AI behavior with identity-aware analytics

Cloudflare 宣布其 Identity-aware AI Gateway 进入公开测试阶段,并推出 User Insights 功能,该功能将流量转化为每个用户和代理的行为基线,并在出现内部风险时发出警报。

ai-securityAI Gatewayidentity-awareUser Insights
1 次进展公开报道
最近进展 2026年8月5日 · llama.cpp

b10278

llama.cpp 发布 b10278 版本,从所有构建脚本中移除 GGML_METAL_USE_BF16 宏。该版本提供 macOS、iOS、Linux、Android、Windows 和 openEuler 等多个平台的构建选项,其中 macOS Intel 和 openEuler 相关构建被标记为 DISABLED。

open-source-releasellama.cppb10278GGML_METAL_USE_BF16
1 次进展公开报道
最近进展 2026年8月4日 · Cloudflare

Announcing Cloudflare Wallets: The programmable wallet for the agentic Internet

Cloudflare 于 2026-08-04 发布 Cloudflare Wallets,为 AI 代理提供原生支付和可验证身份,基于 x402 协议,使代理能在安全护栏内自主购买 API 和内容。

agent-paymentsCloudflare Walletsx402AI agents
1 次进展公开报道
最近进展 2026年8月4日 · Cloudflare Codex

How Cloudflare enforces engineering standards using AI

Cloudflare 创建了 Cloudflare Codex,一个受治理的工程标准主体,AI agent 在开发生命周期中消费该标准。通过将结构化 RFC 与 agentic 审查配对,团队在代码、规范和事故报告中自动执行一致性。

engineering-standardsengineering standardsAI agentsRFC
1 次进展公开报道
最近进展 2026年8月4日 · Astro

How we built a software factory to drive Astro’s GitHub issue count to zero

Astro maintainers replaced manual issue verification with isolated AI subagents running in GitHub Actions, reducing open issue count by 85%. The post explores architecture for automated bug reproduction, patch verification, and preview releases.

developer-toolsAI subagentsGitHub Actionsissue triage
1 次进展公开报道
最近进展 2026年8月4日 · Cloudflare

Introducing: Cloudflare Agents

Cloudflare 于 2026 年 8 月 4 日发布 Cloudflare Agents,将已部署的 agent 会话整合到单一体验中,展示 agent 规模化运行的关键信息和洞察。

agent-managementCloudflareAgentsagent 管理
1 次进展公开报道
最近进展 2026年8月4日 · Cloudflare

Run CI/CD for millions of repos — on your platform, on Cloudflare

Cloudflare 发布了一篇博客文章,介绍如何在 Cloudflare 上使用 Workflows、Artifacts 和 CI SDK 构建可定制的、沙盒化的 CI/CD 流水线,用 TypeScript 工作流步骤和自愈 AI 代理替代复杂的 YAML 配置。

developer-toolsCI/CDWorkflowsArtifacts
1 次进展公开报道
最近进展 2026年8月4日 · Cloudflare

The Agent Development Lifecycle has arrived on Cloudflare

Cloudflare 于 2026-08-04 发布了 Agent Development Lifecycle,并介绍了支撑该生命周期的 Cloudflare 基础组件。

developer-toolsAgentDevelopment LifecycleCloudflare
1 次进展公开报道
最近进展 2026年8月4日 · Google

The latest AI news we announced in July 2026

Google 于 2026 年 7 月发布了一系列 AI 更新,具体内容在博客文章中宣布。

ai-updatesGoogleAIupdates
1 次进展公开报道
最近进展 2026年8月4日 · llama.cpp

b10259

llama.cpp 发布 b10259 版本,新增在加载期间重塑张量的功能(PR #26531)。该版本提供 macOS、iOS、Linux、Android、Windows、openEuler 等平台的多种构建选项,包括 CPU、Vulkan、ROCm、OpenVINO、SYCL、CUDA、HIP、OpenCL 等后端,并支持 Apple Silicon、Intel、ARM 等架构。部分平台(如 macOS Intel、openEuler 某些配置)被标记为 DISABLED。

open-sourcellama.cppb10259tensor reshape
1 次进展公开报道
最近进展 2026年8月3日 · Cloudflare

Smaller, faster, safer: running Kimi and GLM at scale

Cloudflare 发布了一篇博客,介绍其如何通过量化 KV 缓存、压缩模型权重和添加完整性检查,来更快速、更便宜、更安全地服务 Kimi 和 GLM 等前沿模型,以应对 GPU 内存压力。

model-serving-optimizationKV cache quantizationweight compressionintegrity checks
1 次进展公开报道
最近进展 2026年8月3日 · MS-SWIFT

v4.4.3: bump transformers and peft (#9837)

MS-SWIFT 发布了 v4.4.3 版本,该版本更新了 transformers 和 peft 依赖。

open-sourceMS-SWIFTv4.4.3transformers
1 次进展公开报道
最近进展 2026年8月3日 · llama.cpp

b10237

llama.cpp 发布 b10237 版本,为 DeepSeek V3.2 添加 MTP(Multi-Token Prediction)支持,并在模型类型发现过程中无需包含 MTP 层。该版本提供多种平台构建,包括 macOS、iOS、Linux、Android、Windows 和 openEuler。

open-sourcellama.cppDeepSeek V3.2MTP
1 次进展公开报道
最近进展 2026年8月2日 · llama.cpp

b10227

llama.cpp 发布 b10227 版本,新增 Qwen3 专用解析器,支持 tagged thinking tool parser,并重构添加 permute helper,支持 omission,更新工具分隔符,添加 qwen3-coder 注释,修复触发模式。

open-sourcellama.cppQwen3parser
1 次进展公开报道
最近进展 2026年8月2日 · llama.cpp

b10225

llama.cpp 发布 b10225 版本,新增仅在需要时加载 MiMo V2 MTP 张量的功能,并更新了各平台的构建支持列表。

open-sourcellama.cppMiMo V2MTP
1 次进展公开报道
最近进展 2026年8月2日 · llama.cpp

b10226

llama.cpp 发布 b10226 版本,修复了 iGPU 的分类问题(#26105)。该版本支持多种平台和硬件后端,包括 macOS Apple Silicon(含 KleidiAI 启用)、macOS Intel(禁用)、iOS XCFramework、Linux(CPU、Vulkan、ROCm 7.2、OpenVINO、SYCL FP32/FP16)、Android(CPU、OpenCL Adreno)、Windows(CPU、CUDA 12.4/13.3、Vulkan、OpenVINO、SYCL、HIP)、openEuler(禁用,部分支持 310p 和 910b ACL Graph)。

open-sourcellama.cppiGPUSYCL
1 次进展公开报道
最近进展 2026年8月1日 · RAGFlow

dev-20260801: Go: fix list services (#17664)

RAGFlow 发布 dev-20260801 版本,包含修复 admin list services 和 admin show service 'service_name' 的变更,由 Jin Hai 提交。

open-sourceRAGFlowdev-20260801bug fix
1 次进展公开报道
最近进展 2026年8月1日 · llama.cpp

b10217

llama.cpp 发布 b10217 版本,支持在 DS4 的思考过程中启用工具调用(#26269)。该版本提供多种平台构建,包括 macOS(Apple Silicon arm64、KleidiAI 启用)、Linux(CPU、Vulkan、ROCm 7.2、OpenVINO、SYCL)、Android(arm64 CPU)、Windows(CPU、CUDA 12/13、Vulkan、OpenVINO、SYCL、HIP)以及 openEuler(部分禁用)。

open-sourcellama.cpptool callthinking
1 次进展公开报道
近 7 天 · 最近进展 2026年8月22日 · llama.cpp

b10573

llama.cpp 发布 b10573 版本,通过 ffmpeg 支持 WebP 图像格式。该版本提供 macOS、Linux、Android、Windows 及 openEuler 等多平台的构建产物,涵盖 CPU、Vulkan、ROCm、CUDA、OpenVINO、SYCL 等后端。

open-source-softwarellama.cppWebPffmpeg
1 次进展公开报道
近 7 天 · 最近进展 2026年8月22日 · llama.cpp

b10569

llama.cpp 发布 b10569 版本,新增 dots3-note 模型支持(PR #27060),包含文本转换初始化实现、地址审查评论修复、rope 移动至新的 llama_kv_cache_dsa_iswa,并提供 macOS、Linux、Android、Windows、openEuler 等多平台构建产物。

open-sourcellama.cppdots3-noteKV cache
1 次进展公开报道
近 7 天 · 最近进展 2026年8月21日 · Cline

v4.1.11

Cline 发布 v4.1.11 版本,新增支持模型在任务中生成图像,生成的图像内联渲染在对话中;修复 VS Code 1.134 上代码操作报错、@ 文件提及路径含空格失败、CRLF 行尾多行编辑 diff 视图等问题;恢复任务时保留存活会话而非重建;清除任务作用域设置覆盖;迁移旧任务时保留经典截断范围;保留 LiteLLM 输入 token 限制;恢复 Gemini 自定义基础 URL 并规范化旧主机根值;提供商注册链接指向各自 API 密钥页面;通过 skills 工具加载技能斜杠命令。

open-source-agent-releaseClinev4.1.11图像生成
1 次进展公开报道
近 7 天 · 最近进展 2026年8月20日 · llama.cpp

b10524

llama.cpp 发布 b10524 版本,该版本使 MoE expert scatter 操作具有确定性(#26464)。

open-sourcellama.cppMoEdeterministic
1 次进展公开报道
近 7 天 · 最近进展 2026年8月20日 · llama.cpp

b10507

llama.cpp 发布 b10507 版本,新增 mtmd_bitmap_set_mergeable 功能(PR #27348),并更新了各平台构建支持列表。

open-sourcellama.cppb10507mtmd_bitmap_set_mergeable
1 次进展公开报道
近 7 天 · 最近进展 2026年8月20日 · llama.cpp

b10506

llama.cpp 发布 b10506 版本,新增 Metal 后端对 q8_0 量化使用 packed types 进行反量化(dequantize)的功能。该版本支持 macOS Apple Silicon(arm64)、iOS、Linux、Android、Windows 等多种平台,并提供了多种后端(如 Vulkan、ROCm、OpenVINO、SYCL、CUDA、OpenCL 等)的构建选项。部分平台或后端被标记为 DISABLED,例如 macOS Intel、Ubuntu x64 (ROCm 7.14)、openEuler 等。

open-sourcellama.cppMetalq8_0
1 次进展公开报道
最近进展 2026年8月17日 · llama.cpp

b10455

llama.cpp 发布 b10455 版本,新增 SYCL 后端对 OPT_STEP_ADAMW 和 OPT_STEP_SGD 算子的支持,并更新了 ops.md 文档。该版本同时提供了覆盖 macOS、Linux、Windows、Android、openEuler 等多个平台的构建选项,其中部分平台(如 macOS Intel、Ubuntu x64 ROCm 7.14、openEuler 系列)标记为 DISABLED。

open-sourcellama.cppSYCLOPT_STEP_ADAMW
1 次进展公开报道
最近进展 2026年8月15日 · llama.cpp

b10437

llama.cpp 发布 b10437 版本,新增对 MiniMaxText01ForCausalLM 和 MiniMaxM1ForCausalLM 的支持,并针对 MiniMax-Text-01 模型进行了多项优化,包括添加 logits mask、使用 hparams.is_recr() 替换硬编码条件、使用 build_rs() 管理循环状态、移除状态转置操作、优化 decay 张量计算等。同时,为 MiniMax-M1 添加了 jinja 模板,并进行了相关测试修复和代码清理。

open-source-model-supportllama.cppMiniMax-Text-01MiniMax-M1
1 次进展公开报道
最近进展 2026年8月15日 · llama.cpp

b10436

llama.cpp 发布 b10436 版本,包含 mtmd、common 的多种修复,并应用了 gguf 修复。该版本提供多种平台构建,包括 macOS、iOS、Linux、Android、Windows 等,部分平台如 macOS Intel、ROCm 7.14 等被禁用。

open-sourcellama.cppb10436gguf
1 次进展公开报道
最近进展 2026年8月13日 · RAGFlow

dev-20260813

RAGFlow 发布了 dev-20260813 版本,该版本修复了允许共享同一基础嵌入模型的数据集被同时搜索的问题。

open-sourceRAGFlowdev-20260813embedding
1 次进展公开报道
最近进展 2026年8月12日 · llama.cpp

b10369

llama.cpp 的 b10369 版本为 pocket-tts 添加了支持,将转置卷积实现为 GEMM + col2im,以解决深度可分离上采样导致的图节点过多和内核启动开销问题。CUDA 上每帧生成时间下降 80%,CPU 上下降 50%,输出与先前实现逐样本匹配,相关性为 0.999994,帧数相同。

model-optimizationpocket-ttscol2imGEMM
1 次进展公开报道
最近进展 2026年8月11日 · llama.cpp

b10357

llama.cpp 发布 b10357 版本,包含一个针对 Flash Attention prefill kernel 的 OpenCL 优化:在本地内存中转置 K tile。该版本同时列出了 macOS、iOS、Linux、Android、Windows 和 openEuler 等多个平台的构建支持情况。

open-source-optimizationllama.cppFlash AttentionOpenCL
1 次进展公开报道
最近进展 2026年8月8日 · Claude Code

v2.1.225

Claude Code 发布 v2.1.225 版本,新增网关支出限制支持,改进工作区信任提示,修复多个问题,包括 OAuth 令牌、MCP OAuth 服务器、自动模式计数、跨会话消息、远程控制会话恢复、代理列表悬停和自托管运行器注册等。

developer-toolsClaude Codev2.1.225gateway
1 次进展公开报道
近 7 天 · 最近进展 2026年8月23日 · Cline

v4.1.15

Cline 发布 v4.1.15 版本,修复了 MCP 工具调用中 Auto-approve 功能的问题。此前,当 "Use MCP servers" 开关开启时,该功能仅对单独选择加入的工具生效,导致开关看似无效;现在该开关独立控制所有 MCP 工具。

developer-toolsClineMCPAuto-approve
1 次进展公开报道
近 7 天 · 最近进展 2026年8月23日 · llama.cpp

b10603

llama.cpp 发布 b10603 版本,支持 GLM-4.5-Air 模型中的 MTP(Multi-Token Prediction)功能。该版本提供多种平台构建,包括 macOS、Linux、Windows、Android 等,并支持多种后端如 Vulkan、CUDA、ROCm、OpenVINO、SYCL 等。

open-source-inferencellama.cppGLM-4.5-AirMTP
1 次进展公开报道
近 7 天 · 最近进展 2026年8月23日 · llama.cpp

b10598

llama.cpp 发布 b10598 版本,使用 pillow-accurate 算法并修正所有模型的 resize_algo,以进行速度优化。该版本提供多种平台构建,包括 macOS、iOS、Linux、Android、Windows 和 openEuler,并支持多种后端(如 Vulkan、ROCm、OpenVINO、SYCL、CUDA、OpenCL)。

open-sourcellama.cppb10598pillow-accurate
1 次进展公开报道
最近进展 2026年8月15日 · Kimi-K3

b10448

llama.cpp 发布 b10448 版本,新增 Kimi-K3 文本模型支持。该模型采用混合 KDA(线性)+ MLA(完整)注意力,架构与 Kimi-Linear-48B 类似,但额外包含跨层残差注意力、潜在 MoE、situ 激活、MLA 输出门和全秩 KDA 门。K3 的 text_config 报告为 KimiLinearForCausalLM,因此路由基于顶层名称。KDA 衰减门有两种形式,由 gate_lower_bound 选择,K3 设置为 -5.0。跨层残差使用 ggml_dsv4_hc_pre,仅支持 CPU 和 CUDA。路由专家以 mxfp4-pack-quantized 压缩张量形式提供,与 ggml 的 MXFP4 位兼容。

model-architectureKimi-K3llama.cpp混合注意力
1 次进展公开报道
最近进展 2026年8月15日 · llama.cpp

b10447

llama.cpp 发布 b10447 版本,重新设计 yield_to_queue 线程模型(#27133),在 worker 中运行 common_speculative_process,并交换 worker 主线程设计。该版本提供 macOS、iOS、Linux、Android、Windows 及 openEuler 等多平台构建,部分平台(如 macOS Intel、ROCm、openEuler 部分配置)被标记为 DISABLED。

open-sourcellama.cppb10447yield_to_queue
1 次进展公开报道
最近进展 2026年8月15日 · llama.cpp

b10446

llama.cpp 发布 b10446 版本,更新 BoringSSL 至 0.20260813.0,并提供多平台构建选项,包括 macOS、Linux、Android、Windows 等,部分平台如 macOS Intel、Ubuntu ROCm、openEuler 等被禁用。

open-sourcellama.cppBoringSSLrelease
1 次进展公开报道
最近进展 2026年8月14日 · llama.cpp

b10438: mtmd: fix Granite4 Vision image sequence assembly (#26653)

llama.cpp 发布 b10438 版本,包含对 Granite4 Vision 图像序列组装(image sequence assembly)的修复,具体涉及 grid assembly、scaled image height/width 的截断处理,并移除了 MTMD_DUMP_EMBD 调试脚手架。提交由 Hemanth Battu 和 Xuan Son Nguyen 共同完成。

open-sourcellama.cppGranite4 Visionimage sequence assembly
1 次进展公开报道
最近进展 2026年8月14日 · Anthropic

v2.1.233

Anthropic 发布了 Claude Code 的 v2.1.233 版本,新增了 GitLab 合并请求 URL 支持、可选的 forward_user_identity 网关设置、Linux 上 Bash 工具命令的可选内存 cgroup 支持,以及 CLAUDE_CODE_WEBFETCH_CACHE_TTL_MS 环境变量。修复了云会话丢失、MCP v2 连接重开、通知钩子未触发、Linux 空闲会话 CPU 占用 100% 以及捆绑技能别名报错等问题。

developer-toolsClaude CodeGitLabMCP
1 次进展公开报道
最近进展 2026年8月8日 · llama.cpp

b10330

llama.cpp 发布 b10330 版本,新增 CUDA 内核融合 rms_norm、mul、rope 及 view、set_rows 操作,并添加广播权重测试用例,同时检查内存范围。该版本支持多种平台,包括 macOS Apple Silicon、Linux(CPU、Vulkan、ROCm、OpenVINO、SYCL)、Android、Windows(CPU、CUDA、Vulkan、OpenVINO、SYCL、HIP)等。

open-sourcellama.cppCUDAkernel fusion
1 次进展公开报道
最近进展 2026年8月7日 · GitHub Copilot

GitHub Copilot weekly releases — August 3

GitHub 于 2026 年 8 月 7 日发布博客文章,介绍 GitHub Copilot 在桌面应用、CLI 和 VS Code 中的每周更新,功能包括恢复和组织工作、审查更改以及在不丢失上下文的情况下提问。

developer-tools-updateGitHub Copilotweekly releasedesktop app
1 次进展公开报道
最近进展 2026年8月16日 · llama.cpp

b10454: ci : fix dry-run reporting in make-release job [no ci] (#27167)

llama.cpp 的 b10454 提交修复了 make-release CI 任务中 --dry-run 模式下的报告问题。此前,即使某些步骤失败,该模式也会错误地报告所有检查通过。此提交引用了 issue #26839 的评论。

ci-fixCIdry-runmake-release
1 次进展公开报道
最近进展 2026年8月8日 · llama.cpp

b10329

llama.cpp 发布 b10329 版本,调整了工作目录(working directory)的显示逻辑:只有当一个工具声明其路径解析并针对工作目录运行时,WebUI 才会显示工作目录芯片并启用 /cwd 命令。此前只要服务器暴露任何内置工具(如 get_datetime),或用户关闭所有文件系统工具,工作目录芯片仍会显示。工具现在在 /tools 列表中发布其是否解析路径并针对工作目录运行的信息,与已有的写权限声明并列。该版本同时提供了 macOS、iOS、Linux、Android、Windows 等多平台的构建产物。

developer-toolsllama.cppworking directorytool declaration
1 次进展公开报道
59 个事件
最近进展 2026年7月8日 · xAI / Grok

Grok 4.5 发布:xAI 将代码、Agent 与 Office 工作合并为旗舰模型

xAI 于 2026 年 7 月发布 Grok 4.5,并通过 API、Grok Build、Cursor 与 Office 插件提供使用。

model-releaseGrokGrok 4.5xAI
1 次进展官方来源
最近进展 2026年7月9日 · Microsoft / OpenAI

GPT-5.6 进入 Microsoft 365 Copilot:Agent 获得企业级分发

GPT-5.6 成为 Microsoft 365 Copilot 的首选模型,覆盖 Word、Excel、PowerPoint、Chat 和 Cowork。

商业化Microsoft 365Copilot企业 Agent
2 次进展官方来源 · 多源核验
最近进展 2026年7月29日 · OpenAI

GPT-5.6 发布:OpenAI 把模型升级推向长期自主 Agent

OpenAI 发布 GPT-5.6,并同步推出面向跨应用、文件与长期任务的 ChatGPT Work。

model-releaseGPT-5.6AgentChatGPT Work
8 次进展官方来源 · 多源核验
最近进展 2026年7月8日 · OpenAI

GPT-Live 推进全双工语音:Agent 的交互带宽继续上升

OpenAI 发布新一代语音模型 GPT-Live,并接入 ChatGPT Voice。

multimodalGPT-Live语音多模态
1 次进展官方来源
当月论文组 · 2026年7月本月精选 1 篇高质量研究

Global Workspace · J-space · 可解释性 · 隐式推理 · 因果干预

展开全部论文
最近进展 2026年7月8日 · Robbyant / Ant Group

LingBot-VLA 2.0 开源:国产具身模型进入跨本体规模化阶段

蚂蚁集团 Robbyant 发布 LingBot-VLA 2.0 技术报告、预训练权重与代码;官方披露训练数据覆盖 20 种机器人配置和约 6 万小时机器人/第一视角视频。

embodied-aiLingBot-VLA 2.0具身智能VLA
1 次进展官方来源
最近进展 2026年7月25日 · Anthropic

v2.1.220

Anthropic 发布了 Claude Code v2.1.220,更新内容为 Bug 修复和可靠性改进。

open-sourceClaude Codev2.1.220bug fixes
2 次进展多方报道
最近进展 2026年7月28日 · CrewAI

1.15.6

CrewAI 发布 v1.15.6 版本,修复了 Anthropic preview tool-use 块检测、strict tool schema 属性名保留、crew 和 flow 执行失败时 execution_end 钩子分发、load_agent_from_repository 中 async get_agent 处理以及依赖解析问题。

open-sourceCrewAIv1.15.6bug-fix
5 次进展多方报道
最近进展 2026年7月28日 · Weaviate

v1.38.7 - Never use a search result as a read-repair payload

Weaviate 发布了 v1.38.7 和 v1.37.14 版本,包含多项修复和性能改进。

open-sourceWeaviatev1.38.7v1.37.14
2 次进展公开报道
最近进展 2026年7月26日 · Vercel

@ai-sdk/anthropic-aws@2.0.13

Vercel AI SDK 发布了 @ai-sdk/anthropic-aws@2.0.13 补丁版本,依赖更新为 @ai-sdk/anthropic@4.0.21,后者修复了将思考令牌报告为推理令牌使用的问题。

open-sourceVercel AI SDKAnthropic补丁
4 次进展公开报道
最近进展 2026年7月26日 · Vercel

@ai-sdk/amazon-bedrock@5.0.32

Vercel AI SDK 发布了 @ai-sdk/amazon-bedrock@5.0.32 和 @ai-sdk/amazon-bedrock@4.0.142 两个补丁版本,修复了在 Bedrock 上使用 Claude 模型时,omit tool strict 和 output_config.format 参数被拒绝的问题。

open-sourceVercel AI SDKAmazon BedrockClaude
2 次进展公开报道
最近进展 2026年7月14日 · OpenAI

How data science teams use ChatGPT Work

OpenAI 于 2026-07-14 发布了两篇教程,分别面向数据科学团队和销售团队,展示如何使用 ChatGPT Work 从实际工作输入构建根因简报、影响报告、KPI 备忘录、范围分析和仪表盘规范(数据科学),以及管道简报、会议准备包、预测回顾、账户计划和停滞交易诊断(销售)。

product-launchChatGPT Workdata sciencesales
2 次进展公开报道
最近进展 2026年7月27日 · Langfuse

v4.0.0-rc.2

Langfuse 发布了 v4.0.0-rc.2 预发布版本,包含 Agent 后台执行、异步虚拟化 JSON 渲染器、Salesforce 同步回填、移动端布局优化等功能,并删除了已废弃的 Postgres 和 ClickHouse 表。

open-source-observabilityv4.0.0-rc.2AgentJSON渲染
4 次进展公开报道
最近进展 2026年7月31日 · Vercel

@ai-sdk/xai@4.0.20

@ai-sdk/xai@4.0.20 版本发布,依赖更新包括 @ai-sdk/provider-utils@5.0.14 和 @ai-sdk/openai-compatible@3.0.16。

open-source@ai-sdk/xaiVercel AI SDKxAI
8 次进展公开报道
最近进展 2026年7月31日 · Vercel

@ai-sdk/workflow-harness@1.0.46

Vercel 发布了 @ai-sdk/workflow-harness@1.0.46 和 @ai-sdk/workflow@1.0.39、1.0.40 补丁版本。@ai-sdk/workflow@1.0.39 新增了动态工具描述、流式指令和 prepareStep 输入支持,并重构了 prepareStep 覆盖。

open-sourceVercelAI SDKworkflow
8 次进展公开报道
最近进展 2026年7月25日 · OpenAI Codex

0.146.0-alpha.2

OpenAI Codex 发布了两个 alpha 版本:0.146.0-alpha.1(2026-07-22T05:04:48Z)和 0.146.0-alpha.2(2026-07-22T07:25:46Z)。

open-sourceOpenAI Codexalpha releaseversion 0.146.0
8 次进展公开报道
最近进展 2026年7月25日 · SGLang

v0.5.16

SGLang v0.5.16 发布,包含 574 个 PR,来自 169 位贡献者。新特性包括:DSpark 置信度驱动推测解码算法,在 DeepSeek-V4-Pro 上达到 383.7 tok/s(TP8 B300, bs=1);Inkling 多模态 MoE 模型支持(975B 参数,1M 上下文),在 Blackwell 上达到 71.7k tok/s 输入和 171.0 tok/s 每用户解码;新增 LongCat 2.0 FP8、JetBrains Mellum v2、Pi0.5 等模型;UnifiedRadixTree 成为 SWA、Mamba 和 DSA 模型的默认实现。

open-sourceSGLangv0.5.16DSpark
2 次进展多方报道
最近进展 2026年7月31日 · OpenAI

Advancing responsible AI across Europe

OpenAI 于 2026 年 7 月 31 日发布文章,阐述其在安全、安保、透明度和来源方面的实践,以支持欧洲负责任的人工智能治理,并承诺随着欧盟人工智能法案的推进继续相关工作。

responsible-ai-governanceresponsible AIEU AI Actgovernance
1 次进展公开报道
最近进展 2026年7月31日 · llama.cpp

b10204

llama.cpp 发布 b10204 版本,新增 SYCL 支持通过 DEV2DEV_MEMCPY_FORWARD 实现 dev2dev memcpy,由 Neo Zhang Jianyu 贡献。该版本提供多种平台构建选项,包括 macOS(Apple Silicon、Intel)、iOS、Linux(CPU、Vulkan、ROCm、OpenVINO、SYCL)、Android、Windows(CPU、CUDA、Vulkan、OpenVINO、SYCL、HIP)及 openEuler(部分禁用)。

open-sourcellama.cppSYCLdev2dev memcpy
1 次进展公开报道
最近进展 2026年7月31日 · llama.cpp

b10202

llama.cpp 发布 b10202 版本,包含 SYCL 后端对 RMS_NORM 和 MUL 的融合优化(PR #26015)。该版本支持多种平台和硬件后端,包括 macOS、iOS、Linux、Android、Windows 和 openEuler,并支持 CPU、Vulkan、ROCm、OpenVINO、SYCL、CUDA、HIP、OpenCL 等。

open-sourcellama.cppSYCLRMS_NORM
1 次进展公开报道
最近进展 2026年7月31日 · llama.cpp

b10201

llama.cpp 发布 b10201 版本,改进 flash_attn_vec 以支持长上下文下的量化 KV cache,修复若干 bug 和注释,并解决 rebasing 导致的构建错误。该版本提供 macOS、iOS、Linux、Android、Windows 及 openEuler 等多平台构建,涵盖 CPU、Vulkan、ROCm、OpenVINO、SYCL、CUDA、OpenCL 等后端。

inference-optimizationflash attentionquantized KV cachelong context
1 次进展公开报道
最近进展 2026年7月31日 · RAGFlow

dev-20260731-2

RAGFlow 发布 dev-20260731-2 版本,修复了 wiki 的 claim card 不显示标题的问题(issue #17626)。

bug-fixRAGFlowwikiclaim card
1 次进展公开报道
最近进展 2026年7月31日 · Univé

Univé builds an AI-ready workforce

Univé 使用 ChatGPT Enterprise 构建了一支具备 AI 能力的工作团队,其方法结合了领导力、负责任的治理和员工主导的创新,以在规模上改变工作方式。

enterprise-ai-adoptionChatGPT EnterpriseAI-ready workforceleadership
1 次进展公开报道
最近进展 2026年7月30日 · Weaviate

v1.38.8 - Batch flat ContainsAny/ContainsAll/ContainsNone

Weaviate 发布了 v1.38.8 版本,包含多项修复和功能改进,如移除对旧备份格式的支持、修复 KagomeJa 自定义词典节流问题、通过 Index.withShardOrRemote 路由分片访问、按租户大小惰性分配向量缓存内存、修复复制中的加载分片就绪检查、为模块基础客户端添加重试、修复队列中的数据竞争、在命名空间集群上返回 API 密钥的首字母、在 BM25 搜索中支持跨属性 AND 匹配、添加 AnalyzeBatch 并优化 roaringset 读取路径、固定无限向量搜索测试中的 nearObject 锚点、更新依赖以修复 CVE-2026-46600 和 CVE-2026-56852 等。

open-sourceWeaviatev1.38.8BM25
1 次进展公开报道
最近进展 2026年7月30日 · llama.cpp

b10186

llama.cpp 发布 b10186 版本,修复了 KleidiAI CI 和 stringop overflow 警告问题。该版本支持 macOS(Apple Silicon arm64,含 KleidiAI 启用/禁用选项、Intel x64)、iOS、Linux(Ubuntu x64 CPU、arm64 CPU、s390x CPU、Vulkan、ROCm 7.2、OpenVINO、SYCL FP32/FP16)、Android(arm64 CPU)、Windows(x64 CPU、arm64 CPU、arm64 OpenCL Adreno、x64 CUDA 12/13、Vulkan、OpenVINO、SYCL、HIP)、openEuler(x86 310p、x86 910b ACL Graph、aarch64 310p、aarch64 910b ACL Graph)以及 UI。

open-sourcellama.cppb10186KleidiAI
1 次进展公开报道
最近进展 2026年7月29日 · Cline

nightly-main-20260729125433-912c46781808

Cline 发布了 nightly-main-20260729125433-912c46781808 版本,该版本是从 main 分支在 commit 912c467 发布的,包含 A/B 测试的合并内容。

open-sourceClinenightlyrelease
1 次进展公开报道
最近进展 2026年7月29日 · Weaviate

v1.39.0-rc.1 - Namespaces, Alter Schema, gRPC web, Search REST API

Weaviate 发布了 v1.39.0-rc.1 预发布版本,包含 Namespaces (GA)、Alter Schema - Reindex property (GA)、Alter Schema - Drop vector index (Preview)、gRPC web (GA) 和 Search REST API (GA) 功能。

open-source-releaseWeaviatev1.39.0-rc.1Namespaces
1 次进展公开报道
最近进展 2026年7月29日 · llama.cpp

b10175

llama.cpp 发布 b10175 版本,新增对 AMD RDNA 3.5 和 RDNA 3 的独立调优支持,并更新了多个平台的构建配置。

open-sourcellama.cppb10175RDNA 3.5
1 次进展公开报道
最近进展 2026年7月28日 · Cline

nightly-main-20260728125218-dc175c73a8dd

Cline 发布了 nightly-main-20260728125218-dc175c73a8dd 版本,该版本是 combined A/B 版本,从 main 分支的 dc175c7 提交发布。

open-sourceClinenightlyrelease
1 次进展公开报道
最近进展 2026年7月27日 · llama.cpp

b10150

llama.cpp 发布 b10150 版本,包含 ggml 调整 offloading ops 到 weight 后端逻辑、llama dsv4 图修复,并提供多平台构建(macOS、Linux、Windows、Android、openEuler)及 UI。

open-sourcellama.cppb10150ggml
1 次进展公开报道
最近进展 2026年7月27日 · Open WebUI

v0.11.0

Open WebUI 发布 v0.11.0 版本,主要更新包括:重新设计的界面、子代理功能(允许模型将任务部分委托给后台辅助代理)、文件夹页面(支持分页加载和排序)、以及多项其他改进。

open-sourcev0.11.0界面重新设计子代理
1 次进展公开报道
最近进展 2026年7月24日 · Cline

nightly-main-20260724124508-98024c4243ab

Cline 发布了 nightly-main-20260724124508-98024c4243ab 版本,该版本为 combined A/B 版本,基于 main 分支,提交哈希为 98024c4。

open-sourceClinenightlyrelease
1 次进展公开报道
最近进展 2026年7月24日 · llama.cpp

b10105

llama.cpp 发布 b10105 版本,由 Aaron Teo 提交,重构了 mlock/mmap/directio 为 load-mode 参数,并更新了文档和基准测试。

open-sourcellama.cppb10105load-mode
1 次进展公开报道
最近进展 2026年7月23日 · Cline

nightly-main-20260723124723-ae033761ab1e

Cline 发布了 nightly-main-20260723124723-ae033761ab1e 版本,该版本为 combined A/B 构建,于 2026-07-23T12:47:23.000Z 从 main 分支发布。

open-sourceClinenightlyrelease
1 次进展公开报道
最近进展 2026年7月23日 · Weaviate

v1.39.0-rc.0 - Namespaces, Alter Schema, gRPC web, Search REST API

Weaviate 发布了 v1.39.0-rc.0 预发布版本,包含 Namespaces (GA)、Alter Schema - Reindex property (GA)、Alter Schema - Drop vector index (GA)、gRPC web (GA) 和 Search REST API (GA) 功能。

open-sourcev1.39.0-rc.0NamespacesAlter Schema
1 次进展公开报道
最近进展 2026年7月22日 · llama.cpp

b10087

llama.cpp 发布 b10087 版本,新增对 Laguna XS.2 M.1 的支持,并提供 macOS、Linux、Windows、Android、iOS 等多平台构建选项。

open-sourcellama.cppb10087Laguna XS.2 M.1
1 次进展公开报道
最近进展 2026年7月22日 · llama.cpp

b10085

llama.cpp 发布 b10085 版本,修复 Qwen3-VL 视觉位置嵌入插值中 align_corners 参数不匹配问题,该问题导致非正方形图像的接地坐标缩放偏移。

open-source-fixllama.cppQwen3-VLposition embedding
1 次进展公开报道
最近进展 2026年7月22日 · llama.cpp

b10084

llama.cpp 发布 b10084 版本,包含对复用描述符时检查张量类型的修复,支持多种平台和硬件后端。

open-sourcellama.cppb10084tensor type
1 次进展公开报道
最近进展 2026年7月22日 · llama.cpp

b10082

llama.cpp 发布 b10082 版本,新增 KleidiAI 内核权重类型警告功能。

open-source-releasellama.cppKleidiAIb10082
1 次进展公开报道
最近进展 2026年7月16日 · Google DeepMind

Our approach to bioresilience

Google DeepMind and Isomorphic Labs published a blog post titled 'Our approach to bioresilience' on July 16, 2026, sharing their joint approach to bioresilience and AI models.

ai-safety-bioresiliencebioresilienceAI modelsGoogle DeepMind
1 次进展公开报道
最近进展 2026年7月30日 · llama.cpp

b10184

llama.cpp 发布 b10184 版本,支持 macOS、iOS、Linux、Android、Windows 等多平台,包括 Apple Silicon、CUDA、Vulkan、ROCm 等后端。

open-sourcellama.cppb10184multi-platform
1 次进展公开报道
最近进展 2026年7月25日 · Microsoft

ONNX Runtime v1.28.0

ONNX Runtime v1.28.0 发布,升级 ONNX 1.22.0 和 protobuf 6.33.5,cuDNN 和 cuFFT 在 CUDA EP 中变为运行时可选,引入实验性 C/C++ API,移除 TensorRT fused causal attention kernels 等。

open-sourceONNX Runtimev1.28.0CUDA
1 次进展公开报道
最近进展 2026年7月24日 · llama.cpp

b10108

llama.cpp 发布 b10108 版本,改进了核心组件(L2、DMA、MM、FA)的流水线。

open-sourcellama.cppb10108推理优化
1 次进展公开报道
最近进展 2026年7月23日 · llama.cpp

b10092

llama.cpp 发布 b10092 版本,启用 AIX 上的 PowerPC 后端变体,修复 PowerPC Q0 matmul 实现中缺失的分号。

open-sourcellama.cppPowerPCAIX
1 次进展公开报道
最近进展 2026年7月31日 · llama.cpp

b10216

llama.cpp 的 b10216 版本为 Vulkan 后端添加了 GGML_OP_POOL_1D 支持,包括新增 pool1d 计算着色器、push constants 结构体、pipeline 字段,并修复了池化结束边界为负时的崩溃问题,同时扩展了测试覆盖。该版本还列出了多种平台的构建选项,包括 macOS、Linux、Android、Windows 等。

open-sourcellama.cppVulkanpool1d
1 次进展公开报道
最近进展 2026年7月31日 · llama.cpp

b10215

llama.cpp 发布 b10215 版本,为 Windows Intel GPU 引入驱动版本检查以缓解崩溃问题,移除针对已修复驱动的崩溃防护,并调整函数体位置。该版本提供 macOS、Linux、Windows、Android、openEuler 等平台的多种构建选项,包括 CPU、Vulkan、ROCm、OpenVINO、SYCL、CUDA、HIP、OpenCL 等后端。

open-sourcellama.cppb10215Intel GPU
1 次进展公开报道
最近进展 2026年7月31日 · llama.cpp

b10214

llama.cpp 发布 b10214 版本,新增 n_embd_head 参数(PR #26342),由 Daniel Han 共同编写。该版本提供 macOS(Apple Silicon arm64,含 KleidiAI 启用/禁用)、iOS XCFramework、Linux(Ubuntu x64/arm64/s390x CPU、Vulkan、ROCm 7.2、OpenVINO、SYCL FP32/FP16)、Android(arm64 CPU)、Windows(x64 CPU、arm64 CPU、OpenCL Adreno、CUDA 12.4/13.3、Vulkan、OpenVINO、SYCL、HIP)以及 openEuler(x86 310p、x86 910b ACL Graph、aarch64 310p、aarch64 910b ACL Graph)等平台的构建选项,并包含 UI 组件。

open-sourcellama.cppn_embd_headb10214
1 次进展公开报道
最近进展 2026年7月31日 · llama.cpp

b10213

llama.cpp 发布 b10213 版本,支持 rotated KV cache 量化(#26180),并提供 macOS、Linux、Android、Windows、openEuler 等多平台构建。

open-sourcellama.cppKV cache量化
1 次进展公开报道
最近进展 2026年7月24日 · llama.cpp

b10121: ui: reduce per-token render cost when streaming (#26053)

llama.cpp 发布 b10121 版本,通过 UI 优化将流式输出时每个 token 的渲染时间从 210.36ms 降至 2.67ms(40 条消息场景下从 22.02ms 降至 3.33ms)。

open-sourcellama.cppstreamingUI rendering
1 次进展公开报道
最近进展 2026年7月24日 · Cline

v4.0.11

Cline v4.0.11 发布,新增对 Anthropic Claude Opus 5(含 1M 上下文窗口变体)的支持,覆盖 Anthropic、Claude Code、Bedrock、Vertex、Cline 和 OpenRouter 提供商;新增 Moonshot Kimi K3 支持;修复 Claude Opus 1M 上下文变体在超过 200k token 请求时的定价错误;为 Kimi K3 模型启用原生工具调用,修复空响应问题。

open-source-agent-platformClinev4.0.11Claude Opus 5
1 次进展公开报道
最近进展 2026年7月23日 · DeepSpeed

v0.19.3 Patch Release

DeepSpeed 发布了 v0.19.3 补丁版本,包含多项修复和功能更新,如验证 fp16 动态损失缩放参数为正、修复 ZeRO-3 中输出缓冲区的数据类型问题、修复文件描述符泄漏、默认梯度裁剪为 1.0、支持 AutoEP 与 ZeRO-3 zero.Init 源模块等。

open-sourceDeepSpeedv0.19.3patch release
1 次进展公开报道
最近进展 2026年7月23日 · Hugging Face

Bringing Nunchaku 4-bit Diffusion Inference to Diffusers

Hugging Face 于 2026 年 7 月 23 日发布博客,宣布将 Nunchaku 4-bit 扩散推理集成到 Diffusers 库中。

model-inference-optimizationNunchaku4-bit quantizationdiffusion inference
1 次进展公开报道
最近进展 2026年7月13日 · Google

Empowering India’s next generation of innovators with ATL Saathi

Google and AIM launched ATL Saathi, a Gemini-powered AI tool for Indian educators in robotics labs.

education-ai-toolATL SaathiGeminiIndia
1 次进展公开报道
最近进展 2026年7月11日 · OpenAI

彭博社揭秘苹果起诉 OpenAI 内幕:前员工一句“哈哈”成窃密关键

IT之家 7 月 12 日消息,据彭博社昨天报道,当 iPhone 工程师 Chang Liu 离开苹果,加入 OpenAI 硬件部门时,他带走的不只是多年以来累计的工作经验。 根据苹果昨天提起的诉讼,Chang Liu 离职时带走了三样东西:一台始终未归还的 MacBook 工作机、一名可以持续分享内情的苹果员工,以及一项软件漏洞,让他可以在离开苹果后继续访问公司内网服务器。 Chang Liu 发现漏洞后, 与他的同事 Alyssa Peng 分享道:“哈哈(LOL),我发现我还能访问网络存储,太搞笑了” 。而 Alyssa Peng 则是回复道:“我准备好了”,并利用自己的电脑帮助 Chang Liu 获取更多机密信息。 本次诉讼发生以前,苹果与 OpenAI 的关系就趋于紧张。两家公司本来是合作伙伴,如今却希望捷足先登 AI 硬件市场而成为竞争对手,意图重新定义消费者如何使用电子产品。 据悉,双方矛盾的核心人物是前苹果高管 Tang Tan。该人曾负责设计 iPhone、Apple Watch 等多款产品,并在 2023 年底告知管理层即将离职,后来成为 OpenAI 首席硬件官。 IT之家从原报道获悉,苹果甚至破天荒地允许他继续工作至 2024 年 2 月,好完成硬件部门的交接、对齐工作。然而在幕后,Tang Tan 已经密会前苹果首席设计官乔纳森 · 艾维及 OpenAI CEO 萨姆 · 奥尔特曼,希望打造一款全新的 AI 设备,未来有望挑战 iPhone。 目前已有超 400 名员工从苹果跳槽至 OpenAI。这种大规模挖角很快引来了苹果警觉,因为 OpenAI 不仅挖走了多位硬件和设计部门高级主管,还重创了苹果多个工程团队。 这种情况持续到了今年 6 月,当 OpenAI 挖走苹果智能眼镜负责人保罗 · 米德后,苹果要求其立即离职,并没有像 Tang Tan 那样给出交接时间。 苹果认为,OpenAI 正试图复制 iPhone 的整套产品研发体系,并在诉状中表示:“OpenAI 尚处于起步阶段的硬件业务,如今建立在极其脆弱的根基之上,其核心已经从非法窃取而来的商业机密腐烂”。 据一位与 Tang Tan 共事的不具名人士透露, 他在苹果 25 年的职业生涯一直以大胆著称 , 甚至可以说是“飞得离太阳非常近” 。 Tang Tan 因主导 Mac 笔记本和 iPod 设计而成名,随后负责初代 iPhone 的产品设计。2011 年起,他全面接管 iPhone 设计团队,之后又负责 Apple Watch 设计工作。离开苹果时,他已经跻身公司最高管理层。 与此同时,OpenAI 已经向硬件业务砸了数十亿美元,并朝着 IPO 迈进。不过根据知情人士透露,OpenAI 收购乔纳森旗下 io Products 时,并没有真正成熟的产品。虽然公司曾经研究过耳机、智能眼镜以及 AI 音箱等方案,但最终还是决定研制一款可以取代智能手机的设备。 苹果表示,公司在起诉 OpenAI 之前曾尝试过私了。苹果在今年 2 月主动联系过 OpenAI,告知其机密信息已经流出,要求 OpenAI 主动展开调查、防止类似事件再次发生。 然而 OpenAI 并未作出回应,诉讼中点名的员工也没有回应媒体置评请求。 此外,本次诉讼也进一步凸显了 Tang Tan 和苹果下一任 CEO 约翰 · 特努斯的紧张关系。据悉, 特努斯曾是 Tang Tan 的上司 , 而 OpenAI 挖走的大多数苹果员工都来自特努斯掌管的硬件部门 。

政策监管彭博社揭秘苹果起诉openai内幕
1 次进展公开报道
最近进展 2026年7月11日 · industry

Terrorist groups are using every major AI chatbot for attack planning and weapons development

A Cambridge study found that Boko Haram uses AI chatbots like ChatGPT, Claude, and Gemini to plan attacks, build explosives, and maintain weapons. ISIS operatives have been training the group's commanders on how to bypass safety filters since 2023. Given that the study found safety filters repeatedly failed to prevent misuse, voluntary self-regulation by AI providers clearly isn't enough. The article Terrorist groups are using every major AI chatbot for attack planning and weapons development appeared first on The Decoder .

政策监管terroristgroupsare
1 次进展公开报道
最近进展 2026年7月11日 · OpenAI

OpenAI 招聘家庭产品经理,将拓展家庭用户市场

IT之家 7 月 12 日消息,距离 ChatGPT 发布、生成式 AI 进入大众视野已过去三年多,OpenAI 正将关注重点从个人用户进一步扩展至家庭用户。 根据最新招聘信息,OpenAI 正在旧金山招聘一名专职产品经理,为其旗下产品打造面向家庭、护理人员和老年人的体验。职位要求应聘者具备面向家长和家庭用户设计产品的经验,并熟悉需要高度信任机制的消费者产品。 这一招聘动作也反映出 ChatGPT 的用户群体正在发生变化,不再主要由年轻用户构成。 根据市场研究机构 Sensor Tower 向 TechCrunch 提供的数据,2026 年第二季度,全球 ChatGPT 用户中 35 岁及以上人群占比已从一年前的 26% 上升至 31%;而 18 至 24 岁用户占比则从 34% 降至 29%。 在美国,Sensor Tower 估计,今年第二季度约 24% 的智能手机家长用户使用过 ChatGPT,而一年前这一比例仅为 16%。 科技咨询公司 Creative Strategies 首席执行官本 · 巴贾林(Ben Bajarin)认为,专门设立面向家庭的产品岗位,意味着 OpenAI 已开始将旗下产品从“个人效率工具”重新定位为“家庭共同使用的技术平台”。 “这与 Google、Apple 和 Meta 当年走过的发展路径类似 —— 随着平台逐渐融入日常生活,它们开始面向整个家庭提供服务。但 AI 的影响更大,因为 AI 助手不仅是在管理内容或设备,而是直接参与人与技术之间的互动。”他说。 不过,这种转变也带来了新的信任与安全挑战。 家庭在线安全研究所(Family Online Safety Institute,FOSI)首席执行官斯蒂芬 · 巴尔卡姆(Stephen Balkam)表示,此次招聘既说明 OpenAI 已进入更加成熟的发展阶段,也表明公司开始意识到,儿童和青少年使用 AI 产品需要不同于成年人产品的安全保护机制。 “我认为这是一次通过重新设计来提升安全性的尝试。”巴尔卡姆表示,“最初推出这些产品时,并没有充分考虑儿童用户,因此现在作出这样的调整是十分必要的。” 他的观点也呼应了 FOSI 本周发布的一项最新研究。这项针对美国和澳大利亚 4000 多个家庭开展的调查显示,家长普遍低估了孩子使用生成式 AI 的频率。只有 27% 的美国家长表示,孩子过去一周使用过生成式 AI,而实际上有 38% 的孩子表示自己确实使用过。 巴尔卡姆认为,AI 公司应该针对未成年用户采用完全不同的产品设计,包括更严格的内容管控、符合年龄特点的交互体验、家长监管机制,以及明确提醒用户自己正在与 AI 而非真人交流。 与此同时,AI 公司保护未成年用户的能力正受到越来越严格的审视。OpenAI 已遭遇多起由家长提起的诉讼,指控 ChatGPT 对其孩子造成伤害,其中部分案件甚至涉及未成年人自杀事件。 IT之家注意到,为回应这些担忧,OpenAI 在过去一年陆续推出了多项安全措施,包括: 为青少年账户提供家长控制功能; 将涉及敏感内容的对话交由更擅长识别心理危机的推理模型处理; 最新推出可选的“Trusted Contact(可信联系人)”功能,在检测到潜在自残风险时,可提醒家人或照护者。 巴尔卡姆表示,AI 企业有机会避免社交媒体行业曾经犯下的错误。过去多年,社交平台长期将儿童与成年人一视同仁,直到公众压力和监管不断增加后,才逐步加强未成年人保护措施。 此次招聘也与 OpenAI 在家庭领域的其他布局保持一致。 不久前,OpenAI 与圣安东尼奥马刺社区影响组织(San Antonio Spurs Community Impact)以及积极教练联盟(Positive Coaching Alliance)共同举办了一场研讨会,探讨 AI 在教育、教练培训以及青少年成长中的作用。 不过,用户年龄结构变化并非 ChatGPT 独有。 Sensor Tower 数据显示,Anthropic 的 Claude、Google 的 Gemini 与 ChatGPT 一样,25 至 34 岁用户均占全球用户总数的 40%,而微软 Copilot 这一比例为 33%。 但 Copilot 的用户年龄明显偏大,其中 45 岁及以上用户占比达到 20%,高于 Claude 的 14%、Gemini 的 12% 以及 ChatGPT 的 11%。 虽然 ChatGPT 在年长用户中的渗透率仍相对较低,但增长速度快于竞争对手。 Sensor Tower 数据显示,今年第二季度,ChatGPT 45 岁及以上用户占比较去年同期提升 3 个百分点;相比之下,Copilot 仅增长 2 个百分点,而 Claude 和 Gemini 的这一年龄段用户占比则出现下…

产品发布openai招聘家庭产品经理将拓展家庭用户市场
1 次进展公开报道
最近进展 2026年7月11日 · industry

Agentation – Visual UI Annotation for AI Coding Agents

Article URL: https://www.agentation.com/ Comments URL: https://news.ycombinator.com/item?id=48873337 Points: 1 # Comments: 0

产品发布agentationvisualui
1 次进展公开报道
最近进展 2026年7月11日 · industry

Show HN: BoundFlow – an open-source control plane for AI agents

Article URL: https://github.com/boundflow/boundflow Comments URL: https://news.ycombinator.com/item?id=48875888 Points: 1 # Comments: 0

产品发布showhnboundflow
1 次进展公开报道
最近进展 2026年7月11日 · industry

Sovereign AgentOps – Self-hosted constitutional AI governance for MCP agents

Article URL: https://github.com/geludobre/sovereign-agentops Comments URL: https://news.ycombinator.com/item?id=48875223 Points: 1 # Comments: 0

产品发布sovereignagentopsself
1 次进展公开报道
8 个事件
最近进展 2026年6月16日 · 智谱 AI / Z.ai

GLM-5.2 开源:智谱把 1M 上下文用于长时工程任务

智谱于 2026 年 6 月发布 GLM-5.2,以 MIT 许可开放权重,并提供 1M 上下文版本。

model-release智谱ZhipuZ.ai
1 次进展官方来源
最近进展 2026年6月17日 · xAI / Grok

Grok 进入 Amazon Bedrock:xAI 获得企业云分发与治理入口

xAI 于 2026 年 6 月宣布 Grok 4.3 在 Amazon Bedrock 正式可用。

商业化GrokGrok 4.3xAI
1 次进展官方来源
最近进展 2026年6月23日 · Mistral AI

Mistral OCR 4 发布:文档理解成为企业 Agent 的基础能力层

Mistral 于 2026 年 6 月发布 OCR 4,继续扩展其文档解析与企业工作流能力。

document-aiMistralMistral AIOCR 4
1 次进展官方来源
最近进展 2026年6月24日 · Google DeepMind

Gemini 3.5 Flash Computer Use:浏览器 Agent 进入低延迟模型层

Google DeepMind 于 2026 年 6 月 24 日发布 Gemini 3.5 Flash 的 computer use 能力。

product-releaseComputer UseBrowser AgentGemini 3.5 Flash
1 次进展官方来源
当月论文组 · 2026年6月本月精选 1 篇高质量研究

Deployment Simulation · 模型安全 · 真实分布 · Agent 评测 · 风险预测

展开全部论文
最近进展 2026年6月11日 · OpenAI

OpenAI 收购 Ona:Agent 竞争延伸到长期软件工程能力

OpenAI 于 2026 年 6 月 11 日宣布收购 Ona。

资本动作OpenAIOna收购
1 次进展官方来源
最近进展 2026年6月9日 · Google DeepMind

Gemma 4 12B:开放多模态模型进一步压缩部署门槛

Google DeepMind 于 2026 年 6 月 9 日发布统一、无独立编码器的 Gemma 4 12B 多模态模型。

model-releaseGemma 4 12B开放模型多模态
1 次进展官方来源
最近进展 2026年6月9日 · Microsoft

Claude Fable 5 进入 Microsoft Foundry:模型分发继续平台化

Microsoft 于 2026 年 6 月 9 日宣布 Claude Fable 5 在 Microsoft Foundry 可用,面向自主 Agent 场景。

distributionClaude Fable 5Microsoft Foundry企业 AI
1 次进展官方来源
10 个事件
最近进展 2026年5月28日 · Anthropic

Anthropic 完成 Series H:模型竞争进入资本、收入与算力共振

Anthropic 宣布完成 650 亿美元 Series H 融资,投后估值 9650 亿美元,并披露年化收入超过 470 亿美元。

资本动作Series H融资算力
1 次进展官方来源
最近进展 2026年5月25日 · xAI / Grok

Grok Build 发布:xAI 从模型 API 进入终端编码 Agent

xAI 于 2026 年 5 月发布 Grok Build 早期测试版,为订阅用户提供终端编码 Agent。

coding-agentGrokGrok BuildxAI
1 次进展官方来源
最近进展 2026年5月20日 · Cohere / Command

Command A+ 发布:Cohere 强化可私有部署的企业 Agent 模型

Cohere 于 2026 年 5 月发布 Command A+,并通过标准 API 与私有部署方式提供。

model-releaseCohereCommandCommand A+
1 次进展官方来源
最近进展 2026年5月19日 · 面壁智能 / ModelBest / OpenBMB

MiniCPM5-1B 开源:面壁把端侧小模型与 Agent Skills 连接

面壁智能与 OpenBMB 于 2026 年 5 月发布 MiniCPM5-1B,并提供部署、微调和 Agent Skills。

on-device面壁智能ModelBestOpenBMB
1 次进展官方来源
当月论文组 · 2026年5月本月精选 1 篇高质量研究

ERA · AI for Science · Nature · 科学 Agent · 实证研究

展开全部论文
最近进展 2026年5月15日 · Google DeepMind

Gemini 3.5:前沿模型竞争进一步转向可执行行动

Google DeepMind 于 2026 年 5 月 15 日发布 Gemini 3.5,并以面向行动的前沿智能作为核心定位。

model-releaseGemini 3.5Agent工具调用
1 次进展官方来源
最近进展 2026年5月17日 · Google DeepMind

Gemini Omni:原生多模态交互从能力展示走向统一产品入口

Google DeepMind 于 2026 年 5 月 17 日发布 Gemini Omni,强化跨文本、语音、视觉等模态的统一交互。

model-releaseGemini Omni多模态实时交互
1 次进展官方来源
最近进展 2026年5月17日 · Google

Google Antigravity 2.0:AI Coding 从补全工具走向任务级工程环境

Google DeepMind 于 2026 年 5 月 17 日发布 Google Antigravity 2.0,继续扩展面向 Agent 的开发体验。

product-releaseAntigravityAI CodingCoding Agent
1 次进展官方来源
最近进展 2026年5月20日 · Google

Google I/O 2026:AI 从单点功能变成横跨产品与开发栈的平台层

Google 于 2026 年 5 月 20 日汇总 I/O 2026 的 100 项发布、演示与产品更新。

industryGoogle I/O平台化Gemini
1 次进展官方来源
最近进展 2026年5月21日 · Google DeepMind

DeepMind 亚太加速器:前沿模型开始与区域产业问题直接绑定

Google DeepMind 于 2026 年 5 月 21 日宣布在亚太启动面向环境风险的加速器计划。

ecosystem亚太加速器气候科技
1 次进展官方来源
7 个事件
最近进展 2026年4月23日 · OpenAI

GPT-5.5 发布:模型升级开始按端到端工作结果衡量

OpenAI 发布 GPT-5.5,重点提升编码、研究、数据分析、文档和跨工具操作。

model-releaseGPT-5.5真实工作Computer Use
2 次进展官方来源 · 多源核验
最近进展 2026年4月7日 · 智谱 AI / Z.ai

GLM-5.1 发布:智谱把 Agent 目标推进到 8 小时持续执行

智谱官方 Release Notes 于 2026 年 4 月记录 GLM-5.1 发布,定位为长时任务旗舰模型。

agent-platform智谱ZhipuZ.ai
1 次进展官方来源
最近进展 2026年4月28日 · 商汤科技 / SenseTime / 日日新

SenseNova U1 开源:商汤把理解与生成合并为原生多模态模型

商汤于 2026 年 4 月发布并开源 SenseNova U1 原生统一多模态模型系列。

multimodal商汤SenseTime日日新
1 次进展官方来源
最近进展 2026年4月16日 · Anthropic

Claude Opus 4.7 发布:前沿能力继续聚焦复杂工作与 Agent

Anthropic 发布 Claude Opus 4.7,重点提升代码、Agent、视觉和多步骤任务表现。

model-releaseClaude Opus 4.7Agent编码
1 次进展官方来源
当月论文组 · 2026年4月本月精选 1 篇高质量研究

ReasoningBank · Agent 记忆 · test-time learning · 经验提炼 · ICLR

展开全部论文
最近进展 2026年4月2日 · Google DeepMind

Gemma 4 发布:开放模型竞争继续向单位资源效率推进

Google DeepMind 于 2026 年 4 月 2 日发布 Gemma 4,强调在开放模型形态下提升能力与部署效率。

model-releaseGemma 4开放模型推理效率
1 次进展官方来源
最近进展 2026年4月30日 · Google DeepMind

AI Co-clinician:医疗 AI 从问答助手转向协作式临床工作流

Google DeepMind 于 2026 年 4 月 30 日提出 AI co-clinician 方向,探索模型与临床人员协作的新工作模式。

industry医疗 AICo-clinician临床工作流
1 次进展官方来源
3 个事件
4 个事件
本月 4 个事件将在接近视口时加载
6 个事件
本月 6 个事件将在接近视口时加载
2 个事件
本月 2 个事件将在接近视口时加载
1 个事件
本月 1 个事件将在接近视口时加载
2 个事件
本月 2 个事件将在接近视口时加载
2 个事件
本月 2 个事件将在接近视口时加载
4 个事件
本月 4 个事件将在接近视口时加载
2 个事件
本月 2 个事件将在接近视口时加载
4 个事件
本月 4 个事件将在接近视口时加载
5 个事件
本月 5 个事件将在接近视口时加载
5 个事件
本月 5 个事件将在接近视口时加载
3 个事件
本月 3 个事件将在接近视口时加载
3 个事件
本月 3 个事件将在接近视口时加载
3 个事件
本月 3 个事件将在接近视口时加载
2 个事件
本月 2 个事件将在接近视口时加载
2 个事件
本月 2 个事件将在接近视口时加载
2 个事件
本月 2 个事件将在接近视口时加载
2 个事件
本月 2 个事件将在接近视口时加载
1 个事件
本月 1 个事件将在接近视口时加载
4 个事件
本月 4 个事件将在接近视口时加载
1 个事件
本月 1 个事件将在接近视口时加载
1 个事件
本月 1 个事件将在接近视口时加载
2 个事件
本月 2 个事件将在接近视口时加载
3 个事件
本月 3 个事件将在接近视口时加载
3 个事件
本月 3 个事件将在接近视口时加载
2 个事件
本月 2 个事件将在接近视口时加载
4 个事件
本月 4 个事件将在接近视口时加载
4 个事件
本月 4 个事件将在接近视口时加载
7 个事件
本月 7 个事件将在接近视口时加载
3 个事件
本月 3 个事件将在接近视口时加载
5 个事件
本月 5 个事件将在接近视口时加载
4 个事件
本月 4 个事件将在接近视口时加载
8 个事件
本月 8 个事件将在接近视口时加载
3 个事件
本月 3 个事件将在接近视口时加载
2 个事件
本月 2 个事件将在接近视口时加载
2 个事件
本月 2 个事件将在接近视口时加载
4 个事件
本月 4 个事件将在接近视口时加载
1 个事件
本月 1 个事件将在接近视口时加载