事件时间线
按月查看已核验的行业事件和重要研究,可按领域或内容类型筛选。
v4.5.0
Langfuse 发布 v4.5.0,新增提示词批量导入导出、结构仪表盘、计费解析器、工具静默模式、并发后台运行限制等功能,并修复多项问题。Cline 发布 v4.1.6,新增 meta/muse-spark-1.2-contributor 模型,并修复属性错误遥测。OpenAI Java SDK 发布 v4.50.0,新增 GPT-5.5 模型和可选工具名称/命名空间字段。
最近进展 2026年8月18日 · LiteLLMv1.97.0
LiteLLM 发布 v1.97.0,所有 Docker 镜像均使用 cosign 签名,每个版本使用同一密钥(首次引入于 commit 0112e53)。用户可通过固定 commit hash 或 release tag 验证签名。该版本新增功能:在 /cursor/chat/completions 上解析 Cursor thinking/fast 模型名称后缀;修复 team-callbacks 中 disable_logging 调用时停止日志记录的问题。
最近进展 2026年8月19日 · MS-SWIFTv4.5.2
MS-SWIFT 发布 v4.5.2 版本,修复了 Qwen3.8-35B-A3B 模型的错误尺寸配置,该配置在开发过程中从之前的 Qwen3.5/3.6 系列错误复制而来。社区报告了此问题。
最近进展 2026年8月5日 · Clinev4.1.3
Cline 发布 v4.1.3 版本,修复了组合发布包中两个 bundle 相互使对方 Cline 账户会话失效的问题;升级后的旧窗口刷新 token 会消耗共享 refresh token 导致“Unauthorized”提示和意外登出,现在升级后的旧窗口保持当前会话并显示一次性 Reload Window 提示。迁移到新扩展无法识别的模型 id 时回退到默认 Cline 模型,而非让 provider 未配置。恢复可靠的检查点:检查点一致创建,恢复时回滚整个工作区而非部分文件。保留 provider 配置加载完成前的设置编辑(base URL、API key、Qwen/Moonshot API 行不再被静默丢弃)。修复自定义 base URL 字段丢失按键的问题,并在清除失败后保留自定义 URL 复选框状态。推理时使用 AskSage 自定义 API URL 而非忽略。编辑消息替换会话时,待处理的工具审批会被解决。
最近进展 2026年8月15日 · ClineDesktop v0.0.12
Cline 发布 Desktop v0.0.12,为每个工具调用在 transcript 中分配独立行,包含图标、状态和可展开详情;命令以终端风格显示(如 $ bun test),编辑以逐 hunk 的 diff 内联展示;运行中的工具行以品牌紫色高亮,完成后变灰,错误保持红色;文件 diff 通过共享的语法高亮渲染器呈现,跟随应用主题而非浏览器主题;刷新了会话 transcript 布局、消息表面和 composer,采用新的 Inter 和 Geist Mono 字体;思考指示器在工具参数流式传输等安静时段保持显示;消息操作(复制、分叉、时间戳)不再拥挤消息文本,展开面板以全不透明度渲染;欢迎屏幕聊天输入居中并顶部对齐,提示建议暂时隐藏;新会话首轮不再卡在“Agent is working...”状态;计划运行不再出现在 transcript 中。Xiaomi MiMo 发布 v0.1.12,包含 CLI 新增 --yolo 权限绕过别名、bash 临时作用域删除豁免强制确认、会话重试 GPT 服务器过载错误、技能搜索黑名单提醒模型、认证停止向子进程传递用户凭据、Compose Next 模型可调用等修复。
近 7 天 · 最近进展 2026年8月24日 · Claude Codev2.1.241
Anthropic 发布了 Claude Code 的 v2.1.241 版本,更新内容为 bug 修复和可靠性改进。Cherry Studio 发布了 v2.0.8 版本,包含多项修复和新功能,如技能全局启用控制、代理浮动任务进度胶囊等。
近 7 天 · 最近进展 2026年8月21日 · FastGPTv4.16.1
FastGPT 发布 v4.16.1,更新 Agent Sandbox 环境变量和运行态镜像,并引入迁移工具将 MCP/HTTP 工具的 JSON Schema 统一为字符串存储。
最近进展 2026年8月19日 · MiMo-Codev0.1.13
MiMo-Code 发布 v0.1.13,包含多项修复与功能:运行时使用 Node API 进行哈希和 FTS 查询;移除死开发分支和 beta 发布路径;MIMOCODE_AUTO_APPROVE_DELETE 标志改为惰性读取;删除询问豁免改为实例级;重放空的 Anthropic thinking 块;yolo 自动批准删除;checkpoint 增加禁用开关;标识符时间戳扩展至 64 位;隐藏禁用生命周期提示;稳定 MCP 工具排序;动态系统提示内容受标志控制;新增 MIMOCODE_DISABLE_AGENTS_SKILLS 标志;技能目录去重。
最近进展 2026年8月13日 · Claude Codev2.1.231
Claude Code v2.1.231 修复了 MCP OAuth 登录时因重定向 URI 不匹配而失败的问题,该问题影响使用预注册 OAuth 客户端的服务器(如 Slack)。
近 7 天 · 最近进展 2026年8月23日 · LiteLLMv1.98.0
LiteLLM 发布 v1.98.0,所有 Docker 镜像均使用 cosign 签名,并提供了通过固定 commit hash 或 release tag 验证签名的方法。修复了 Bedrock 中 Claude Sonnet 5 的 toolSpec.strict 问题,以及 Vertex passthrough 批次的成本归属问题。
最近进展 2026年8月19日 · LMDeployv0.16.0
LMDeploy 发布 v0.16.0,新增支持 Interns2 mobius、GLM-5.2、Intern-S2-Mobius meta-MoE、MoE gate v2、CP attention 修复、TurboMind ViT(InternVL 和 Qwen VL 模型)、Hy3、MTP 和 FP8 优化;改进包括 SM90 原生 BF16/FP8 GEMM kernels、fused-SiLU 量化、SSM prefix caching 优化、guided-decoding 异步 D2H 拷贝和 xgrammar v0.2.1、Gluon blocked FP8 GEMM for Hopper、opt-in torch.compile for decode CUDA graphs。OpenAI Agents SDK for JavaScript 发布 v0.16.1,新增模型调用超时、run-scoped sandbox 工作目录、Docker sandbox 禁用网络、Modal sandbox 资源选项。
最近进展 2026年8月10日 · ClineDesktop v0.0.11
Cline 发布 Desktop v0.0.11,支持从剪贴板粘贴图片到 composer;打开非 git 仓库文件夹不再显示 git 术语;欢迎建议根据文件夹内容自适应;文件夹选择器报告失败并提供手动路径输入;打开已有会话不再覆盖所选模型;diff 面板根据会话工作目录解析文件路径;/team 提示词通过核心运行时执行;失败回合在转录中显示错误;空安装目录的插件不再列为已安装;插件设置和贡献集中管理并支持原子切换;修复启动脚本加载错误;webview 错误归因于来源 URL;登出作为正常状态处理;浏览器上下文菜单在应用界面被抑制,文本字段保留。
最近进展 2026年8月7日 · MiMo-Codev0.1.10
Xiaomi MiMo 发布 MiMo-Code v0.1.10,重点改进编排器与多会话可靠性:编排器路由到现有会话而非新建,子进程存活状态基于最近活动而非最近完成步骤,spawn 成为 actor 工具提示中的默认选项。工作树和 bash 提交继承仓库真实 git 身份。上下文与检查点处理修复包括:按模型早期压缩预算、遵守配置的上下文限制、消除重复上下文重建、手动 /rebuild 即时重建并显示等待界面,检查点写入器用故障分类替代盲目失败计数器。提供商韧性改进:不发送空内容消息(修复 Bedrock/Anthropic 400)、重放未签名的 Anthropic 推理、重试 OpenAI 流服务器错误和内部请求超时、DeepSeek 推理努力变体、OpenAI 函数工具使用 strict: false。
最近进展 2026年8月14日 · Langfusev3.225.3
Langfuse 发布 v3.225.3,修复了公开评论创建时的 authorUserId 验证问题(#16026),并忽略用户配置中的密码属性(#16027)。此前 v3.225.2 修复了 OIDC 发现验证中的内部目标阻止(#15988)、项目角色更新范围限定到组织(#15987)以及防止正则回溯拒绝服务(#15985)。OpenAI Python SDK 发布 v3.0.0,默认 HTTP 客户端改为 HTTPX2,不再自动安装 httpx,并提供临时运行时 legacy HTTPX 逃生舱。
最近进展 2026年8月9日 · ClineSDK v0.0.71
Cline 发布 SDK v0.0.71,包含 @cline/llms、@cline/agents、@cline/shared 等包。该版本改进了推理设置的可移植性,使 effort 级别和启用/禁用标志映射到 AI SDK 的原生推理设置(包括 Ollama),并优先处理显式禁用推理的请求。sdk.error 遥测现在归因于实际使用的模型,并从事件属性中去除未定义值。模型目录从 models.dev 刷新,并为 Cline provider 增加了 meta/muse-spark-1.2-contributor。
最近进展 2026年8月14日 · vLLMv0.27.1
vLLM 发布 v0.27.1 补丁版本,基于 v0.27.0,支持量化 DSpark Markov heads(PR #50424)。
最近进展 2026年8月9日 · ClineCLI v3.0.50
Cline 发布 CLI v3.0.50,为交互式 TUI 添加用户可选颜色主题,内置主题包括 Auto、Cline Dark、Cline Light、Tokyo Night、Gruvbox Dark、Nord、Dracula、Catppuccin Mocha、One Dark、Solarized Dark 和 Solarized Light。主题可实时预览,CLINE_THEME 环境变量可在启动时覆盖持久化选择。此外,git 分支显示现在会随其他终端或编辑器中的分支切换而更新;Telegram 斜杠命令(如 /clear)现在能到达连接器命令主机;竞态连接器启动不再冲突,实例在打开 socket 模式前被声明,hub 监督连接器进程,doctor/connect 跳过已启动的连接器;连接器工具默认启用;Slack 问候语在重连时不再重播;自动批准设置现在优先于 ACP。
近 7 天 · 最近进展 2026年8月22日 · ClineDesktop v0.0.14
Cline 发布 Desktop v0.0.14,新增原生 macOS 通知、语音输入、命令流式输出、图像生成、折叠工作摘要、动画推理轨迹等功能。beta 版引入云会话预览、头像叠加预览和 SSH 远程环境概念验证。
最近进展 2026年8月16日 · OpenHandsv1.13.0
OpenHands 于 2026-08-13 发布 v1.13.0,包含对话归档、内联 Markdown 工件预览、就绪问题门控、上下文窗口用量计量器与手动压缩等新功能,以及多项修复。
最近进展 2026年8月11日 · LiteLLMv1.94.2
LiteLLM 发布了 v1.94.2 版本,该版本的所有 Docker 镜像均使用 cosign 签名,签名密钥在提交 0112e53 中引入。用户可以通过固定的提交哈希或发布标签验证签名。该版本还包含对 #35835 和 #35844 的 backport。
近 7 天 · 最近进展 2026年8月26日 · Clinesdk/core/v0.0.81
Cline 于 2026-08-26 发布了 @cline/core@0.0.81、@cline/llms@0.0.81 和 @cline/shared@0.0.81 三个 SDK 包的新版本,时间分别为 09:37:48、09:37:45 和 09:37:42 UTC。此前在 08:45:41 UTC 发布了 @cline/core@0.0.80。
近 7 天 · 最近进展 2026年8月26日 · CUTLASSCUTLASS 4.7.1
NVIDIA 发布了 CUTLASS 4.7.1,修复了多个 bug,包括 setmaxnreg 与特定 warp-specialized 模式一起使用时的内核编译失败、jit/kernel 装饰器泄漏、cutlass.jax.cutlass_call 中的张量别名和可选张量处理问题、IKET profiler 的 protobuf 版本要求从 6.30 降低到 4.21、导入时写入 CUTE_DSL_LIBS、export_to_c 对 i64 输入输出 i32 动态形状、从 Python 值构造 cutlass.Numeric 的性能、TVM-FFI 环境流检测和字节偏移错误。该版本已针对 FlashAttention、Quack、FlashInfer、cuDNN-Frontend 和 PyTorch 进行了测试。
近 7 天 · 最近进展 2026年8月26日 · Clinesdk/llms/v0.0.80
Cline 发布了 @cline/llms@0.0.80 和 @cline/shared@0.0.80 两个 SDK 包的新版本。
最近进展 2026年8月7日 · RAGFlowdev-20260807-2
RAGFlow 于 2026-08-07 发布了 dev-20260807 和 dev-20260807-2 两个版本。dev-20260807 修复了表单字段中 embd_name 的显示,使其在缺少时回退到 embd_id。dev-20260807-2 改进了流式 agent 的 TTS 功能(issue #18004)。
最近进展 2026年8月6日 · RAGFlowdev-20260806-2
RAGFlow 在 2026-08-06 发布了 dev-20260806-2 版本,新增了 HTML 文件类型图标(issue #17925)。
最近进展 2026年8月2日 · Clinesdk/agents/v0.0.68
Cline 于 2026-08-01 发布了 @cline/agents@0.0.68、@cline/shared@0.0.68 和 @cline/llms@0.0.68 三个 SDK 包的新版本。
最近进展 2026年8月16日 · RAGFlowdev-20260817: fix: stop three recurring errors on doc delete (#17685) (#17686)
RAGFlow 发布 dev-20260817 版本,修复文档删除时三个重复出现的错误。该版本是 #17526("Refactor: merge dataset scope graph")的后续,该重构引入了两个代码路径,触及部署 schema 未声明的 Infinity 列。此 PR 使运行时对旧 schema 具有鲁棒性,同时向新 schema 添加新列,以确保新创建的表正确。
最近进展 2026年8月14日 · Clinesdk/core/v0.0.74
Cline 于 2026-08-13 发布了 @cline/core、@cline/llms、@cline/agents 和 @cline/shared 四个包的 v0.0.74 版本。
近 7 天 · 最近进展 2026年8月25日 · @ai-sdk/deepgram@ai-sdk/deepgram@3.1.0
@ai-sdk/deepgram@3.1.0 是 Vercel AI SDK 的一个版本,发布于 2026-08-23。该版本修复了转录选项(keyterm、paragraphs、intents、sentiment、replace)被静默丢弃的问题,现在这些选项作为查询参数发送到 /v1/listen 请求。提供者调用签名从 'nova-3' 扩展到任何转录模型 ID。行为变更:diarize 不再默认设为 true,仅在显式设置时发送。语音方面,裸语音族 ID(aura-2、aura)通过 generateSpeech 的 voice 和 language 选项组合上游模型 ID,完整语音 ID 保持不变。DeepgramSpeechModelId 联合类型被缩减为族 ID 加字符串转义。providerMetadata.deepgram 携带使用元数据、速度透传和错误解析。
最近进展 2026年8月14日 · Arize Phoenixarize-phoenix: v20.1.0
Arize Phoenix 发布 v20.1.0(2026-08-12),新增 JWT client assertion 支持 OAuth2 登录、评估指标图表布局优化、POST /traces/transfer 端点;修复导出会话 ID 冲突,并将 OpenAI 推理模型路由到 Responses API 客户端。v20.0.0(2026-08-11)引入 agent session persistence、语义着色工具提示、google-genai 替代 google-generativeai、span filter DSL 支持 trace_annotations。
最近进展 2026年8月10日 · OpenAI Codex0.148.0-alpha.2
OpenAI Codex 于 2026-08-07 发布了 0.148.0-alpha.1 和 0.148.0-alpha.2 两个预发布版本。
最近进展 2026年8月11日 · Clinesdk/agents/v0.0.72
Cline 发布了 @cline/agents@0.0.72、@cline/shared@0.0.72 和 @cline/llms@0.0.72 三个 SDK 包的新版本,时间均在 2026-08-09 02:33 UTC 左右。
最近进展 2026年8月5日 · ClineSDK v0.0.69
Cline 发布 SDK v0.0.69(含 @cline/llms@0.0.69 与 @cline/shared@0.0.69)。Ollama 的 response-start 超时默认值从 30 秒改为 5 分钟;完全空的 Ollama 响应(无文本、推理或工具调用)改为在模型边界重试;VS Code 与 CLI 中重新创建检查点,运行边界检测现在能跨进程重启与压缩存活;检查点恢复成为真正的工作区回滚,任务期间创建的文件被恢复至检查点时刻内容,检查点后创建的文件被移除,.gitignore 路径(如 build output、node_modules、.env)不受影响,并提供恢复前快照。
最近进展 2026年8月12日 · CUTLASSCUTLASS 4.6.2
NVIDIA 于 2026-08-08 发布 CUTLASS 4.6.2,包含 CuTe DSL 的 bug 修复与改进:回退了 4.6.0 中 TMA bulk copy elect_one 的变更以对齐 4.5.x 行为;修复了向量化 fp32->f8 转换问题、CuTe DSL fp8 grouped_gemm_dglu 内核编译问题、ptxas 的 opt-level 设置问题;set_name_prefix 现支持完全自定义编译内核名称;将每次 cute.compile 的 JIT 编译开销减少约 50 ms;在安装 Torch 时导入 cutlass.cute 速度提升 3.8 倍,未安装时提升 1.25 倍。该版本已针对 FlashAttention、Quack、FlashInfer 的特定提交进行测试。
最近进展 2026年8月9日 · Clinesdk/core/v0.0.70
Cline 发布了 @cline/core、@cline/shared、@cline/agents 和 @cline/llms 四个包的 v0.0.70 版本,时间均在 2026-08-05 09:15 左右。
近 7 天 · 最近进展 2026年8月24日 · Clinesdk/core/v0.0.77
Cline 发布了 @cline/core@0.0.77、@cline/shared@0.0.77、@cline/agents@0.0.77 和 @cline/llms@0.0.77 四个 SDK 包,版本号均为 0.0.77,发布时间在 2026-08-21 04:56:19 至 04:56:23 UTC 之间。此外,@cline/core@0.0.76 于 2026-08-21 02:39:05 UTC 发布。
近 7 天 · 最近进展 2026年8月24日 · OpenAI Codex0.150.0-alpha.2
OpenAI Codex 发布了两个版本:0.150.0-alpha.1(2026-08-20)和 0.150.0-alpha.2(2026-08-21)。
最近进展 2026年8月15日 · OpenAI Codex0.148.0-alpha.9
OpenAI Codex 发布了三个连续的 alpha 版本:0.148.0-alpha.7(2026-08-11T15:33:21Z)、0.148.0-alpha.8(2026-08-11T18:47:56Z)和 0.148.0-alpha.9(2026-08-12T01:38:28Z)。这些版本在 GitHub 上以标签 rust-v0.148.0-alpha.7、rust-v0.148.0-alpha.8 和 rust-v0.148.0-alpha.9 发布。
最近进展 2026年8月14日 · Vercel AI SDK@ai-sdk/vue@3.0.248
Vercel 于 2026-08-11 发布了 @ai-sdk/vue@3.0.248、@ai-sdk/rsc@2.0.248 和 @ai-sdk/svelte@4.0.248 三个补丁版本,均更新了依赖 ai@6.0.248 和 @ai-sdk/provider-utils@4.0.44,其中 @ai-sdk/rsc 还更新了 @ai-sdk/provider@3.0.15。
近 7 天 · 最近进展 2026年8月26日 · Transformersv5.16.0
Hugging Face Transformers 发布了 v5.16.0 版本,通过 GitHub 标签发布。
近 7 天 · 最近进展 2026年8月26日 · llama.cppb10635
llama.cpp 发布 b10635 版本,为 MoE 在 sm_60 上解除 mmq 阻塞,并为 dp4a 和旧版 cuda 复制 mmq-config-pascal,同时降低非 dp4a pascal 上 Q2_K、Q4_K、Q5_K、Q6_K 的占用。该版本提供多种平台构建,包括 macOS、Linux、Windows、Android 等。
近 7 天 · 最近进展 2026年8月26日 · Langfusev4.20.0
Langfuse 发布 v4.20.0 版本,包含多项功能更新与修复。功能方面:在搜索栏中复用规则过滤器(#16554)、为评分添加内联类别并支持在新标签页打开配置(#16271)、添加评估器执行 SLO 指标(#16589)、在 Web 端将 trace-table 的 facet 列表折叠在“Show N more”控件后(#16071)。修复方面:澄清评估器保存对话框标题(#16557)、在 HIPAA 部署中隐藏产品反馈(#16526)、要求审计日志访问权限才能进行审计日志批量导出下载(#16567)、通过标签点击切换列可见性(#16276)、将过大的 tRPC 查询作为 POST 发送以避免 HTTP 414/431 错误(#16268)、在表格中将观察级别标注为状态(#16269)、为缺失的观察成本显示破折号(#16287)、从 Sentry 中移除无堆栈的浏览器扩展 import() 噪声(#16367)、丢弃预期的陈旧工具批准冲突(#16384)、解析单消息输入(#16565)以及处理格式错误的输入。
近 7 天 · 最近进展 2026年8月26日 · llama.cppb10632
llama.cpp 发布 b10632 版本,为 Mamba-2 预填充添加了分块 SSD MMA 优化,并新增了 FC_SSM_SCAN 常量。
近 7 天 · 最近进展 2026年8月25日 · llama.cppb10622
llama.cpp 发布 b10622 版本,修复了 Metal 后端在内存不足时因未检查 ggml_metal_buffer_init 返回值而导致的空指针解引用崩溃(OOM crash)。修复后,分配失败会记录错误并返回 NULL,避免硬崩溃。
近 7 天 · 最近进展 2026年8月25日 · MLXv0.32.2
MLX 发布 v0.32.2 版本,包含多项修复与改进:保留非规格化浮点数转 bool、支持裸 Ellipsis 索引赋值、修复 divmod 对浮点商的截断、为 scaled_dot_product_attention 增加 force_fused 选项、拒绝归一化层中的负 eps、约束 GGUF 元数据字符串/数组值、gqa-8 解码注意力中每 K/V 字节只读一次、修复 fft vmap 和 jvp、修复 median 丢弃 NaN、修复 CPU 扫描、验证优化器 betas、修复 RMSNormVJP 反向传播、为 take_along_axis 的 axis 参数添加默认值、为 NAX 设备 head_dim 256 添加融合全注意力路径、更新 nanobind 至 2.15.0、跳过不必要的 simdgroup 计算。
近 7 天 · 最近进展 2026年8月25日 · llama.cppb10621
llama.cpp 发布了版本 0.3.0(标签 b10621),更新内容包括版本号提升、CI 更新默认发布描述、添加生成发布摘要的脚本提示。该版本提供了多种平台的构建产物,包括 macOS、iOS、Linux、Android、Windows 和 openEuler,支持多种后端(如 Vulkan、ROCm、OpenVINO、SYCL、CUDA、OpenCL)。
近 7 天 · 最近进展 2026年8月25日 · Langfusev4.18.0
Langfuse 发布 v4.18.0,包含多项功能、修复和价格调整。功能包括:基于 payload 的评估规则过滤器、刷新全大写/精确匹配/关键词重叠模板、记录编码请求体大小、在事件流中记录工具审批来源。修复包括:GPT-5.4 推理 token 定价、评分分页、评估器搜索模态、过滤器、自动化 token、OTLP 请求体限制、LLM 判断重试、布尔测试结果渲染、媒体标签、sandbox MCP 工具提示。价格调整:降低 gpt-5.6-sol 价格。
近 7 天 · 最近进展 2026年8月25日 · llama.cppb10620
llama.cpp 项目发布了 b10620 版本,该版本提供了针对 macOS、Linux、Android、Windows 和 openEuler 等多个平台的构建产物,包括 CPU、Vulkan、ROCm、OpenVINO、SYCL、CUDA、OpenCL 等后端支持,并提供了 UI。
近 7 天 · 最近进展 2026年8月25日 · ClineDesktop v0.0.17
Cline 发布 Desktop v0.0.17,将 Plugins、MCP、Skills、Rules、Hooks 和 Tools 整合为一个 Customize 中心,包含标签页和实时计数;目录标签显示已安装内容,并内联 Browse 区域,安装后立即显示,独立的 Marketplace 页面被移除。Models 页面重新设计,提供商按 Connected、Popular 和 All 分组,显示认证类型和配置状态;OAuth 提供商支持浏览器登录,并提供手动密钥选项和明确的连接/断开/退出操作。语音输入移至 Settings → Voice 页面,仅提供支持转录的提供商并预选默认模型;作曲器的麦克风按钮仅在配置语音模型后出现。侧边栏会话按项目分组,置顶会话位于每组前,计划会话有内联时钟标记;收藏操作更名为 Pin,New、Schedule 和 Customize 各有标签行。
近 7 天 · 最近进展 2026年8月24日 · llama.cppb10605
llama.cpp 发布 b10605 版本,其中 mamba2 的 in/out projections 被扁平化以调度 GEMM 而非 GEMV,并移除了冗余的 output reshape。该版本支持多种平台,包括 macOS、iOS、Linux、Android、Windows 和 openEuler,并启用了多种后端如 Vulkan、ROCm、OpenVINO、SYCL、CUDA 和 OpenCL。
近 7 天 · 最近进展 2026年8月24日 · llama.cppb10604
llama.cpp 发布 b10604 版本,包含 Deepseek 4 的 sm tensor 支持,设置更细粒度的 head splits,修复 dspark,添加 dsv4 模型保存,允许 dflash 在特定设备返回,添加 dsv4 seq_rm 注释,简化共享专家延迟 allreduce,移除 dsv4 特殊测试。该版本提供多平台构建,包括 macOS、iOS、Linux、Android、Windows 和 openEuler,并支持多种后端如 Vulkan、ROCm、OpenVINO、SYCL、CUDA 等。
近 7 天 · 最近进展 2026年8月23日 · llama.cppb10593
llama.cpp 发布 b10593 版本,包含 DeepseekV4 的多序列回滚修复、模型加载修复、压缩比断言、图拓扑静态化等改动,并提供多平台构建产物。
近 7 天 · 最近进展 2026年8月23日 · Clinev4.1.14
Cline 发布 v4.1.14 版本,更新了内置模型目录,新增 Claude Fable 5、Grok 4.6 on Vertex、DeepSeek V4 Flash 变体(含 vision preview)、MiMo v2.5、Qwen3.8 27B、Gemma 4 26B、LongCat 2.0、Nemotron 3.5 Lightning 和 Thinking Machines 的 Inkling 模型。修复了交互式会话完成遥测问题,确保每个会话报告一次完成。
近 7 天 · 最近进展 2026年8月23日 · llama.cppb10590
llama.cpp 发布了 b10590 版本,更新了 subprocess.h,并提供了多种平台和硬件加速的构建产物,包括 macOS、iOS、Linux、Android、Windows 和 openEuler。
近 7 天 · 最近进展 2026年8月23日 · llama.cppb10589
llama.cpp 发布 b10589 版本,新增 CUDA 的 POOL_1D 支持,并修复了 editorconfig 合规性缺失的尾部换行。该版本提供 macOS、Linux、Android、Windows、openEuler 等多个平台的构建产物,涵盖 CPU、Vulkan、ROCm、OpenVINO、SYCL、CUDA、OpenCL 等后端。
近 7 天 · 最近进展 2026年8月22日 · llama.cppb10581
llama.cpp 发布 b10581 版本,新增对 DSpark 的支持,用于 bailingmoe3 模型。该版本提供 macOS、iOS、Linux、Android、Windows 及 openEuler 等多平台构建,并包含 UI 组件。
近 7 天 · 最近进展 2026年8月22日 · llama.cppb10580
llama.cpp 发布 b10580 版本,新增对 dots3-note 的 vision+audio 支持(PR #27524),并包含文本转换初始化实现、mtmd 转换实现及 C++ 实现,更新了 gguf-py/gguf/tensor_mapping.py。该版本提供多种平台构建,包括 macOS Apple Silicon、Linux(CPU、Vulkan、ROCm、OpenVINO、SYCL)、Android、Windows(CPU、CUDA、Vulkan、OpenCL、OpenVINO、SYCL、ROCm)等。
近 7 天 · 最近进展 2026年8月22日 · llama.cppb10578
llama.cpp 发布 b10578 版本,优化了 ggml 的 concat 操作,将逐元素 memcpy 替换为行级 memcpy,并修复了行级拷贝的 concat 偏移,添加了 concat 行连续性和块大小断言。该版本支持多种平台,包括 macOS、Linux、Android、Windows 等。
近 7 天 · 最近进展 2026年8月22日 · llama.cppb10577
llama.cpp 发布 b10577 版本,修复了 draft-mtp 与 embeddings 的兼容性问题(#26352、#27299、#27400),并提供了多平台构建产物,包括 macOS、Linux、Windows、Android 等。
近 7 天 · 最近进展 2026年8月22日 · llama.cppb10576
llama.cpp 发布了 b10576 版本,重新添加了 Q2_K reordered MMVQ 和 ESIMD kernels(PR #27490),并恢复了之前被回滚的提交。该版本支持多种平台,包括 macOS、iOS、Linux、Android、Windows 和 openEuler,并提供了 SYCL FP32/FP16 等构建选项。
近 7 天 · 最近进展 2026年8月21日 · Google DeepMindFrom Atari to EVE Online: Building on 15 Years of AI Research in Games
Google DeepMind 宣布与游戏工作室合作,基于 15 年的游戏 AI 研究,原型化突破性的 AI 游戏玩法。
近 7 天 · 最近进展 2026年8月21日 · vLLMv0.28.0rc2: [Spec Decode] DFlash2: local convolution + candidate selector (#52816)
vLLM 项目发布了 v0.28.0rc2 版本,其中包含一个名为 DFlash2 的 Spec Decode 功能,该功能涉及局部卷积和候选选择器。此版本是从提交 b389ac2 中 cherry-pick 而来,由 khluu 签署。
近 7 天 · 最近进展 2026年8月20日 · llama.cppb10514
llama.cpp 发布 b10514 版本,新增 GraniteSWAForCausalLM 和 GraniteMoeSWAForCausalLM 模型转换支持,包括 rope_pattern 数组转换基础设施、SWA 模式逻辑修复、非 rope 层支持,以及 llama_hparams 的 has_rope 和架构常量。
近 7 天 · 最近进展 2026年8月20日 · llama.cppb10509
llama.cpp 发布 b10509 版本,新增 ggml_rope_set_offset 算子,并支持 Metal、CUDA、Vulkan 后端,同时提供多种平台构建。
最近进展 2026年8月19日 · RAGFlowv0.27.0
RAGFlow 发布 v0.27.0 版本,包含多项功能更新与修复,如新增模型提供商、聊天与搜索页面过滤器、任务执行器迁移至 Go 语言,以及修复内存错误显示、技能搜索、内置元数据等问题。
最近进展 2026年8月17日 · GoogleGet closer to the game with Gemini and Pixel
Google 宣布与五家全球足球俱乐部合作,利用 Gemini 和 Pixel 提升球迷的 matchday 体验。
最近进展 2026年8月17日 · llama.cppb10456
llama.cpp 发布 b10456 版本,修复 SYCL 后端量化拷贝内核的线程/块数量,使其与量化大小成比例,减少过度/不足订阅。在 Arc 70 上,q4_0 到 f32 路径的吞吐量从 20.21 GB/s 提升到 158.19 GB/s,其余量化类型性能提升持平。该版本同时提供多平台构建,包括 macOS、Linux、Windows、Android 等,部分平台(如 macOS Intel、ROCm 7.14、openEuler)标记为 DISABLED。
最近进展 2026年8月16日 · llama.cppb10452
llama.cpp 发布 b10452 版本,重构了 supports_string_content / supports_typed_content 处理(#27130),改进了 supports_string_content 能力检测,新增测试中的 "skip" 消息,并更新了网站与 UI。该版本支持 macOS(Apple Silicon arm64,含 KleidiAI 启用与禁用)、iOS、Linux(多种 CPU/GPU 后端)、Android、Windows(多种 CUDA/Vulkan/OpenVINO/SYCL/ROCm 后端)及 openEuler(部分禁用)。
最近进展 2026年8月16日 · llama.cppb10451
llama.cpp 发布 b10451 版本,包含对 LoRA 张量数据是否在文件边界内的检查更新,修改了 src/llama-adapter.cpp,并提供了多种平台构建选项。
最近进展 2026年8月13日 · CUTLASSCUTLASS 4.7.0
NVIDIA 发布了 CUTLASS 4.7.0,引入了 CuTe DSL 的 Primitives API,这是一个基于 SIMT 的 Tensor Core 编程的低层抽象,作为过渡性 API 直到 CUDA Python 类似方案可用。同时引入了任务调度框架,用于 warp 特化内核的静态分析,检测并发问题并提供可视化工具。编译器诊断改进,可在编译时报告寄存器溢出和本地内存使用,并带有源代码行号。该版本已针对 FlashAttention 和 Quack 等包进行了测试。
最近进展 2026年8月13日 · llama.cppb10405
llama.cpp 发布 b10405 版本,移除 ggml-hip 中的 -funsafe-math-optimizations 编译选项,该选项启用 -fassociative-math,会重关联浮点归约,可能导致 RDNA3.5 上贪心 argmax 结果翻转(如 MTP 推测解码与非推测基线产生分歧)。移除后 HIP 构建符合 IEEE 标准。该版本同时列出多平台构建状态,包括 macOS、Linux、Windows、Android 等,部分平台标记为 DISABLED。
最近进展 2026年8月12日 · llama.cppb10375
llama.cpp 发布 b10375 版本,主要变更包括为 Qwen 模型收紧 bare function 解析(#26793),并更新了各平台的构建支持矩阵。
最近进展 2026年8月12日 · ONNX RuntimeONNX Runtime v1.29.0
ONNX Runtime v1.29.0 发布,宣布弃用 onnxruntime-web 的 WebGL 和 JSEP,推荐使用原生 WebGPU EP;POSIX 遥测现可在 Linux、macOS、Android 和 iOS 上使用(需启用遥测构建),不改变公共 ABI,WebAssembly 保持无遥测,设置 ORT_DISABLE_TELEMETRY=1 可禁用非 Windows 遥测;移除了未使用的内部 onnxruntime/python/tools/tensorrt 仪表板工具,不影响 TensorRT Execution Provider API;修复了 TensorRT 和 NvTensorRTRTX 引擎重拟合中的路径遍历漏洞,使外部数据路径验证无条件化;验证了 CPU MoE k 属性与专家数量,修复了 CPU TensorScatter 安全问题;为 pooling、LSTM、DynamicQuantizeLSTM、Sampling、FeatureVectorizer、SkipLayerNorm、QLinearConv、Whisper 解码等添加了缺失的 rank、shape 和参数验证。
最近进展 2026年8月11日 · llama.cppb10359
llama.cpp 发布 b10359 版本,修复 CI 错误,新增 flash_attn 测试,为 cpy 添加 i32 支持,并启用所有 ops 测试。该版本提供多种平台构建,包括 macOS、Linux、Android、Windows 等,支持 CPU、Vulkan、ROCm、OpenVINO、SYCL、CUDA 等后端。
最近进展 2026年8月11日 · llama.cppb10358
llama.cpp 发布了 b10358 版本,更新了各平台的构建支持,包括 macOS、iOS、Linux、Android、Windows 和 openEuler,并提及了 PR 25532 的评审意见。
最近进展 2026年8月10日 · llama.cppb10338
llama.cpp 发布 b10338 版本,修复了 MoE 模型保存/加载时共享专家 FFN 长度键被覆盖的问题。修复前,保存器两次调用 add_kv 写入 LLM_KV_EXPERT_SHARED_FEED_FORWARD_LENGTH,第二次覆盖第一次,导致 shared_feed_forward_length 被错误保存为 n_ff_chexp,且 expert_chunk_feed_forward_length 从未写入。这导致 qwen2moe、qwen3-next、granite-moe、hunyuan-moe、ernie4.5、bailingmoe2、nemotron-h 等共享专家 MoE 模型在保存后加载失败。修复后,第二次调用改为写入 LLM_KV_EXPERT_CHUNK_FEED_FORWARD_LENGTH,并更新测试以验证所有架构的往返加载。
最近进展 2026年8月10日 · MultiverseComputingCAIMaking Knowledge Distillation Cheap Enough to Run at Scale
Hugging Face 博客发布了一篇题为“Making Knowledge Distillation Cheap Enough to Run at Scale”的文章,作者为 MultiverseComputingCAI,发布于 2026-08-10。文章讨论了如何使知识蒸馏的成本足够低以支持大规模运行。
最近进展 2026年8月10日 · llama.cppb10336
llama.cpp 发布 b10336 版本,重构了多个 WGSL 文件并简化了 flash_attn 的 WGSL 实现。该版本提供 macOS、iOS、Linux、Android、Windows 和 openEuler 等多个平台的构建产物,其中部分平台(如 macOS Intel、openEuler)被标记为 DISABLED。
最近进展 2026年8月9日 · llama.cppb10333
llama.cpp 发布 b10333 版本,修复了 SpaceMiT 后端中缺失的 Q5_0 调度问题。该版本支持多种平台,包括 macOS、iOS、Linux、Android、Windows 和 openEuler,并提供了 CPU、Vulkan、ROCm、OpenVINO、SYCL、CUDA、OpenCL、HIP 等后端。
最近进展 2026年8月9日 · llama.cppb10332
llama.cpp 发布 b10332 版本,移除了 GGML_HIP_ROCWMMA_FATTN 相关代码。该版本支持多种平台,包括 macOS、iOS、Linux、Android、Windows 和 openEuler,并提供了 CPU、Vulkan、ROCm、OpenVINO、SYCL、CUDA、HIP、OpenCL 等后端。
最近进展 2026年8月7日 · NVIDIA NeMo SpeechNVIDIA NeMo Speech 3.0
NVIDIA NeMo Speech 3.0 是仓库拆分并更名为 NVIDIA-NeMo/Speech 后的首个主要版本。该版本聚焦 ASR、TTS、音频处理、说话人任务和 SpeechLM。非语音组件(如框架、LLM、VLM、扩散、导出/部署、评估器)已移至 NVIDIA-NeMo 组织下的独立仓库。该版本移除了 80 万行废弃代码,迁移到 uv 包管理器,增强了模型测试覆盖,减少了依赖数量,改进了文档,提供了更轻量的容器,并添加了 AGENTS.md 和代理技能。
最近进展 2026年8月7日 · llama.cppb10305
llama.cpp 发布 b10305 版本,为 SYCL 后端新增对 DSv4 操作(LIGHTNING_INDEXER、DSV4_HC_COMB、DSV4_HC_POST、DSV4_HC_PRE)的支持,并更新了 ops.md 文档。该版本同时提供了覆盖 macOS、Linux、Android、Windows 及 openEuler 等多平台的构建选项,包括 CPU、Vulkan、ROCm、OpenVINO、SYCL、CUDA、HIP 等后端。
最近进展 2026年8月7日 · llama.cppb10303
llama.cpp 发布 b10303 版本,修复了 SYCL 后端在 Arc770 上出现的 'Error OP FLASH_ATTN_EXT' 错误。该版本同时列出了 macOS、Linux、Android、Windows、openEuler 等多个平台的构建支持情况,其中 macOS Intel 和 openEuler 部分构建被标记为 DISABLED。
最近进展 2026年8月7日 · llama.cppb10301
llama.cpp 发布 b10301 版本,修复了 CUDA 中未使用变量/函数的警告(#26688)。该版本提供多种平台的构建选项,包括 macOS、iOS、Linux、Android、Windows 和 openEuler,并支持多种后端如 Vulkan、ROCm、OpenVINO、SYCL、HIP、OpenCL 等。
最近进展 2026年8月7日 · HSP GRUPPEHow HSP GRUPPE builds AI capabilities for tax advisory
HSP GRUPPE 使用 ChatGPT Enterprise 来提高生产力、改善工作质量,并为税务咨询和客户服务创造更多容量。
最近进展 2026年8月7日 · llama.cppb10299
llama.cpp 发布 b10299 版本,修复了 MSL 中 threadgroup matrix 数组实例化导致的编译错误。修复方式是将 threadgroup half4x4 数组改为 POD threadgroup half 数组,并转换为 threadgroup half4x4 * 进行矩阵索引。该版本支持 macOS Apple Silicon (arm64)、Linux Ubuntu x64 (CPU)、Android arm64 (CPU)、Windows x64 (CPU) 等多种平台。
最近进展 2026年8月6日 · llama.cppb10295
llama.cpp 发布 b10295 版本,修复了量化张量重塑后的 strides 问题(#26672)。该版本支持 macOS(Apple Silicon arm64,含 KleidiAI 启用/禁用)、iOS XCFramework、Linux(多种 CPU/GPU 后端)、Android、Windows(多种后端)、openEuler 等平台,并包含 UI 组件。
最近进展 2026年8月6日 · Semantic Kerneldotnet-1.79.0
Semantic Kernel 发布 dotnet-1.79.0 版本,包含多项更新:将 .NET SDK 从 10.0.301 升级到 10.0.302;更新 Microsoft.AspNetCore.OData 至 9.5.0;修复 CosmosDB 向量存储 bug;将 VectorStoreRAG 和 Concepts 示例迁移到 CommunityToolkit.VectorData 包;为 TimePlugin 添加 TimeProvider 注入以实现确定性测试;拒绝混合分隔符的 UNC 路径;升级 Prompty.Core 至 2.0.0-beta.3 以解决 NU1903 漏洞;修复 Ollama 的 Think 属性等。
最近进展 2026年8月6日 · Semantic Kernelpython-1.44.1
2026-08-06,Semantic Kernel 发布 python-1.44.1 版本,包含多项变更:编码 OpenAPI 服务器变量值、整合 Dependabot 依赖更新、抑制内部 HTTP 工具中的 CodeQL 误报、为 Azure AI Agent 添加 MCP 工具审批回调(破坏性变更)、整合 Python 和 .NET 依赖更新、跳过规范化名称冲突的 MCP 工具和提示、更新 ProcessFrameworkWithSignalR React 前端的 form-data 依赖、在 Copilot Studio agent 中记录 x5t 证书指纹哈希、将 Python 版本提升至 1.44.1。
最近进展 2026年8月6日 · llama.cppb10293
llama.cpp 发布 b10293 版本,包含针对 AMD ROCm 的 CI 修复,支持 gfx1151(Strix Halo)集成 GPU,并修复了调试断言问题。
最近进展 2026年8月6日 · llama.cppb10291
llama.cpp 发布 b10291 版本,修复 Vulkan 提交批处理大小问题,添加调试工具以诊断 DeviceLost 驱动错误,并修复提交阈值应用过晚的问题。该版本支持多种平台和硬件后端,包括 macOS、Linux、Windows、Android 等。
最近进展 2026年8月5日 · CloudflareThe Agent Access Model
Cloudflare 于 2026-08-05 发布博客文章《The Agent Access Model》,提出一种用于保护任务级 Agent 的新架构,核心包括严格身份代理、持续中介和状态化信任。
最近进展 2026年8月5日 · CloudflareCatching rogue AI behavior with identity-aware analytics
Cloudflare 宣布其 Identity-aware AI Gateway 进入公开测试阶段,并推出 User Insights 功能,该功能将流量转化为每个用户和代理的行为基线,并在出现内部风险时发出警报。
最近进展 2026年8月5日 · llama.cppb10278
llama.cpp 发布 b10278 版本,从所有构建脚本中移除 GGML_METAL_USE_BF16 宏。该版本提供 macOS、iOS、Linux、Android、Windows 和 openEuler 等多个平台的构建选项,其中 macOS Intel 和 openEuler 相关构建被标记为 DISABLED。
最近进展 2026年8月4日 · CloudflareAnnouncing Cloudflare Wallets: The programmable wallet for the agentic Internet
Cloudflare 于 2026-08-04 发布 Cloudflare Wallets,为 AI 代理提供原生支付和可验证身份,基于 x402 协议,使代理能在安全护栏内自主购买 API 和内容。
最近进展 2026年8月4日 · Cloudflare CodexHow Cloudflare enforces engineering standards using AI
Cloudflare 创建了 Cloudflare Codex,一个受治理的工程标准主体,AI agent 在开发生命周期中消费该标准。通过将结构化 RFC 与 agentic 审查配对,团队在代码、规范和事故报告中自动执行一致性。
最近进展 2026年8月4日 · AstroHow we built a software factory to drive Astro’s GitHub issue count to zero
Astro maintainers replaced manual issue verification with isolated AI subagents running in GitHub Actions, reducing open issue count by 85%. The post explores architecture for automated bug reproduction, patch verification, and preview releases.
最近进展 2026年8月4日 · CloudflareIntroducing: Cloudflare Agents
Cloudflare 于 2026 年 8 月 4 日发布 Cloudflare Agents,将已部署的 agent 会话整合到单一体验中,展示 agent 规模化运行的关键信息和洞察。
最近进展 2026年8月4日 · CloudflareRun CI/CD for millions of repos — on your platform, on Cloudflare
Cloudflare 发布了一篇博客文章,介绍如何在 Cloudflare 上使用 Workflows、Artifacts 和 CI SDK 构建可定制的、沙盒化的 CI/CD 流水线,用 TypeScript 工作流步骤和自愈 AI 代理替代复杂的 YAML 配置。
最近进展 2026年8月4日 · CloudflareThe Agent Development Lifecycle has arrived on Cloudflare
Cloudflare 于 2026-08-04 发布了 Agent Development Lifecycle,并介绍了支撑该生命周期的 Cloudflare 基础组件。
最近进展 2026年8月4日 · GoogleThe latest AI news we announced in July 2026
Google 于 2026 年 7 月发布了一系列 AI 更新,具体内容在博客文章中宣布。
最近进展 2026年8月4日 · llama.cppb10259
llama.cpp 发布 b10259 版本,新增在加载期间重塑张量的功能(PR #26531)。该版本提供 macOS、iOS、Linux、Android、Windows、openEuler 等平台的多种构建选项,包括 CPU、Vulkan、ROCm、OpenVINO、SYCL、CUDA、HIP、OpenCL 等后端,并支持 Apple Silicon、Intel、ARM 等架构。部分平台(如 macOS Intel、openEuler 某些配置)被标记为 DISABLED。
最近进展 2026年8月3日 · CloudflareSmaller, faster, safer: running Kimi and GLM at scale
Cloudflare 发布了一篇博客,介绍其如何通过量化 KV 缓存、压缩模型权重和添加完整性检查,来更快速、更便宜、更安全地服务 Kimi 和 GLM 等前沿模型,以应对 GPU 内存压力。
最近进展 2026年8月3日 · MS-SWIFTv4.4.3: bump transformers and peft (#9837)
MS-SWIFT 发布了 v4.4.3 版本,该版本更新了 transformers 和 peft 依赖。
最近进展 2026年8月3日 · llama.cppb10237
llama.cpp 发布 b10237 版本,为 DeepSeek V3.2 添加 MTP(Multi-Token Prediction)支持,并在模型类型发现过程中无需包含 MTP 层。该版本提供多种平台构建,包括 macOS、iOS、Linux、Android、Windows 和 openEuler。
最近进展 2026年8月2日 · llama.cppb10227
llama.cpp 发布 b10227 版本,新增 Qwen3 专用解析器,支持 tagged thinking tool parser,并重构添加 permute helper,支持 omission,更新工具分隔符,添加 qwen3-coder 注释,修复触发模式。
最近进展 2026年8月2日 · llama.cppb10225
llama.cpp 发布 b10225 版本,新增仅在需要时加载 MiMo V2 MTP 张量的功能,并更新了各平台的构建支持列表。
最近进展 2026年8月2日 · llama.cppb10226
llama.cpp 发布 b10226 版本,修复了 iGPU 的分类问题(#26105)。该版本支持多种平台和硬件后端,包括 macOS Apple Silicon(含 KleidiAI 启用)、macOS Intel(禁用)、iOS XCFramework、Linux(CPU、Vulkan、ROCm 7.2、OpenVINO、SYCL FP32/FP16)、Android(CPU、OpenCL Adreno)、Windows(CPU、CUDA 12.4/13.3、Vulkan、OpenVINO、SYCL、HIP)、openEuler(禁用,部分支持 310p 和 910b ACL Graph)。
最近进展 2026年8月1日 · RAGFlowdev-20260801: Go: fix list services (#17664)
RAGFlow 发布 dev-20260801 版本,包含修复 admin list services 和 admin show service 'service_name' 的变更,由 Jin Hai 提交。
最近进展 2026年8月1日 · llama.cppb10217
llama.cpp 发布 b10217 版本,支持在 DS4 的思考过程中启用工具调用(#26269)。该版本提供多种平台构建,包括 macOS(Apple Silicon arm64、KleidiAI 启用)、Linux(CPU、Vulkan、ROCm 7.2、OpenVINO、SYCL)、Android(arm64 CPU)、Windows(CPU、CUDA 12/13、Vulkan、OpenVINO、SYCL、HIP)以及 openEuler(部分禁用)。
近 7 天 · 最近进展 2026年8月22日 · llama.cppb10573
llama.cpp 发布 b10573 版本,通过 ffmpeg 支持 WebP 图像格式。该版本提供 macOS、Linux、Android、Windows 及 openEuler 等多平台的构建产物,涵盖 CPU、Vulkan、ROCm、CUDA、OpenVINO、SYCL 等后端。
近 7 天 · 最近进展 2026年8月22日 · llama.cppb10569
llama.cpp 发布 b10569 版本,新增 dots3-note 模型支持(PR #27060),包含文本转换初始化实现、地址审查评论修复、rope 移动至新的 llama_kv_cache_dsa_iswa,并提供 macOS、Linux、Android、Windows、openEuler 等多平台构建产物。
近 7 天 · 最近进展 2026年8月21日 · Clinev4.1.11
Cline 发布 v4.1.11 版本,新增支持模型在任务中生成图像,生成的图像内联渲染在对话中;修复 VS Code 1.134 上代码操作报错、@ 文件提及路径含空格失败、CRLF 行尾多行编辑 diff 视图等问题;恢复任务时保留存活会话而非重建;清除任务作用域设置覆盖;迁移旧任务时保留经典截断范围;保留 LiteLLM 输入 token 限制;恢复 Gemini 自定义基础 URL 并规范化旧主机根值;提供商注册链接指向各自 API 密钥页面;通过 skills 工具加载技能斜杠命令。
近 7 天 · 最近进展 2026年8月20日 · llama.cppb10524
llama.cpp 发布 b10524 版本,该版本使 MoE expert scatter 操作具有确定性(#26464)。
近 7 天 · 最近进展 2026年8月20日 · llama.cppb10507
llama.cpp 发布 b10507 版本,新增 mtmd_bitmap_set_mergeable 功能(PR #27348),并更新了各平台构建支持列表。
近 7 天 · 最近进展 2026年8月20日 · llama.cppb10506
llama.cpp 发布 b10506 版本,新增 Metal 后端对 q8_0 量化使用 packed types 进行反量化(dequantize)的功能。该版本支持 macOS Apple Silicon(arm64)、iOS、Linux、Android、Windows 等多种平台,并提供了多种后端(如 Vulkan、ROCm、OpenVINO、SYCL、CUDA、OpenCL 等)的构建选项。部分平台或后端被标记为 DISABLED,例如 macOS Intel、Ubuntu x64 (ROCm 7.14)、openEuler 等。
最近进展 2026年8月17日 · llama.cppb10455
llama.cpp 发布 b10455 版本,新增 SYCL 后端对 OPT_STEP_ADAMW 和 OPT_STEP_SGD 算子的支持,并更新了 ops.md 文档。该版本同时提供了覆盖 macOS、Linux、Windows、Android、openEuler 等多个平台的构建选项,其中部分平台(如 macOS Intel、Ubuntu x64 ROCm 7.14、openEuler 系列)标记为 DISABLED。
最近进展 2026年8月15日 · llama.cppb10437
llama.cpp 发布 b10437 版本,新增对 MiniMaxText01ForCausalLM 和 MiniMaxM1ForCausalLM 的支持,并针对 MiniMax-Text-01 模型进行了多项优化,包括添加 logits mask、使用 hparams.is_recr() 替换硬编码条件、使用 build_rs() 管理循环状态、移除状态转置操作、优化 decay 张量计算等。同时,为 MiniMax-M1 添加了 jinja 模板,并进行了相关测试修复和代码清理。
最近进展 2026年8月15日 · llama.cppb10436
llama.cpp 发布 b10436 版本,包含 mtmd、common 的多种修复,并应用了 gguf 修复。该版本提供多种平台构建,包括 macOS、iOS、Linux、Android、Windows 等,部分平台如 macOS Intel、ROCm 7.14 等被禁用。
最近进展 2026年8月13日 · RAGFlowdev-20260813
RAGFlow 发布了 dev-20260813 版本,该版本修复了允许共享同一基础嵌入模型的数据集被同时搜索的问题。
最近进展 2026年8月12日 · llama.cppb10369
llama.cpp 的 b10369 版本为 pocket-tts 添加了支持,将转置卷积实现为 GEMM + col2im,以解决深度可分离上采样导致的图节点过多和内核启动开销问题。CUDA 上每帧生成时间下降 80%,CPU 上下降 50%,输出与先前实现逐样本匹配,相关性为 0.999994,帧数相同。
最近进展 2026年8月11日 · llama.cppb10357
llama.cpp 发布 b10357 版本,包含一个针对 Flash Attention prefill kernel 的 OpenCL 优化:在本地内存中转置 K tile。该版本同时列出了 macOS、iOS、Linux、Android、Windows 和 openEuler 等多个平台的构建支持情况。
最近进展 2026年8月8日 · Claude Codev2.1.225
Claude Code 发布 v2.1.225 版本,新增网关支出限制支持,改进工作区信任提示,修复多个问题,包括 OAuth 令牌、MCP OAuth 服务器、自动模式计数、跨会话消息、远程控制会话恢复、代理列表悬停和自托管运行器注册等。
近 7 天 · 最近进展 2026年8月23日 · Clinev4.1.15
Cline 发布 v4.1.15 版本,修复了 MCP 工具调用中 Auto-approve 功能的问题。此前,当 "Use MCP servers" 开关开启时,该功能仅对单独选择加入的工具生效,导致开关看似无效;现在该开关独立控制所有 MCP 工具。
近 7 天 · 最近进展 2026年8月23日 · llama.cppb10603
llama.cpp 发布 b10603 版本,支持 GLM-4.5-Air 模型中的 MTP(Multi-Token Prediction)功能。该版本提供多种平台构建,包括 macOS、Linux、Windows、Android 等,并支持多种后端如 Vulkan、CUDA、ROCm、OpenVINO、SYCL 等。
近 7 天 · 最近进展 2026年8月23日 · llama.cppb10598
llama.cpp 发布 b10598 版本,使用 pillow-accurate 算法并修正所有模型的 resize_algo,以进行速度优化。该版本提供多种平台构建,包括 macOS、iOS、Linux、Android、Windows 和 openEuler,并支持多种后端(如 Vulkan、ROCm、OpenVINO、SYCL、CUDA、OpenCL)。
最近进展 2026年8月15日 · Kimi-K3b10448
llama.cpp 发布 b10448 版本,新增 Kimi-K3 文本模型支持。该模型采用混合 KDA(线性)+ MLA(完整)注意力,架构与 Kimi-Linear-48B 类似,但额外包含跨层残差注意力、潜在 MoE、situ 激活、MLA 输出门和全秩 KDA 门。K3 的 text_config 报告为 KimiLinearForCausalLM,因此路由基于顶层名称。KDA 衰减门有两种形式,由 gate_lower_bound 选择,K3 设置为 -5.0。跨层残差使用 ggml_dsv4_hc_pre,仅支持 CPU 和 CUDA。路由专家以 mxfp4-pack-quantized 压缩张量形式提供,与 ggml 的 MXFP4 位兼容。
最近进展 2026年8月15日 · llama.cppb10447
llama.cpp 发布 b10447 版本,重新设计 yield_to_queue 线程模型(#27133),在 worker 中运行 common_speculative_process,并交换 worker 主线程设计。该版本提供 macOS、iOS、Linux、Android、Windows 及 openEuler 等多平台构建,部分平台(如 macOS Intel、ROCm、openEuler 部分配置)被标记为 DISABLED。
最近进展 2026年8月15日 · llama.cppb10446
llama.cpp 发布 b10446 版本,更新 BoringSSL 至 0.20260813.0,并提供多平台构建选项,包括 macOS、Linux、Android、Windows 等,部分平台如 macOS Intel、Ubuntu ROCm、openEuler 等被禁用。
最近进展 2026年8月14日 · llama.cppb10438: mtmd: fix Granite4 Vision image sequence assembly (#26653)
llama.cpp 发布 b10438 版本,包含对 Granite4 Vision 图像序列组装(image sequence assembly)的修复,具体涉及 grid assembly、scaled image height/width 的截断处理,并移除了 MTMD_DUMP_EMBD 调试脚手架。提交由 Hemanth Battu 和 Xuan Son Nguyen 共同完成。
最近进展 2026年8月14日 · Anthropicv2.1.233
Anthropic 发布了 Claude Code 的 v2.1.233 版本,新增了 GitLab 合并请求 URL 支持、可选的 forward_user_identity 网关设置、Linux 上 Bash 工具命令的可选内存 cgroup 支持,以及 CLAUDE_CODE_WEBFETCH_CACHE_TTL_MS 环境变量。修复了云会话丢失、MCP v2 连接重开、通知钩子未触发、Linux 空闲会话 CPU 占用 100% 以及捆绑技能别名报错等问题。
最近进展 2026年8月8日 · llama.cppb10330
llama.cpp 发布 b10330 版本,新增 CUDA 内核融合 rms_norm、mul、rope 及 view、set_rows 操作,并添加广播权重测试用例,同时检查内存范围。该版本支持多种平台,包括 macOS Apple Silicon、Linux(CPU、Vulkan、ROCm、OpenVINO、SYCL)、Android、Windows(CPU、CUDA、Vulkan、OpenVINO、SYCL、HIP)等。
最近进展 2026年8月7日 · GitHub CopilotGitHub Copilot weekly releases — August 3
GitHub 于 2026 年 8 月 7 日发布博客文章,介绍 GitHub Copilot 在桌面应用、CLI 和 VS Code 中的每周更新,功能包括恢复和组织工作、审查更改以及在不丢失上下文的情况下提问。
最近进展 2026年8月16日 · llama.cppb10454: ci : fix dry-run reporting in make-release job [no ci] (#27167)
llama.cpp 的 b10454 提交修复了 make-release CI 任务中 --dry-run 模式下的报告问题。此前,即使某些步骤失败,该模式也会错误地报告所有检查通过。此提交引用了 issue #26839 的评论。
最近进展 2026年8月8日 · llama.cppb10329
llama.cpp 发布 b10329 版本,调整了工作目录(working directory)的显示逻辑:只有当一个工具声明其路径解析并针对工作目录运行时,WebUI 才会显示工作目录芯片并启用 /cwd 命令。此前只要服务器暴露任何内置工具(如 get_datetime),或用户关闭所有文件系统工具,工作目录芯片仍会显示。工具现在在 /tools 列表中发布其是否解析路径并针对工作目录运行的信息,与已有的写权限声明并列。该版本同时提供了 macOS、iOS、Linux、Android、Windows 等多平台的构建产物。
Grok 4.5 发布:xAI 将代码、Agent 与 Office 工作合并为旗舰模型
xAI 于 2026 年 7 月发布 Grok 4.5,并通过 API、Grok Build、Cursor 与 Office 插件提供使用。
最近进展 2026年7月9日 · Microsoft / OpenAIGPT-5.6 进入 Microsoft 365 Copilot:Agent 获得企业级分发
GPT-5.6 成为 Microsoft 365 Copilot 的首选模型,覆盖 Word、Excel、PowerPoint、Chat 和 Cowork。
最近进展 2026年7月29日 · OpenAIGPT-5.6 发布:OpenAI 把模型升级推向长期自主 Agent
OpenAI 发布 GPT-5.6,并同步推出面向跨应用、文件与长期任务的 ChatGPT Work。
最近进展 2026年7月8日 · OpenAIGPT-Live 推进全双工语音:Agent 的交互带宽继续上升
OpenAI 发布新一代语音模型 GPT-Live,并接入 ChatGPT Voice。
当月论文组 · 2026年7月本月精选 1 篇高质量研究Global Workspace · J-space · 可解释性 · 隐式推理 · 因果干预
展开全部论文
Global Workspace · J-space · 可解释性 · 隐式推理 · 因果干预
LingBot-VLA 2.0 开源:国产具身模型进入跨本体规模化阶段
蚂蚁集团 Robbyant 发布 LingBot-VLA 2.0 技术报告、预训练权重与代码;官方披露训练数据覆盖 20 种机器人配置和约 6 万小时机器人/第一视角视频。
最近进展 2026年7月25日 · Anthropicv2.1.220
Anthropic 发布了 Claude Code v2.1.220,更新内容为 Bug 修复和可靠性改进。
最近进展 2026年7月28日 · CrewAI1.15.6
CrewAI 发布 v1.15.6 版本,修复了 Anthropic preview tool-use 块检测、strict tool schema 属性名保留、crew 和 flow 执行失败时 execution_end 钩子分发、load_agent_from_repository 中 async get_agent 处理以及依赖解析问题。
最近进展 2026年7月28日 · Weaviatev1.38.7 - Never use a search result as a read-repair payload
Weaviate 发布了 v1.38.7 和 v1.37.14 版本,包含多项修复和性能改进。
最近进展 2026年7月26日 · Vercel@ai-sdk/anthropic-aws@2.0.13
Vercel AI SDK 发布了 @ai-sdk/anthropic-aws@2.0.13 补丁版本,依赖更新为 @ai-sdk/anthropic@4.0.21,后者修复了将思考令牌报告为推理令牌使用的问题。
最近进展 2026年7月26日 · Vercel@ai-sdk/amazon-bedrock@5.0.32
Vercel AI SDK 发布了 @ai-sdk/amazon-bedrock@5.0.32 和 @ai-sdk/amazon-bedrock@4.0.142 两个补丁版本,修复了在 Bedrock 上使用 Claude 模型时,omit tool strict 和 output_config.format 参数被拒绝的问题。
最近进展 2026年7月14日 · OpenAIHow data science teams use ChatGPT Work
OpenAI 于 2026-07-14 发布了两篇教程,分别面向数据科学团队和销售团队,展示如何使用 ChatGPT Work 从实际工作输入构建根因简报、影响报告、KPI 备忘录、范围分析和仪表盘规范(数据科学),以及管道简报、会议准备包、预测回顾、账户计划和停滞交易诊断(销售)。
最近进展 2026年7月27日 · Langfusev4.0.0-rc.2
Langfuse 发布了 v4.0.0-rc.2 预发布版本,包含 Agent 后台执行、异步虚拟化 JSON 渲染器、Salesforce 同步回填、移动端布局优化等功能,并删除了已废弃的 Postgres 和 ClickHouse 表。
最近进展 2026年7月31日 · Vercel@ai-sdk/xai@4.0.20
@ai-sdk/xai@4.0.20 版本发布,依赖更新包括 @ai-sdk/provider-utils@5.0.14 和 @ai-sdk/openai-compatible@3.0.16。
最近进展 2026年7月31日 · Vercel@ai-sdk/workflow-harness@1.0.46
Vercel 发布了 @ai-sdk/workflow-harness@1.0.46 和 @ai-sdk/workflow@1.0.39、1.0.40 补丁版本。@ai-sdk/workflow@1.0.39 新增了动态工具描述、流式指令和 prepareStep 输入支持,并重构了 prepareStep 覆盖。
最近进展 2026年7月25日 · OpenAI Codex0.146.0-alpha.2
OpenAI Codex 发布了两个 alpha 版本:0.146.0-alpha.1(2026-07-22T05:04:48Z)和 0.146.0-alpha.2(2026-07-22T07:25:46Z)。
最近进展 2026年7月25日 · SGLangv0.5.16
SGLang v0.5.16 发布,包含 574 个 PR,来自 169 位贡献者。新特性包括:DSpark 置信度驱动推测解码算法,在 DeepSeek-V4-Pro 上达到 383.7 tok/s(TP8 B300, bs=1);Inkling 多模态 MoE 模型支持(975B 参数,1M 上下文),在 Blackwell 上达到 71.7k tok/s 输入和 171.0 tok/s 每用户解码;新增 LongCat 2.0 FP8、JetBrains Mellum v2、Pi0.5 等模型;UnifiedRadixTree 成为 SWA、Mamba 和 DSA 模型的默认实现。
最近进展 2026年7月31日 · OpenAIAdvancing responsible AI across Europe
OpenAI 于 2026 年 7 月 31 日发布文章,阐述其在安全、安保、透明度和来源方面的实践,以支持欧洲负责任的人工智能治理,并承诺随着欧盟人工智能法案的推进继续相关工作。
最近进展 2026年7月31日 · llama.cppb10204
llama.cpp 发布 b10204 版本,新增 SYCL 支持通过 DEV2DEV_MEMCPY_FORWARD 实现 dev2dev memcpy,由 Neo Zhang Jianyu 贡献。该版本提供多种平台构建选项,包括 macOS(Apple Silicon、Intel)、iOS、Linux(CPU、Vulkan、ROCm、OpenVINO、SYCL)、Android、Windows(CPU、CUDA、Vulkan、OpenVINO、SYCL、HIP)及 openEuler(部分禁用)。
最近进展 2026年7月31日 · llama.cppb10202
llama.cpp 发布 b10202 版本,包含 SYCL 后端对 RMS_NORM 和 MUL 的融合优化(PR #26015)。该版本支持多种平台和硬件后端,包括 macOS、iOS、Linux、Android、Windows 和 openEuler,并支持 CPU、Vulkan、ROCm、OpenVINO、SYCL、CUDA、HIP、OpenCL 等。
最近进展 2026年7月31日 · llama.cppb10201
llama.cpp 发布 b10201 版本,改进 flash_attn_vec 以支持长上下文下的量化 KV cache,修复若干 bug 和注释,并解决 rebasing 导致的构建错误。该版本提供 macOS、iOS、Linux、Android、Windows 及 openEuler 等多平台构建,涵盖 CPU、Vulkan、ROCm、OpenVINO、SYCL、CUDA、OpenCL 等后端。
最近进展 2026年7月31日 · RAGFlowdev-20260731-2
RAGFlow 发布 dev-20260731-2 版本,修复了 wiki 的 claim card 不显示标题的问题(issue #17626)。
最近进展 2026年7月31日 · UnivéUnivé builds an AI-ready workforce
Univé 使用 ChatGPT Enterprise 构建了一支具备 AI 能力的工作团队,其方法结合了领导力、负责任的治理和员工主导的创新,以在规模上改变工作方式。
最近进展 2026年7月30日 · Weaviatev1.38.8 - Batch flat ContainsAny/ContainsAll/ContainsNone
Weaviate 发布了 v1.38.8 版本,包含多项修复和功能改进,如移除对旧备份格式的支持、修复 KagomeJa 自定义词典节流问题、通过 Index.withShardOrRemote 路由分片访问、按租户大小惰性分配向量缓存内存、修复复制中的加载分片就绪检查、为模块基础客户端添加重试、修复队列中的数据竞争、在命名空间集群上返回 API 密钥的首字母、在 BM25 搜索中支持跨属性 AND 匹配、添加 AnalyzeBatch 并优化 roaringset 读取路径、固定无限向量搜索测试中的 nearObject 锚点、更新依赖以修复 CVE-2026-46600 和 CVE-2026-56852 等。
最近进展 2026年7月30日 · llama.cppb10186
llama.cpp 发布 b10186 版本,修复了 KleidiAI CI 和 stringop overflow 警告问题。该版本支持 macOS(Apple Silicon arm64,含 KleidiAI 启用/禁用选项、Intel x64)、iOS、Linux(Ubuntu x64 CPU、arm64 CPU、s390x CPU、Vulkan、ROCm 7.2、OpenVINO、SYCL FP32/FP16)、Android(arm64 CPU)、Windows(x64 CPU、arm64 CPU、arm64 OpenCL Adreno、x64 CUDA 12/13、Vulkan、OpenVINO、SYCL、HIP)、openEuler(x86 310p、x86 910b ACL Graph、aarch64 310p、aarch64 910b ACL Graph)以及 UI。
最近进展 2026年7月29日 · Clinenightly-main-20260729125433-912c46781808
Cline 发布了 nightly-main-20260729125433-912c46781808 版本,该版本是从 main 分支在 commit 912c467 发布的,包含 A/B 测试的合并内容。
最近进展 2026年7月29日 · Weaviatev1.39.0-rc.1 - Namespaces, Alter Schema, gRPC web, Search REST API
Weaviate 发布了 v1.39.0-rc.1 预发布版本,包含 Namespaces (GA)、Alter Schema - Reindex property (GA)、Alter Schema - Drop vector index (Preview)、gRPC web (GA) 和 Search REST API (GA) 功能。
最近进展 2026年7月29日 · llama.cppb10175
llama.cpp 发布 b10175 版本,新增对 AMD RDNA 3.5 和 RDNA 3 的独立调优支持,并更新了多个平台的构建配置。
最近进展 2026年7月28日 · Clinenightly-main-20260728125218-dc175c73a8dd
Cline 发布了 nightly-main-20260728125218-dc175c73a8dd 版本,该版本是 combined A/B 版本,从 main 分支的 dc175c7 提交发布。
最近进展 2026年7月27日 · llama.cppb10150
llama.cpp 发布 b10150 版本,包含 ggml 调整 offloading ops 到 weight 后端逻辑、llama dsv4 图修复,并提供多平台构建(macOS、Linux、Windows、Android、openEuler)及 UI。
最近进展 2026年7月27日 · Open WebUIv0.11.0
Open WebUI 发布 v0.11.0 版本,主要更新包括:重新设计的界面、子代理功能(允许模型将任务部分委托给后台辅助代理)、文件夹页面(支持分页加载和排序)、以及多项其他改进。
最近进展 2026年7月24日 · Clinenightly-main-20260724124508-98024c4243ab
Cline 发布了 nightly-main-20260724124508-98024c4243ab 版本,该版本为 combined A/B 版本,基于 main 分支,提交哈希为 98024c4。
最近进展 2026年7月24日 · llama.cppb10105
llama.cpp 发布 b10105 版本,由 Aaron Teo 提交,重构了 mlock/mmap/directio 为 load-mode 参数,并更新了文档和基准测试。
最近进展 2026年7月23日 · Clinenightly-main-20260723124723-ae033761ab1e
Cline 发布了 nightly-main-20260723124723-ae033761ab1e 版本,该版本为 combined A/B 构建,于 2026-07-23T12:47:23.000Z 从 main 分支发布。
最近进展 2026年7月23日 · Weaviatev1.39.0-rc.0 - Namespaces, Alter Schema, gRPC web, Search REST API
Weaviate 发布了 v1.39.0-rc.0 预发布版本,包含 Namespaces (GA)、Alter Schema - Reindex property (GA)、Alter Schema - Drop vector index (GA)、gRPC web (GA) 和 Search REST API (GA) 功能。
最近进展 2026年7月22日 · llama.cppb10087
llama.cpp 发布 b10087 版本,新增对 Laguna XS.2 M.1 的支持,并提供 macOS、Linux、Windows、Android、iOS 等多平台构建选项。
最近进展 2026年7月22日 · llama.cppb10085
llama.cpp 发布 b10085 版本,修复 Qwen3-VL 视觉位置嵌入插值中 align_corners 参数不匹配问题,该问题导致非正方形图像的接地坐标缩放偏移。
最近进展 2026年7月22日 · llama.cppb10084
llama.cpp 发布 b10084 版本,包含对复用描述符时检查张量类型的修复,支持多种平台和硬件后端。
最近进展 2026年7月22日 · llama.cppb10082
llama.cpp 发布 b10082 版本,新增 KleidiAI 内核权重类型警告功能。
最近进展 2026年7月16日 · Google DeepMindOur approach to bioresilience
Google DeepMind and Isomorphic Labs published a blog post titled 'Our approach to bioresilience' on July 16, 2026, sharing their joint approach to bioresilience and AI models.
最近进展 2026年7月30日 · llama.cppb10184
llama.cpp 发布 b10184 版本,支持 macOS、iOS、Linux、Android、Windows 等多平台,包括 Apple Silicon、CUDA、Vulkan、ROCm 等后端。
最近进展 2026年7月25日 · MicrosoftONNX Runtime v1.28.0
ONNX Runtime v1.28.0 发布,升级 ONNX 1.22.0 和 protobuf 6.33.5,cuDNN 和 cuFFT 在 CUDA EP 中变为运行时可选,引入实验性 C/C++ API,移除 TensorRT fused causal attention kernels 等。
最近进展 2026年7月24日 · llama.cppb10108
llama.cpp 发布 b10108 版本,改进了核心组件(L2、DMA、MM、FA)的流水线。
最近进展 2026年7月23日 · llama.cppb10092
llama.cpp 发布 b10092 版本,启用 AIX 上的 PowerPC 后端变体,修复 PowerPC Q0 matmul 实现中缺失的分号。
最近进展 2026年7月31日 · llama.cppb10216
llama.cpp 的 b10216 版本为 Vulkan 后端添加了 GGML_OP_POOL_1D 支持,包括新增 pool1d 计算着色器、push constants 结构体、pipeline 字段,并修复了池化结束边界为负时的崩溃问题,同时扩展了测试覆盖。该版本还列出了多种平台的构建选项,包括 macOS、Linux、Android、Windows 等。
最近进展 2026年7月31日 · llama.cppb10215
llama.cpp 发布 b10215 版本,为 Windows Intel GPU 引入驱动版本检查以缓解崩溃问题,移除针对已修复驱动的崩溃防护,并调整函数体位置。该版本提供 macOS、Linux、Windows、Android、openEuler 等平台的多种构建选项,包括 CPU、Vulkan、ROCm、OpenVINO、SYCL、CUDA、HIP、OpenCL 等后端。
最近进展 2026年7月31日 · llama.cppb10214
llama.cpp 发布 b10214 版本,新增 n_embd_head 参数(PR #26342),由 Daniel Han 共同编写。该版本提供 macOS(Apple Silicon arm64,含 KleidiAI 启用/禁用)、iOS XCFramework、Linux(Ubuntu x64/arm64/s390x CPU、Vulkan、ROCm 7.2、OpenVINO、SYCL FP32/FP16)、Android(arm64 CPU)、Windows(x64 CPU、arm64 CPU、OpenCL Adreno、CUDA 12.4/13.3、Vulkan、OpenVINO、SYCL、HIP)以及 openEuler(x86 310p、x86 910b ACL Graph、aarch64 310p、aarch64 910b ACL Graph)等平台的构建选项,并包含 UI 组件。
最近进展 2026年7月31日 · llama.cppb10213
llama.cpp 发布 b10213 版本,支持 rotated KV cache 量化(#26180),并提供 macOS、Linux、Android、Windows、openEuler 等多平台构建。
最近进展 2026年7月24日 · llama.cppb10121: ui: reduce per-token render cost when streaming (#26053)
llama.cpp 发布 b10121 版本,通过 UI 优化将流式输出时每个 token 的渲染时间从 210.36ms 降至 2.67ms(40 条消息场景下从 22.02ms 降至 3.33ms)。
最近进展 2026年7月24日 · Clinev4.0.11
Cline v4.0.11 发布,新增对 Anthropic Claude Opus 5(含 1M 上下文窗口变体)的支持,覆盖 Anthropic、Claude Code、Bedrock、Vertex、Cline 和 OpenRouter 提供商;新增 Moonshot Kimi K3 支持;修复 Claude Opus 1M 上下文变体在超过 200k token 请求时的定价错误;为 Kimi K3 模型启用原生工具调用,修复空响应问题。
最近进展 2026年7月23日 · DeepSpeedv0.19.3 Patch Release
DeepSpeed 发布了 v0.19.3 补丁版本,包含多项修复和功能更新,如验证 fp16 动态损失缩放参数为正、修复 ZeRO-3 中输出缓冲区的数据类型问题、修复文件描述符泄漏、默认梯度裁剪为 1.0、支持 AutoEP 与 ZeRO-3 zero.Init 源模块等。
最近进展 2026年7月23日 · Hugging FaceBringing Nunchaku 4-bit Diffusion Inference to Diffusers
Hugging Face 于 2026 年 7 月 23 日发布博客,宣布将 Nunchaku 4-bit 扩散推理集成到 Diffusers 库中。
最近进展 2026年7月13日 · GoogleEmpowering India’s next generation of innovators with ATL Saathi
Google and AIM launched ATL Saathi, a Gemini-powered AI tool for Indian educators in robotics labs.
最近进展 2026年7月11日 · OpenAI彭博社揭秘苹果起诉 OpenAI 内幕:前员工一句“哈哈”成窃密关键
IT之家 7 月 12 日消息,据彭博社昨天报道,当 iPhone 工程师 Chang Liu 离开苹果,加入 OpenAI 硬件部门时,他带走的不只是多年以来累计的工作经验。 根据苹果昨天提起的诉讼,Chang Liu 离职时带走了三样东西:一台始终未归还的 MacBook 工作机、一名可以持续分享内情的苹果员工,以及一项软件漏洞,让他可以在离开苹果后继续访问公司内网服务器。 Chang Liu 发现漏洞后, 与他的同事 Alyssa Peng 分享道:“哈哈(LOL),我发现我还能访问网络存储,太搞笑了” 。而 Alyssa Peng 则是回复道:“我准备好了”,并利用自己的电脑帮助 Chang Liu 获取更多机密信息。 本次诉讼发生以前,苹果与 OpenAI 的关系就趋于紧张。两家公司本来是合作伙伴,如今却希望捷足先登 AI 硬件市场而成为竞争对手,意图重新定义消费者如何使用电子产品。 据悉,双方矛盾的核心人物是前苹果高管 Tang Tan。该人曾负责设计 iPhone、Apple Watch 等多款产品,并在 2023 年底告知管理层即将离职,后来成为 OpenAI 首席硬件官。 IT之家从原报道获悉,苹果甚至破天荒地允许他继续工作至 2024 年 2 月,好完成硬件部门的交接、对齐工作。然而在幕后,Tang Tan 已经密会前苹果首席设计官乔纳森 · 艾维及 OpenAI CEO 萨姆 · 奥尔特曼,希望打造一款全新的 AI 设备,未来有望挑战 iPhone。 目前已有超 400 名员工从苹果跳槽至 OpenAI。这种大规模挖角很快引来了苹果警觉,因为 OpenAI 不仅挖走了多位硬件和设计部门高级主管,还重创了苹果多个工程团队。 这种情况持续到了今年 6 月,当 OpenAI 挖走苹果智能眼镜负责人保罗 · 米德后,苹果要求其立即离职,并没有像 Tang Tan 那样给出交接时间。 苹果认为,OpenAI 正试图复制 iPhone 的整套产品研发体系,并在诉状中表示:“OpenAI 尚处于起步阶段的硬件业务,如今建立在极其脆弱的根基之上,其核心已经从非法窃取而来的商业机密腐烂”。 据一位与 Tang Tan 共事的不具名人士透露, 他在苹果 25 年的职业生涯一直以大胆著称 , 甚至可以说是“飞得离太阳非常近” 。 Tang Tan 因主导 Mac 笔记本和 iPod 设计而成名,随后负责初代 iPhone 的产品设计。2011 年起,他全面接管 iPhone 设计团队,之后又负责 Apple Watch 设计工作。离开苹果时,他已经跻身公司最高管理层。 与此同时,OpenAI 已经向硬件业务砸了数十亿美元,并朝着 IPO 迈进。不过根据知情人士透露,OpenAI 收购乔纳森旗下 io Products 时,并没有真正成熟的产品。虽然公司曾经研究过耳机、智能眼镜以及 AI 音箱等方案,但最终还是决定研制一款可以取代智能手机的设备。 苹果表示,公司在起诉 OpenAI 之前曾尝试过私了。苹果在今年 2 月主动联系过 OpenAI,告知其机密信息已经流出,要求 OpenAI 主动展开调查、防止类似事件再次发生。 然而 OpenAI 并未作出回应,诉讼中点名的员工也没有回应媒体置评请求。 此外,本次诉讼也进一步凸显了 Tang Tan 和苹果下一任 CEO 约翰 · 特努斯的紧张关系。据悉, 特努斯曾是 Tang Tan 的上司 , 而 OpenAI 挖走的大多数苹果员工都来自特努斯掌管的硬件部门 。
最近进展 2026年7月11日 · industryTerrorist groups are using every major AI chatbot for attack planning and weapons development
A Cambridge study found that Boko Haram uses AI chatbots like ChatGPT, Claude, and Gemini to plan attacks, build explosives, and maintain weapons. ISIS operatives have been training the group's commanders on how to bypass safety filters since 2023. Given that the study found safety filters repeatedly failed to prevent misuse, voluntary self-regulation by AI providers clearly isn't enough. The article Terrorist groups are using every major AI chatbot for attack planning and weapons development appeared first on The Decoder .
最近进展 2026年7月11日 · OpenAIOpenAI 招聘家庭产品经理,将拓展家庭用户市场
IT之家 7 月 12 日消息,距离 ChatGPT 发布、生成式 AI 进入大众视野已过去三年多,OpenAI 正将关注重点从个人用户进一步扩展至家庭用户。 根据最新招聘信息,OpenAI 正在旧金山招聘一名专职产品经理,为其旗下产品打造面向家庭、护理人员和老年人的体验。职位要求应聘者具备面向家长和家庭用户设计产品的经验,并熟悉需要高度信任机制的消费者产品。 这一招聘动作也反映出 ChatGPT 的用户群体正在发生变化,不再主要由年轻用户构成。 根据市场研究机构 Sensor Tower 向 TechCrunch 提供的数据,2026 年第二季度,全球 ChatGPT 用户中 35 岁及以上人群占比已从一年前的 26% 上升至 31%;而 18 至 24 岁用户占比则从 34% 降至 29%。 在美国,Sensor Tower 估计,今年第二季度约 24% 的智能手机家长用户使用过 ChatGPT,而一年前这一比例仅为 16%。 科技咨询公司 Creative Strategies 首席执行官本 · 巴贾林(Ben Bajarin)认为,专门设立面向家庭的产品岗位,意味着 OpenAI 已开始将旗下产品从“个人效率工具”重新定位为“家庭共同使用的技术平台”。 “这与 Google、Apple 和 Meta 当年走过的发展路径类似 —— 随着平台逐渐融入日常生活,它们开始面向整个家庭提供服务。但 AI 的影响更大,因为 AI 助手不仅是在管理内容或设备,而是直接参与人与技术之间的互动。”他说。 不过,这种转变也带来了新的信任与安全挑战。 家庭在线安全研究所(Family Online Safety Institute,FOSI)首席执行官斯蒂芬 · 巴尔卡姆(Stephen Balkam)表示,此次招聘既说明 OpenAI 已进入更加成熟的发展阶段,也表明公司开始意识到,儿童和青少年使用 AI 产品需要不同于成年人产品的安全保护机制。 “我认为这是一次通过重新设计来提升安全性的尝试。”巴尔卡姆表示,“最初推出这些产品时,并没有充分考虑儿童用户,因此现在作出这样的调整是十分必要的。” 他的观点也呼应了 FOSI 本周发布的一项最新研究。这项针对美国和澳大利亚 4000 多个家庭开展的调查显示,家长普遍低估了孩子使用生成式 AI 的频率。只有 27% 的美国家长表示,孩子过去一周使用过生成式 AI,而实际上有 38% 的孩子表示自己确实使用过。 巴尔卡姆认为,AI 公司应该针对未成年用户采用完全不同的产品设计,包括更严格的内容管控、符合年龄特点的交互体验、家长监管机制,以及明确提醒用户自己正在与 AI 而非真人交流。 与此同时,AI 公司保护未成年用户的能力正受到越来越严格的审视。OpenAI 已遭遇多起由家长提起的诉讼,指控 ChatGPT 对其孩子造成伤害,其中部分案件甚至涉及未成年人自杀事件。 IT之家注意到,为回应这些担忧,OpenAI 在过去一年陆续推出了多项安全措施,包括: 为青少年账户提供家长控制功能; 将涉及敏感内容的对话交由更擅长识别心理危机的推理模型处理; 最新推出可选的“Trusted Contact(可信联系人)”功能,在检测到潜在自残风险时,可提醒家人或照护者。 巴尔卡姆表示,AI 企业有机会避免社交媒体行业曾经犯下的错误。过去多年,社交平台长期将儿童与成年人一视同仁,直到公众压力和监管不断增加后,才逐步加强未成年人保护措施。 此次招聘也与 OpenAI 在家庭领域的其他布局保持一致。 不久前,OpenAI 与圣安东尼奥马刺社区影响组织(San Antonio Spurs Community Impact)以及积极教练联盟(Positive Coaching Alliance)共同举办了一场研讨会,探讨 AI 在教育、教练培训以及青少年成长中的作用。 不过,用户年龄结构变化并非 ChatGPT 独有。 Sensor Tower 数据显示,Anthropic 的 Claude、Google 的 Gemini 与 ChatGPT 一样,25 至 34 岁用户均占全球用户总数的 40%,而微软 Copilot 这一比例为 33%。 但 Copilot 的用户年龄明显偏大,其中 45 岁及以上用户占比达到 20%,高于 Claude 的 14%、Gemini 的 12% 以及 ChatGPT 的 11%。 虽然 ChatGPT 在年长用户中的渗透率仍相对较低,但增长速度快于竞争对手。 Sensor Tower 数据显示,今年第二季度,ChatGPT 45 岁及以上用户占比较去年同期提升 3 个百分点;相比之下,Copilot 仅增长 2 个百分点,而 Claude 和 Gemini 的这一年龄段用户占比则出现下…
最近进展 2026年7月11日 · industryAgentation – Visual UI Annotation for AI Coding Agents
Article URL: https://www.agentation.com/ Comments URL: https://news.ycombinator.com/item?id=48873337 Points: 1 # Comments: 0
最近进展 2026年7月11日 · industryShow HN: BoundFlow – an open-source control plane for AI agents
Article URL: https://github.com/boundflow/boundflow Comments URL: https://news.ycombinator.com/item?id=48875888 Points: 1 # Comments: 0
最近进展 2026年7月11日 · industrySovereign AgentOps – Self-hosted constitutional AI governance for MCP agents
Article URL: https://github.com/geludobre/sovereign-agentops Comments URL: https://news.ycombinator.com/item?id=48875223 Points: 1 # Comments: 0
GLM-5.2 开源:智谱把 1M 上下文用于长时工程任务
智谱于 2026 年 6 月发布 GLM-5.2,以 MIT 许可开放权重,并提供 1M 上下文版本。
最近进展 2026年6月17日 · xAI / GrokGrok 进入 Amazon Bedrock:xAI 获得企业云分发与治理入口
xAI 于 2026 年 6 月宣布 Grok 4.3 在 Amazon Bedrock 正式可用。
最近进展 2026年6月23日 · Mistral AIMistral OCR 4 发布:文档理解成为企业 Agent 的基础能力层
Mistral 于 2026 年 6 月发布 OCR 4,继续扩展其文档解析与企业工作流能力。
最近进展 2026年6月24日 · Google DeepMindGemini 3.5 Flash Computer Use:浏览器 Agent 进入低延迟模型层
Google DeepMind 于 2026 年 6 月 24 日发布 Gemini 3.5 Flash 的 computer use 能力。
当月论文组 · 2026年6月本月精选 1 篇高质量研究Deployment Simulation · 模型安全 · 真实分布 · Agent 评测 · 风险预测
展开全部论文
Deployment Simulation · 模型安全 · 真实分布 · Agent 评测 · 风险预测
OpenAI 收购 Ona:Agent 竞争延伸到长期软件工程能力
OpenAI 于 2026 年 6 月 11 日宣布收购 Ona。
最近进展 2026年6月9日 · Google DeepMindGemma 4 12B:开放多模态模型进一步压缩部署门槛
Google DeepMind 于 2026 年 6 月 9 日发布统一、无独立编码器的 Gemma 4 12B 多模态模型。
最近进展 2026年6月9日 · MicrosoftClaude Fable 5 进入 Microsoft Foundry:模型分发继续平台化
Microsoft 于 2026 年 6 月 9 日宣布 Claude Fable 5 在 Microsoft Foundry 可用,面向自主 Agent 场景。
Anthropic 完成 Series H:模型竞争进入资本、收入与算力共振
Anthropic 宣布完成 650 亿美元 Series H 融资,投后估值 9650 亿美元,并披露年化收入超过 470 亿美元。
最近进展 2026年5月25日 · xAI / GrokGrok Build 发布:xAI 从模型 API 进入终端编码 Agent
xAI 于 2026 年 5 月发布 Grok Build 早期测试版,为订阅用户提供终端编码 Agent。
最近进展 2026年5月20日 · Cohere / CommandCommand A+ 发布:Cohere 强化可私有部署的企业 Agent 模型
Cohere 于 2026 年 5 月发布 Command A+,并通过标准 API 与私有部署方式提供。
最近进展 2026年5月19日 · 面壁智能 / ModelBest / OpenBMBMiniCPM5-1B 开源:面壁把端侧小模型与 Agent Skills 连接
面壁智能与 OpenBMB 于 2026 年 5 月发布 MiniCPM5-1B,并提供部署、微调和 Agent Skills。
当月论文组 · 2026年5月本月精选 1 篇高质量研究ERA · AI for Science · Nature · 科学 Agent · 实证研究
展开全部论文
ERA · AI for Science · Nature · 科学 Agent · 实证研究
Gemini 3.5:前沿模型竞争进一步转向可执行行动
Google DeepMind 于 2026 年 5 月 15 日发布 Gemini 3.5,并以面向行动的前沿智能作为核心定位。
最近进展 2026年5月17日 · Google DeepMindGemini Omni:原生多模态交互从能力展示走向统一产品入口
Google DeepMind 于 2026 年 5 月 17 日发布 Gemini Omni,强化跨文本、语音、视觉等模态的统一交互。
最近进展 2026年5月17日 · GoogleGoogle Antigravity 2.0:AI Coding 从补全工具走向任务级工程环境
Google DeepMind 于 2026 年 5 月 17 日发布 Google Antigravity 2.0,继续扩展面向 Agent 的开发体验。
最近进展 2026年5月20日 · GoogleGoogle I/O 2026:AI 从单点功能变成横跨产品与开发栈的平台层
Google 于 2026 年 5 月 20 日汇总 I/O 2026 的 100 项发布、演示与产品更新。
最近进展 2026年5月21日 · Google DeepMindDeepMind 亚太加速器:前沿模型开始与区域产业问题直接绑定
Google DeepMind 于 2026 年 5 月 21 日宣布在亚太启动面向环境风险的加速器计划。
GPT-5.5 发布:模型升级开始按端到端工作结果衡量
OpenAI 发布 GPT-5.5,重点提升编码、研究、数据分析、文档和跨工具操作。
最近进展 2026年4月7日 · 智谱 AI / Z.aiGLM-5.1 发布:智谱把 Agent 目标推进到 8 小时持续执行
智谱官方 Release Notes 于 2026 年 4 月记录 GLM-5.1 发布,定位为长时任务旗舰模型。
最近进展 2026年4月28日 · 商汤科技 / SenseTime / 日日新SenseNova U1 开源:商汤把理解与生成合并为原生多模态模型
商汤于 2026 年 4 月发布并开源 SenseNova U1 原生统一多模态模型系列。
最近进展 2026年4月16日 · AnthropicClaude Opus 4.7 发布:前沿能力继续聚焦复杂工作与 Agent
Anthropic 发布 Claude Opus 4.7,重点提升代码、Agent、视觉和多步骤任务表现。
当月论文组 · 2026年4月本月精选 1 篇高质量研究ReasoningBank · Agent 记忆 · test-time learning · 经验提炼 · ICLR
展开全部论文
ReasoningBank · Agent 记忆 · test-time learning · 经验提炼 · ICLR
Gemma 4 发布:开放模型竞争继续向单位资源效率推进
Google DeepMind 于 2026 年 4 月 2 日发布 Gemma 4,强调在开放模型形态下提升能力与部署效率。
最近进展 2026年4月30日 · Google DeepMindAI Co-clinician:医疗 AI 从问答助手转向协作式临床工作流
Google DeepMind 于 2026 年 4 月 30 日提出 AI co-clinician 方向,探索模型与临床人员协作的新工作模式。
Grok 4.20 Multi-agent 上线:xAI 将并行 Agent 编排产品化
xAI 官方 Release Notes 记录 Grok 4.20 与 Grok 4.20 Multi-agent 于 2026 年 3 月进入 API。
最近进展 2026年3月10日 · xAI / GrokGrok 4.1 Fast 进入企业 API:搜索、代码与远程 MCP 工具合流
xAI 于 2025 年 11 月在企业 API 提供 Grok 4.1 Fast,并让 Agent 工具支持该模型。
当月论文组 · 2026年3月本月精选 1 篇高质量研究劳动力 · AI 暴露 · 真实使用 · 就业 · Anthropic Economic Index
展开全部论文
劳动力 · AI 暴露 · 真实使用 · 就业 · Anthropic Economic Index
GLM-5 开源:智谱从代码生成转向长时系统工程
智谱于 2026 年 2 月发布 GLM-5,并以 MIT 许可开放权重,同时提供国内外 API。
最近进展 2026年2月14日 · 字节跳动 Seed / 豆包Seed 2.0 发布:字节把多模态理解与长时 Agent 推进生产部署
字节跳动 Seed 团队于 2026 年 2 月发布 Seed 2.0 Pro、Lite 与 Mini 三档通用 Agent 模型。
最近进展 2026年2月13日 · MiniMax / 稀宇科技MiniMax M2.5 开源:编码与办公 Agent 转向生产效率竞争
MiniMax 于 2026 年 2 月发布并开放 MiniMax-M2.5,面向编程、工具调用、搜索和办公任务。
当月论文组 · 2026年2月本月精选 1 篇高质量研究GABRIEL · 社会科学 · 量化测量 · 开源工具 · 审计
展开全部论文
GABRIEL · 社会科学 · 量化测量 · 开源工具 · 审计
Kimi K2.5 开源:月之暗面加入原生多模态与 Agent Swarm
月之暗面于 2026 年 1 月开放 Kimi K2.5,提供原生多模态理解、工具使用和并行 Agent Swarm。
最近进展 2026年1月6日 · xAI / GrokxAI 完成 200 亿美元 Series E:模型竞争继续绑定资本与算力规模
xAI 于 2026 年 1 月宣布完成 200 亿美元 Series E,并披露 Colossus I 与 II 的扩张进展。
最近进展 2026年1月22日 · AnthropicClaude 新宪法发布:模型行为治理走向可审查的制度层
Anthropic 发布 2026 版 Claude Constitution,系统说明模型的价值、行为原则和冲突处理。
最近进展 2026年1月31日 · 阶跃星辰 / StepFunStep 3.5 Flash 开源:阶跃星辰用稀疏模型争夺高效 Agent 推理
阶跃星辰于 2026 年初开放 Step 3.5 Flash,定位为兼顾推理、工具使用与效率的基础模型。
当月论文组 · 2026年1月本月精选 1 篇高质量研究Argos · 多模态 Agent · 强化学习 · 验证器 · 具身智能
展开全部论文
Argos · 多模态 Agent · 强化学习 · 验证器 · 具身智能
Baichuan-M3 开源:百川聚焦医疗决策流程
百川智能于 2026 年初开放 Baichuan-M3-235B,面向临床问诊与可靠医疗决策。
GLM-4.7 发布:跨工具步骤保留推理状态,面向长链编码 Agent
智谱于 2025 年 12 月发布并开放 GLM-4.7 权重,重点增强编码、工具使用与多步推理。
最近进展 2025年12月8日 · 智谱 AI / Z.aiGLM-4.6V 开源:智谱让视觉理解直接进入工具调用
智谱于 2025 年 12 月发布并开源 GLM-4.6V 与 9B 的 GLM-4.6V-Flash。
Codex 正式可用:编码 Agent 从实验进入团队基础设施
OpenAI 宣布 Codex 正式可用,并发布 SDK、Slack 集成和企业管理能力。
GLM-4.6 发布:智谱强化长上下文编码与搜索 Agent
智谱于 2025 年 9 月发布 GLM-4.6,将上下文窗口从 128K 扩展到 200K,并增强编码、推理和工具使用。
最近进展 2025年9月1日 · 腾讯混元 / Tencent Hunyuan混元翻译模型开源:腾讯用 7B 模型切入低成本多语言生产
腾讯混元官方仓库于 2025 年 9 月开放 Hunyuan-MT-7B 与 Hunyuan-MT-Chimera-7B。
GPT-5 发布:快模型与深度推理被统一到一个产品入口
OpenAI 发布 GPT-5,并在 ChatGPT 中通过统一系统路由即时回答和更深推理。
最近进展 2025年8月14日 · Perplexity / CometComet 进入企业版:Perplexity 从答案引擎扩展到可行动浏览器
Perplexity 于 2025 年 8 月向 Enterprise Pro 用户推出 Comet 浏览器。
ChatGPT Agent 发布:研究、浏览与行动合并为统一模式
OpenAI 发布 ChatGPT Agent,将 Operator 的操作、Deep Research 的研究和对话能力整合。
最近进展 2025年7月9日 · xAI / GrokGrok 4 发布:原生工具使用与大规模强化学习成为主线
xAI 于 2025 年 7 月发布 Grok 4 与 Grok 4 Heavy,并通过 Grok 产品和 API 提供访问。
最近进展 2025年7月28日 · 智谱 AI / Z.aiGLM-4.5 开源:智谱把推理、代码与 Agent 合并为统一模型
智谱于 2025 年 7 月发布 GLM-4.5 与 GLM-4.5-Air,并同时提供 API 和开放权重。
最近进展 2025年7月11日 · Moonshot AIKimi K2 开放:Moonshot 把国产模型竞争推向 Agent 与代码
Moonshot AI 发布 Kimi K2 混合专家模型并开放权重,重点强化代码和 Agent 工具使用。
ERNIE 4.5 全家族开源:百度用异构 MoE 补齐多模态开放路线
百度于 2025 年 6 月开放 ERNIE 4.5 的 10 个模型变体,并采用 Apache 2.0 许可。
最近进展 2025年6月16日 · MiniMaxMiniMax-M1 开源:国产推理模型竞争延伸到百万上下文
MiniMax 发布并开源 M1 混合注意力推理模型,提供百万 token 输入上下文。
Claude 4 发布:长时编码与 Agent 能力成为旗舰卖点
Anthropic 发布 Claude Opus 4 与 Sonnet 4,强调编码、工具使用和长任务能力。
最近进展 2025年5月16日 · OpenAICodex 云端 Agent 发布:编码任务从辅助转向委派
OpenAI 发布 Codex 研究预览,可在隔离云环境中并行处理代码库任务。
最近进展 2025年5月21日 · OpenAI / ioio 团队并入 OpenAI:模型公司开始向原生 AI 设备与交互入口扩张
OpenAI 与 Jony Ive 于 2025 年 5 月公布合作,并在 7 月更新确认 io Products 团队已正式并入 OpenAI。
当月论文组 · 2025年5月本月精选 1 篇高质量研究大语言模型 · MoE · 思考预算 · 多语言 · 开源
展开全部论文
大语言模型 · MoE · 思考预算 · 多语言 · 开源
o3 与 o4-mini 发布:推理模型开始主动调用全套工具
OpenAI 发布 o3 和 o4-mini,并让推理模型在 ChatGPT 中组合使用浏览、代码、文件和图像工具。
最近进展 2025年4月29日 · Alibaba / QwenQwen3 开源:中国模型进入混合推理与 Agent 阶段
Qwen 团队发布 Qwen3 系列开放模型,支持 thinking/non-thinking 切换与多语言能力。
最近进展 2025年4月9日 · GoogleGoogle A2A 发布:多 Agent 协作进入协议竞争
Google 联合多家企业发布 Agent2Agent Protocol,用于不同平台和厂商 Agent 之间协作。
最近进展 2025年4月14日 · 智谱 AI / Z.aiGLM-4-32B 开放:智谱补齐中等规模推理与批处理模型
智谱 GLM 团队于 2025 年 4 月开放 GLM-4-32B-0414 系列,覆盖对话、推理与沉思版本。
最近进展 2025年4月5日 · MetaLlama 4 发布:开放模型转向原生多模态 MoE
Meta 发布 Llama 4 Scout 与 Maverick,采用原生多模态和混合专家架构。
OpenAI 融资 400 亿美元:前沿模型资本需求跃迁到基础设施级别
OpenAI 于 2025 年 3 月宣布获得 400 亿美元新资金,投后估值 3000 亿美元,并与 SoftBank Group 合作。
最近进展 2025年3月18日 · NVIDIABlackwell Ultra 发布:推理时 Scaling 重塑 AI 基础设施
NVIDIA 在 GTC 2025 发布 Blackwell Ultra、Dynamo 和面向推理 Agent 的 AI Factory 平台。
最近进展 2025年3月11日 · OpenAIResponses API 与 Agents SDK:OpenAI 建立 Agent 开发平台
OpenAI 发布 Responses API、内置 Web/File/Computer Use 工具和开源 Agents SDK。
最近进展 2025年3月3日 · AnthropicAnthropic 完成 35 亿美元 Series E:编码与企业采用支撑新一轮扩张
Anthropic 于 2025 年 3 月宣布完成 35 亿美元融资,投后估值 615 亿美元,由 Lightspeed Venture Partners 领投。
最近进展 2025年3月25日 · Google DeepMindGemini 2.5 发布:思考模型成为前沿模型默认形态
Google 发布 Gemini 2.5 Pro 实验版,将推理能力内置为模型的核心能力。
Claude 3.7 与 Claude Code:混合推理进入开发者工作流
Anthropic 发布 Claude 3.7 Sonnet,并预览在终端中工作的 Claude Code。
最近进展 2025年2月19日 · xAI / GrokGrok 3 发布:xAI 把大规模预训练推进到推理与搜索 Agent
xAI 于 2025 年 2 月发布 Grok 3、Grok 3 mini 及其 Think 推理版本,并预告 API 与 DeepSearch。
最近进展 2025年2月2日 · OpenAIDeep Research 发布:Agent 首次把复杂知识工作做成标准产品
OpenAI 在 ChatGPT 发布 Deep Research,可自主搜索、分析并综合大量在线来源。
DeepSeek-R1 开源:推理能力与低成本冲击全球模型格局
DeepSeek 发布 R1、R1-Zero 和蒸馏模型,公开权重与技术方法。
最近进展 2025年1月23日 · OpenAIOperator 发布:OpenAI 从对话产品进入浏览器任务执行
OpenAI 发布 Operator 研究预览,模型可以在浏览器中点击、输入并完成多步骤任务。
最近进展 2025年1月15日 · 科大讯飞 / 讯飞星火讯飞星火 X1 发布:国产算力进入深度推理模型验证
科大讯飞于 2025 年 1 月发布星火 X1,并在 4 月升级其数学、代码与逻辑推理能力。
DeepSeek-V3 开源:训练效率成为全球模型竞争的新变量
DeepSeek 发布并开放 DeepSeek-V3 权重与技术报告,采用 671B MoE、37B 激活参数和 FP8 训练。
最近进展 2024年12月11日 · Google DeepMindGemini 2.0 发布:Google 把多模态模型推进到 Agent 系统
Google 发布 Gemini 2.0 Flash,并展示 Project Astra、Mariner 和代码 Agent 等原型。
最近进展 2024年12月12日 · xAI / GrokGrok-2 向所有 X 用户开放:实时搜索与引用成为产品差异点
xAI 于 2024 年 12 月宣布升级版 Grok-2 向所有 X 用户免费开放,并加入网页与 X 搜索结果引用。
Amazon 对 Anthropic 总投资增至 80 亿美元:模型与自研芯片绑定继续加深
Anthropic 于 2024 年 11 月宣布 Amazon 新增 40 亿美元投资,使总投资达到 80 亿美元,并确立 AWS 为主要云和训练伙伴。
最近进展 2024年11月25日 · AnthropicMCP 开源:Agent 的工具连接开始形成公共协议
Anthropic 开源 Model Context Protocol,用统一方式连接 AI 助手、数据源和工具。
OpenAI 融资 66 亿美元:前沿模型公司估值进入平台级规模
OpenAI 于 2024 年 10 月宣布融资 66 亿美元,投后估值为 1570 亿美元。
最近进展 2024年10月22日 · AnthropicClaude Computer Use:模型开始直接操作通用软件界面
Anthropic 发布计算机使用能力测试版,Claude 可以观察屏幕并操作鼠标和键盘。
OpenAI o1 预览:能力扩展从训练 Scaling 转向推理时计算
OpenAI 发布 o1-preview 与 o1-mini,模型会在回答前投入更多推理计算。
最近进展 2024年9月19日 · Alibaba / QwenQwen2.5 发布:中国开放模型形成全尺寸与垂直模型矩阵
阿里巴巴 Qwen 团队发布 Qwen2.5 系列,覆盖 0.5B 到 72B,并扩展代码、数学和视觉语言模型。
欧盟 AI Act 生效:通用模型进入正式合规周期
欧盟《人工智能法案》于 2024 年 8 月 1 日生效,并为通用模型和高风险系统设置分阶段义务。
当月论文组 · 2024年8月本月精选 1 篇高质量研究基础模型 · 图像分割 · 视频分割 · 流式记忆 · 实时处理
展开全部论文
基础模型 · 图像分割 · 视频分割 · 流式记忆 · 实时处理
xAI 完成 60 亿美元 Series B:资本开始直接竞逐超大规模训练集群
xAI 于 2024 年 5 月宣布完成 60 亿美元 Series B,投资方包括 Valor、Vy Capital、a16z、Sequoia 与 Fidelity 等。
最近进展 2024年5月13日 · 零一万物 / 01.AIYi-1.5 开源:零一万物继续押注中英双语开放模型
零一万物于 2024 年 5 月开放 Yi-1.5 系列,增强代码、数学、推理与指令遵循能力。
当月论文组 · 2024年5月本月精选 2 篇高质量研究材料模拟 · 深度学习 · 主动学习 · 第一性原理 · 吉布斯自由能 · 实时目标检测
展开全部论文
材料模拟 · 深度学习 · 主动学习 · 第一性原理 · 吉布斯自由能 · 实时目标检测
MatterSim: Deep Learning Atomistic Model Across Elements, Temperatures and Pressures:材料模拟的深度学习突破
2024年5月提交。MatterSim是一个从大规模第一性原理计算主动学习的深度学习模型,可模拟0-5000K、0-1000GPa条件下的元素周期表材料,预测吉布斯自由能精度达15 meV/atom(与实验对比),数据效率提升97%。
最近进展 2024年5月23日 · YOLOv10YOLOv10: Real-Time End-to-End Object Detection:NMS-free实时检测新范式
2024年5月提交。YOLOv10提出一致双分配(consistent dual assignments)实现无NMS训练,并采用整体效率-精度驱动模型设计策略,在COCO上YOLOv10-S比RT-DETR-R18快1.8倍且参数量与FLOPs减少2.8倍,比YOLOv9-C延迟降低46%、参数减少25%。
当月论文组 · 2024年2月本月精选 2 篇高质量研究可编程梯度信息 · 目标检测 · 轻量级网络 · 信息瓶颈 · 梯度路径规划 · State Space Model
展开全部论文
可编程梯度信息 · 目标检测 · 轻量级网络 · 信息瓶颈 · 梯度路径规划 · State Space Model
YOLOv9: Learning What You Want to Learn Using Programmable Gradient Information:可编程梯度信息实现精准目标检测
YOLOv9提出可编程梯度信息(PGI)概念,解决深度网络中信息瓶颈和可逆函数导致的数据丢失问题。PGI为目标任务提供完整输入信息,生成可靠梯度更新权重。同时设计轻量级网络GELAN,基于梯度路径规划,仅用常规卷积算子即超越基于深度可分离卷积的SOTA方法。在MS COCO数据集上,从零训练的模型性能优于使用大型数据集预训练的SOTA模型。
最近进展 2024年2月4日 · VM-UNetVM-UNet: Vision Mamba UNet for Medical Image Segmentation:基于状态空间模型的医学图像分割U形架构
提出首个基于纯状态空间模型(SSM)的医学图像分割模型VM-UNet,采用视觉状态空间(VSS)模块捕获长程上下文信息,并设计非对称编码器-解码器结构以减少卷积层数量,在ISIC17、ISIC18和Synapse数据集上取得有竞争力的性能。
当月论文组 · 2024年1月本月精选 3 篇高质量研究状态空间模型 · 视觉骨干网络 · 线性复杂度 · 2D选择性扫描 · 高效架构 · U-Mamba
展开全部论文
状态空间模型 · 视觉骨干网络 · 线性复杂度 · 2D选择性扫描 · 高效架构 · U-Mamba
VMamba: Visual State Space Model:视觉状态空间模型,线性复杂度新范式
VMamba将Mamba状态空间语言模型适配为视觉骨干网络,核心是VSS块和2D选择性扫描模块SS2D,通过四方向扫描路径实现1D扫描与2D视觉数据的桥接,在保持线性时间复杂度的同时收集多源上下文信息。
最近进展 2024年1月9日 · U-MambaU-Mamba: Enhancing Long-range Dependency for Biomedical Image Segmentation:U-Mamba通过混合CNN与状态空间模型,在生物医学图像分割中实现长程依赖建模,超越CNN和Transformer
U-Mamba提出混合CNN-SSM模块,结合卷积局部特征提取与状态空间序列模型的长程依赖捕获能力,在CT/MR腹部器官、内窥镜器械和显微镜细胞分割四个任务上超越现有CNN和Transformer网络。
最近进展 2024年1月17日 · VimVision Mamba: 双向状态空间模型实现高效视觉表示学习
提出Vim骨干网络,用双向Mamba块替代自注意力机制,在ImageNet分类、COCO检测和ADE20K分割任务上超越DeiT,且高分辨率推理速度提升2.8倍,GPU内存节省86.8%。
Gemini 1.0 发布:原生多模态成为前沿模型平台标准
Google 在 2023 年 12 月发布 Gemini Ultra、Pro 与 Nano 三种尺寸的原生多模态模型。
当月论文组 · 2023年12月本月精选 2 篇高质量研究状态空间模型 · 选择性机制 · 线性时间序列建模 · 高效推理 · 长序列处理 · 多模态模型
展开全部论文
状态空间模型 · 选择性机制 · 线性时间序列建模 · 高效推理 · 长序列处理 · 多模态模型
Mamba: Linear-Time Sequence Modeling with Selective State Spaces:Mamba:基于选择性状态空间的线性时间序列建模
Mamba是一种新型序列模型架构,通过让状态空间模型参数成为输入的函数,实现了内容感知的选择性信息传播与遗忘,解决了传统高效架构在离散模态上的推理弱点。该模型采用硬件感知的并行算法,在推理时吞吐量比Transformer高5倍,序列长度线性扩展,在语言、音频和基因组学等多个模态上达到最先进性能。在语言建模中,Mamba-3B模型性能与两倍大小的Transformer相当。
最近进展 2023年12月19日 · GeminiGemini:高度多模态模型家族:Gemini:高度多模态模型家族
谷歌发布Gemini多模态模型家族,包含Ultra、Pro、Nano三种规模,在32项基准测试中30项达到最先进水平,首次在MMLU上超越人类专家表现,并在所有20个多模态基准测试中取得最优。
OpenAI DevDay:模型平台向 Assistants、工具与定制能力扩张
OpenAI 在 2023 年 11 月 DevDay 发布 GPT-4 Turbo、Assistants API、新工具和定制模型计划。
当月论文组 · 2023年11月本月精选 1 篇高质量研究目标检测 · 边界框回归 · IoU损失 · 辅助边界框 · 缩放因子
展开全部论文
目标检测 · 边界框回归 · IoU损失 · 辅助边界框 · 缩放因子
Amazon 计划向 Anthropic 投资至多 40 亿美元:云、芯片与模型形成第二个前沿联盟
Anthropic 于 2023 年 9 月宣布 Amazon 将投资至多 40 亿美元并取得少数股权,AWS 成为其关键工作负载的主要云提供商。
最近进展 2023年9月27日 · Mistral AIMistral 7B 发布:小模型效率成为开放生态的新竞争轴
Mistral AI 在 2023 年 9 月发布 Mistral 7B 开放模型。
当月论文组 · 2023年9月本月精选 2 篇高质量研究LLM智能体 · 通用框架 · 多智能体协作 · 人机合作 · 智能体社会 · 目标检测
展开全部论文
LLM智能体 · 通用框架 · 多智能体协作 · 人机合作 · 智能体社会 · 目标检测
The Rise and Potential of Large Language Model Based Agents: A Survey:LLM智能体的崛起与潜力综述
该综述系统梳理了基于大语言模型(LLM)的智能体概念、框架与应用。文章从哲学起源追溯至AI发展,论证LLM作为通用智能体基础的优势,提出包含大脑、感知、行动三组件的通用框架,并覆盖单智能体、多智能体及人机协作三大应用场景,同时探讨智能体社会中的行为、个性及涌现现象。
最近进展 2023年9月20日 · Gold-YOLOGold-YOLO:通过收集-分发机制实现的高效目标检测器:华为提出GD机制与MAE预训练,在COCO上达到39.9% AP和1030 FPS
Gold-YOLO提出Gather-and-Distribute(GD)机制,结合卷积与自注意力操作,增强多尺度特征融合。首次在YOLO系列中引入MAE风格无监督预训练。Gold-YOLO-N在COCO val2017上达到39.9% AP,T4 GPU上1030 FPS,比YOLOv6-3.0-N高2.4% AP。代码已开源。
Qwen-7B 开放:中文大模型进入开放生态建设阶段
Qwen 团队在 2023 年 8 月公开 Qwen-7B 与 Qwen-7B-Chat 的代码和模型权重。
当月论文组 · 2023年8月本月精选 3 篇高质量研究视觉语言模型 · 多模态 · 指令微调 · 视觉定位 · 文本阅读 · 意识
展开全部论文
视觉语言模型 · 多模态 · 指令微调 · 视觉定位 · 文本阅读 · 意识
Qwen-VL: 多功能视觉语言模型,支持理解、定位、文本阅读等:Qwen-VL系列模型,基于Qwen-LM,通过视觉受体、输入输出接口、三阶段训练和多语言多模态语料库实现图文理解,在多项基准上创下新纪录。
Qwen-VL系列模型基于Qwen-LM,通过视觉受体、输入输出接口、三阶段训练和多语言多模态语料库实现图文理解。模型包括Qwen-VL和Qwen-VL-Chat,在图像描述、问答、视觉定位等基准上创下通用模型新纪录,并在真实对话基准上优于现有视觉语言聊天机器人。
最近进展 2023年8月17日 · 无特定项目名称Consciousness in Artificial Intelligence: Insights from the Science of Consciousness:从意识科学看人工智能意识
该报告基于五种主流神经科学意识理论(递归处理理论、全局工作空间理论、高阶理论、预测处理、注意图式理论),提取出计算可实现的意识指标属性,并评估了当前AI系统。结论是当前无AI系统具备意识,但构建有意识AI无技术障碍。
最近进展 2023年8月6日 · Spanish-BERTSpanish Pre-trained BERT Model and Evaluation Data:西班牙语专用BERT模型与评测基准发布
该论文发布了首个完全基于西班牙语数据预训练的BERT模型,并整合了多个西班牙语自然语言处理任务形成类似GLUE的评测基准。实验表明,该模型在大多数任务上优于多语言BERT模型,部分任务达到新最优水平。模型、预训练数据和基准已公开。
Llama 2 发布:开放模型成为可持续的产业路线
Meta 与 Microsoft 在 2023 年 7 月发布 Llama 2,并允许研究和商业使用。
最近进展 2023年7月13日 · 中国国家互联网信息办公室生成式 AI 服务管理暂行办法公布:中国市场形成明确的产品治理框架
中国七部门在 2023 年 7 月公布《生成式人工智能服务管理暂行办法》,自 8 月 15 日起施行。
最近进展 2023年7月11日 · AnthropicClaude 2 发布:长上下文与安全路线形成前沿模型竞争分支
Anthropic 在 2023 年 7 月发布 Claude 2,并开放网页与 API 访问。
当月论文组 · 2023年7月本月精选 4 篇高质量研究潜在扩散模型 · 文本到图像 · 高分辨率 · UNet · 精炼模型 · 视觉-语言-动作模型
展开全部论文
潜在扩散模型 · 文本到图像 · 高分辨率 · UNet · 精炼模型 · 视觉-语言-动作模型
SDXL:改进高分辨率图像合成的潜在扩散模型
SDXL是Stable Diffusion的升级版,采用三倍大的UNet骨干网络,增加注意力块和更大跨注意力上下文,使用双文本编码器。设计多种新颖条件方案,在多宽高比上训练,并引入后处理精炼模型提升视觉保真度。性能显著优于前代,与黑盒顶级图像生成器竞争。
最近进展 2023年7月28日 · RT-2RT-2: Vision-Language-Action Models Transfer Web Knowledge to Robotic Control:将互联网知识迁移至机器人控制的视觉-语言-动作模型
RT-2提出将视觉-语言模型(VLM)与机器人轨迹数据共同微调,通过将机器人动作编码为文本令牌,使模型同时处理自然语言和动作输出。在6000次评估试验中,RT-2展现出对未见物体的泛化能力、解释未训练指令(如按数字或图标放置物体)以及执行基础推理(如选择最小或最大物体)的能力。链式思维推理进一步支持多阶段语义推理,例如选择石头作为临时锤子。
最近进展 2023年7月27日 · SWhisperSirens' Whisper: Inaudible Near-Ultrasonic Jailbreaks of Speech-Driven LLMs:基于近超声的语音大模型越狱攻击
该研究提出SWhisper,首个针对语音驱动大语言模型的近超声越狱攻击方法。通过将恶意提示编码到近超声载波中,利用麦克风非线性解调为可听语音,实现人耳不可感知但被语音识别系统准确转录并传递给LLM。在黑盒评估中,对DeepSeek、Grok等商业平台达到0.94非拒绝率和0.925特定说服分数,暴露了语音LLM系统的关键漏洞。
最近进展 2023年7月14日 · MPDIoUMPDIoU: A Loss for Efficient and Accurate Bounding Box Regression:基于最小点距离的边界框回归损失函数
提出MPDIoU损失函数,基于最小点距离度量边界框相似性,综合重叠区域、中心点距离和宽高偏差,简化计算。在YOLACT和YOLOv7上,PASCAL VOC、MS COCO和IIIT5k数据集表现优于现有损失函数。
当月论文组 · 2023年6月本月精选 3 篇高质量研究LLM-as-a-judge · MT-Bench · Chatbot Arena · 模型评估 · 人类偏好 · 基因组基础模型
展开全部论文
LLM-as-a-judge · MT-Bench · Chatbot Arena · 模型评估 · 人类偏好 · 基因组基础模型
Judging LLM-as-a-Judge with MT-Bench and Chatbot Arena:用LLM作为裁判评估聊天助手
本文提出使用强LLM(如GPT-4)作为裁判来评估聊天助手,并引入MT-Bench多轮问答基准和Chatbot Arena众包对战平台。研究发现GPT-4裁判与人类偏好的一致性超过80%,达到人类间一致水平。同时分析了位置偏差、冗长偏差、自我增强偏差和推理能力有限等局限性,并提出了缓解方案。
最近进展 2023年6月26日 · DNABERT-2DNABERT-2: Efficient Foundation Model and Benchmark For Multi-Species Genome:DNABERT-2:面向多物种基因组的高效基础模型与基准
DNABERT-2用BPE替换k-mer分词,在36个数据集、9个任务的GUE基准上,以21倍更少参数和92倍更少预训练GPU时间达到与SOTA相当的性能。
最近进展 2023年6月1日 · LLaVA-MedLLaVA-Med: Training a Large Language-and-Vision Assistant for Biomedicine in One Day:低成本构建生物医学多模态对话助手
该论文提出一种低成本方法,利用PubMed Central的图文对和GPT-4生成的指令数据,在15小时内训练出生物医学视觉语言对话助手LLaVA-Med,在三个标准生物医学VQA数据集上部分指标超越此前监督学习最优模型。
Anthropic 完成 4.5 亿美元 Series C:安全路线进入产品与企业扩张期
Anthropic 于 2023 年 5 月宣布完成 4.5 亿美元 Series C,由 Spark Capital 领投,Google、Salesforce Ventures、Zoom Ventures 等参与。
当月论文组 · 2023年5月本月精选 4 篇高质量研究QLoRA · 量化微调 · 大模型 · NF4 · 高效训练 · 思维树
展开全部论文
QLoRA · 量化微调 · 大模型 · NF4 · 高效训练 · 思维树
QLoRA: Efficient Finetuning of Quantized LLMs:4比特量化微调让大模型训练平民化
2023年5月,华盛顿大学团队提出QLoRA,在单个48GB GPU上微调65B参数模型,性能达到ChatGPT的99.3%。核心创新包括4-bit NormalFloat数据类型、双重量化和分页优化器。训练了1000+模型,发现小规模高质量数据集微调即可达到SOTA。
最近进展 2023年5月17日 · Princeton NLP GroupTree of Thoughts: Deliberate Problem Solving with Large Language Models:思维树框架让LLM具备规划与回溯能力
2023年5月,普林斯顿大学团队提出Tree of Thoughts(ToT)框架,将LLM推理从链式扩展为树状搜索。在Game of 24任务中,GPT-4+ToT成功率达74%,而标准CoT仅4%。ToT允许模型探索多条推理路径、自我评估并回溯,显著提升需要规划的任务表现。
最近进展 2023年5月29日 · Stanford UniversityDirect Preference Optimization: Your Language Model is Secretly a Reward Model:直接偏好优化,无需强化学习的对齐新范式
2023年5月,斯坦福大学团队提出Direct Preference Optimization(DPO),无需显式奖励模型和强化学习,直接通过偏好数据优化LLM。DPO将奖励函数隐式定义为策略的闭式解,训练更简单、更稳定。实验表明DPO在多个任务上匹配或超越PPO。
最近进展 2023年5月25日 · NVIDIA / UT AustinVoyager: An Open-Ended Embodied Agent with Large Language Models:LLM驱动的终身学习智能体在Minecraft中自主探索
2023年5月,NVIDIA和UT Austin团队提出Voyager,首个LLM驱动的终身学习智能体,在Minecraft中无需人类干预持续探索、获取技能并发现新事物。Voyager使用GPT-4,通过自动课程、技能库和迭代提示机制,获得3.3倍独特物品、解锁里程碑快15.3倍。
当月论文组 · 2023年4月本月精选 4 篇高质量研究自监督学习 · 视觉基础模型 · 数据筛选 · 知识蒸馏 · ViT · 多模态
展开全部论文
自监督学习 · 视觉基础模型 · 数据筛选 · 知识蒸馏 · ViT · 多模态
DINOv2: Learning Robust Visual Features without Supervision:自监督视觉基础模型进入实用阶段
2023年4月,Meta AI发布DINOv2,提出一种全自动数据筛选管道,从海量未标注图像中构建多样化、高质量的训练数据集,并训练了1B参数的ViT模型,再蒸馏为一系列小模型。在图像级和像素级基准上,DINOv2超越了当时最好的通用视觉特征OpenCLIP,且无需微调即可直接用于多种下游任务。
最近进展 2023年4月17日 · LLaVALLaVA: Visual Instruction Tuning:多模态指令微调的开源里程碑
2023年4月,LLaVA首次提出使用纯语言GPT-4生成多模态语言-图像指令数据,并基于此训练了一个端到端的大规模多模态模型(连接视觉编码器和LLM)。在Science QA上,LLaVA+GPT-4达到92.53%准确率,创下新纪录;在合成多模态指令跟随数据集上达到GPT-4的85.1%相对分数。
最近进展 2023年4月7日 · Stanford / Google ResearchGenerative Agents: Interactive Simulacra of Human Behavior:大模型驱动的可信人类行为模拟
2023年4月,斯坦福大学和Google Research提出生成式智能体(Generative Agents),利用大语言模型(LLM)驱动25个智能体在一个类似《模拟人生》的沙盒环境中自主生活。智能体能够起床、做饭、工作、社交、形成记忆并规划未来,仅从一个“想办情人节派对”的初始设定出发,智能体自主传播邀请、结识新朋友、协调时间并最终共同参加派对。
最近进展 2023年4月17日 · BaiduRT-DETR: DETRs Beat YOLOs on Real-time Object Detection:实时目标检测的Transformer时代来临
2023年4月,百度提出RT-DETR,首个实时端到端目标检测器,在COCO上以53.1% AP和108 FPS(T4 GPU)超越YOLOv8等先进YOLO系列。它设计了高效混合编码器解耦尺度内交互和跨尺度融合,并提出不确定性最小化查询选择提升解码器初始查询质量。支持通过调整解码器层数灵活调速,无需重新训练。
GPT-4 发布:大模型进入更可靠的多模态推理阶段
OpenAI 在 2023 年 3 月发布 GPT-4,支持图像输入并在多项专业考试中显著提升表现。
最近进展 2023年3月16日 · MicrosoftMicrosoft 365 Copilot 发布:大模型开始进入组织核心工作流
Microsoft 在 2023 年 3 月发布 Microsoft 365 Copilot,将大模型接入 Word、Excel、PowerPoint、Outlook 与 Teams。
最近进展 2023年3月1日 · OpenAIChatGPT 与 Whisper API 发布:生成式 AI 进入开发者规模化接入阶段
OpenAI 在 2023 年 3 月发布 ChatGPT 和 Whisper API,并显著降低对话模型使用成本。
最近进展 2023年3月23日 · OpenAIChatGPT Plugins 发布:模型开始连接外部工具与实时信息
OpenAI 在 2023 年 3 月发布 ChatGPT Plugins,允许模型调用第三方服务、计算与检索能力。
当月论文组 · 2023年3月本月精选 4 篇高质量研究GPT-4 · AGI · 通用智能 · 大型语言模型 · 能力评估 · BloombergGPT
展开全部论文
GPT-4 · AGI · 通用智能 · 大型语言模型 · 能力评估 · BloombergGPT
Sparks of Artificial General Intelligence: Early experiments with GPT-4:GPT-4展现通用智能火花,AGI雏形已现
2023年3月,微软研究团队发布了对早期GPT-4的评估报告。论文通过大量实验证明,GPT-4在数学、编程、视觉、医学、法律、心理学等众多领域表现出接近人类水平的性能,且无需特殊提示。作者认为GPT-4可被视为早期(但不完整)的AGI系统,并指出其局限性在于仍基于下一个词预测范式。
最近进展 2023年3月30日 · BloombergBloombergGPT: A Large Language Model for Finance:BloombergGPT:金融领域首个大规模语言模型
2023年3月,彭博发布BloombergGPT,一个500亿参数的金融专用语言模型。该模型基于彭博自有的3630亿token金融数据集(含新闻、报告、监管文件等)和3450亿token通用数据训练。在金融基准测试中,BloombergGPT显著优于同等规模的通用模型,同时保持通用NLP性能。
最近进展 2023年3月20日 · Northeastern UniversityReflexion: Language Agents with Verbal Reinforcement Learning:Reflexion:通过语言反馈强化智能体,无需权重更新
2023年3月,研究者提出Reflexion框架,让语言智能体通过自我反思的文本反馈来改进决策,而非更新模型权重。在HumanEval代码生成任务上,Reflexion达到91% pass@1,超越GPT-4的80%。该方法适用于多种任务,包括决策、编码、推理。
最近进展 2023年3月30日 · Microsoft Research AsiaHuggingGPT: Solving AI Tasks with ChatGPT and its Friends in Hugging Face:HuggingGPT:用ChatGPT调度Hugging Face模型解决复杂AI任务
2023年3月,研究者提出HuggingGPT框架,利用ChatGPT作为控制器,自动规划任务、选择Hugging Face上的AI模型、执行子任务并汇总结果。该系统能处理跨模态、跨领域的复杂任务,如“生成一张猫的图片并描述它”。
当月论文组 · 2023年2月本月精选 3 篇高质量研究开源大模型 · 高效训练 · LLaMA · 基座模型 · 数据质量 · 条件控制
展开全部论文
开源大模型 · 高效训练 · LLaMA · 基座模型 · 数据质量 · 条件控制
LLaMA: Open and Efficient Foundation Language Models:开源高效基座模型改写大模型竞争格局
2023年2月,Meta发布LLaMA系列模型(7B-65B参数),仅使用公开数据集训练。LLaMA-13B在多数基准上超越GPT-3(175B),LLaMA-65B与Chinchilla-70B和PaLM-540B竞争。模型全部开源。
最近进展 2023年2月10日 · Stanford ControlNetControlNet: Adding Conditional Control to Text-to-Image Diffusion Models:为扩散模型注入精细控制,开启图像生成新范式
2023年2月,斯坦福大学提出ControlNet,一种向预训练文本到图像扩散模型添加空间条件控制的神经网络架构。它锁定原模型参数,通过零卷积连接可训练副本,支持边缘、深度、分割、人体姿态等多种条件输入,训练数据量可小至5万张。
最近进展 2023年2月9日 · Meta ToolformerToolformer: Language Models Can Teach Themselves to Use Tools:语言模型自学工具调用,突破能力边界
2023年2月,Meta提出Toolformer,通过自监督方式训练语言模型自主决定调用外部工具(计算器、搜索引擎、翻译系统、日历等)的时机、参数和结果融合。仅需每个工具少量演示,即可显著提升零样本任务性能,且不损害核心语言建模能力。
Microsoft 扩大对 OpenAI 的多年投资:模型、算力与云分发形成深度绑定
Microsoft 于 2023 年 1 月宣布与 OpenAI 进入第三阶段合作,并进行一笔多年、数十亿美元规模的投资。
当月论文组 · 2023年1月本月精选 1 篇高质量研究视觉语言预训练 · 冻结模型 · Q-Former · 多模态 · 零样本学习
展开全部论文
视觉语言预训练 · 冻结模型 · Q-Former · 多模态 · 零样本学习
当月论文组 · 2022年12月本月精选 2 篇高质量研究语音识别 · 弱监督学习 · 零样本泛化 · 多语言 · Transformer · 天气预报
展开全部论文
语音识别 · 弱监督学习 · 零样本泛化 · 多语言 · Transformer · 天气预报
Robust Speech Recognition via Large-Scale Weak Supervision:Whisper 开启语音识别零样本泛化时代
2022年12月,OpenAI发布Whisper论文,报告了训练一个模型仅通过预测互联网上68万小时多语言多任务音频的转录文本,即可在零样本设置下达到与先前完全监督方法竞争的性能,且接近人类准确率和鲁棒性。模型和推理代码已开源。
最近进展 2022年12月24日 · Google DeepMind GraphCastGraphCast: Learning skillful medium-range global weather forecasting:AI天气预报的里程碑
2022年12月,Google DeepMind发布GraphCast,一种基于图神经网络和机器学习的中期全球天气预报方法。它直接从再分析数据训练,在0.25度分辨率下预测10天数百个天气变量,耗时不到1分钟。在1380个验证目标中,90%优于最准确的操作性确定性系统,并在热带气旋、大气河流等极端事件预测上表现更优。
ChatGPT 上线:大模型从能力演示变成大众产品
OpenAI 在 2022 年 11 月 30 日发布 ChatGPT research preview。
当月论文组 · 2022年11月本月精选 3 篇高质量研究提示工程 · 自动优化 · 大语言模型 · 零样本学习 · 指令生成 · 科学大模型
展开全部论文
提示工程 · 自动优化 · 大语言模型 · 零样本学习 · 指令生成 · 科学大模型
Large Language Models Are Human-Level Prompt Engineers:APE实现自动提示工程,超越人类水平
2022年11月提交。提出Automatic Prompt Engineer (APE),将提示视为程序,由LLM生成候选指令,再通过搜索最大化评分函数自动选择最优指令。在24个NLP任务上,自动生成的指令零样本性能大幅超越LLM基线,并在19/24个任务上达到或超过人类编写的指令。
最近进展 2022年11月16日 · GalacticaGalactica: A Large Language Model for Science:Galactica科学大模型,重塑科研知识管理
2022年11月提交。Galactica是一个专门针对科学知识训练的大型语言模型,基于论文、参考资料、知识库等大规模科学语料。在LaTeX方程等知识探测任务上,准确率68.2%远超GPT-3的49.0%;在数学推理上超越Chinchilla和PaLM 540B;在PubMedQA和MedMCQA上达到SOTA。模型开源。
最近进展 2022年11月27日 · PatchTSTA Time Series is Worth 64 Words: Long-term Forecasting with Transformers:PatchTST以子序列分块革新时序预测
2022年11月提交。提出PatchTST模型,将多元时间序列分割为子序列级补丁作为Transformer输入,并采用通道独立设计(每个通道共享权重)。在长期预测任务上显著优于此前SOTA Transformer模型,同时支持自监督预训练,迁移学习也达到SOTA。