08.12
2026-08-12 · 星期三 · 06:20 截稿 · 覆盖近 1-3 天动态
Google Gemini应用月活突破10亿,语音交互占比超过六成,每日生成图片量也到了1.5亿张级别。与此同时,开源侧密集出现面向Agent的基础设施:知识图谱构建、技能定义与分发、多Agent预算与组织管理,以及可直接接入编码工具的专业角色合集。xAI同步放出Grok Bot早期beta,让模型能登录用户已有工具并跨应用完成真实任务;Meta则开源了可在单卡消费级GPU运行的30B本地代理模型。
商业变现
3 条
Google Gemini应用月活用户突破10亿
Google官方宣布Gemini应用月活跃用户超过10亿,成为其历史上增长最快的产品。63%用户使用语音交互,每日生成超1.5亿张图片。
独立开发者Aydan AI相关SaaS上线第32天公开MRR达350美元
开发者在X上更新build in public数据:MRR 350美元、过去28天收入477美元、活跃用户448、活跃订阅31。此前一天同期数据接近,显示早期持续增长。
monday.com AI产品ARR环比翻倍并占净新增ARR的17%
monday.com Q2 2026财报显示AI产品ARR较上一季度翻倍,贡献净新增ARR的17%。超过50万美元ARR客户数同比增长68%至114家。
产品发布
1 条
X 热议
3 条
xAI 发布 Grok Bot 早期 beta,AI 队友可登录工具完成真实工作
xAI 推出 Grok Bot,作为可独立登录用户工具、跨应用工作并返回完成结果的 AI 队友。目前对 SuperGrok Heavy、Cursor Ultra 和 Cursor Teams Premium 用户开放早期 beta。
Meta 开源 Muse Glimmer 30B 本地代理模型,可单 GPU 运行
Meta 发布 30B 参数 Muse Glimmer 开源权重(Apache 2.0),专为本地代理工作流优化,可在约 24GB VRAM 的消费者 GPU 上运行并保持代理能力。
新论文展示从专有 LLM API 窃取加密推理轨迹的方法
研究人员发现可将加密 chain-of-thought 注入同提供商较弱模型来解码前沿模型推理,影响 Anthropic、OpenAI 和 Google,并从公开日志中恢复隐私与凭证信息。
GitHub 项目
8 条
Semantica:面向 AI Agent 的图原生知识图谱基础设施
提供多源数据摄入、知识图谱构建、因果推理与决策溯源能力的开源框架,支持可审计的 AI 系统。适合需要上下文持久化与可解释推理的 Agent 开发场景。
refly-ai/refly 开源 Agent Skills 构建器
开源 Agent Skills 构建平台,支持用 vibe workflow 定义技能并导出到 Claude Code、Cursor、Codex。技能可作为原生工具在 Claude Code 中调用,同时兼容 MCP。
Agency Agents:可直接接入主流编码工具的专业 Agent 人设合集
包含大量按领域划分的专业化 AI Agent 定义与安装脚本,覆盖工程、设计、营销等角色。可快速导入 Claude Code、Cursor 等工具使用。
Code-Graph-RAG:基于知识图谱的多语言代码库 RAG 与编辑工具
用 Tree-sitter 解析代码并构建 Memgraph 知识图谱,支持自然语言查询、结构检索与 AST 级编辑。适用于 monorepo 理解与 AI 辅助改码。
Paperclip:用组织架构与预算管理多 Agent 团队的开源平台
提供公司级控制平面,支持雇佣多种 Agent 运行时、分配目标与预算、跟踪工作与成本。可自托管运行多 Agent 协作业务。
robonuggets/gauntlet-loop Claude Code 多 Agent 循环技能
将目标转化为短提示,让 agent 设定真实质量基准,运行 builder/critic 配对并盲比循环直至胜出。可直接作为 Claude Code skill 使用,支持多 agent 编排。
agentskill-sh/mcp-server 大规模技能发现与安装 MCP
面向 agentskill.sh 的 MCP 服务器,可搜索、发现并安装 10 万+ AI agent skills。支持 Claude Code 等平台,提供 trending、安全评分和一键安装功能。
Firecrawl:为 Agent 提供网页搜索与结构化抓取的上下文 API
将网页转为干净 Markdown 或结构化数据,支持搜索与交互式抓取。便于 Agent 获取实时外部上下文。
开源产品
3 条
Ollama v0.32.9 支持Nemotron模型更新
Ollama发布v0.32.9版本,新增NVIDIA Nemotron 3架构支持,并处理Muse Glimmer函数调用边界情况,方便本地运行新开源模型。
Unsloth Desktop 开源本地AI运行与训练桌面应用
Unsloth Desktop是一款可在Windows、macOS和Linux本地运行的开源桌面应用,支持运行和训练多种LLM及扩散模型,并集成工具调用、RAG与远程部署。
OpenHuman 本地个人AI助手版本更新
OpenHuman是开源本地优先桌面AI助手,具备持久记忆、多智能体编排和深度研究功能,近期发布增强记忆与语音相关能力。
报告观点
5 条
Evo-Bench:语言模型能否改进智能体Harness?
提出Evo-Bench基准,用于评估LLM自主优化其操作Harness的能力,覆盖搜索、办公和通用领域。实验显示顶级模型可获得显著性能提升,并产生可迁移的推理结构。
SHE:基于轨迹的LLM智能体安全Harness演化
提出SHE框架,将安全Harness分解为四类工件,并通过归因引导的演化循环从轨迹失败中学习。实验表明该方法可提升安全表现同时保持任务效用。
面向技能型LLM智能体强化学习的双向上下文自蒸馏
提出BCSD框架,结合自蒸馏与强化学习,从增强和精简两种技能上下文视角评估轨迹。在ALFWorld和WebShop任务上提升了智能体对自然语言技能的利用能力。
ADIAS:交互式智能体系统的自动化设计
提出ADIAS方法,用于自动化设计交互式智能体系统,覆盖架构生成与优化流程。论文展示了其在多智能体场景下的设计效率与可扩展性。
ArchAgent v2:数据预取锦标赛案例研究
提出ArchAgent v2框架,采用级联进化搜索与硬件可实现性反馈,用于自动化微架构设计。在第四届数据预取锦标赛中生成的三级预取器优于先前人工冠军方案。
内容由 AI 检索生成,每日自动更新,可能存在错漏;事实与数据以源链接为准。资讯狗不对第三方链接内容负责。