08.13
2026-08-13 · 星期四 · 06:19 截稿 · 覆盖近 1-3 天动态
今天模型与 agent 基础设施同时推进。Grok 4.6 上线,聚焦长时程 agent 与复杂交互,在 agentic coding 与知识工作基准上接近同类模型,API 价格维持低位;Elon 已预告 4.7 几周内就绪,并会注入大量 SpaceX 真实工程数据。NVIDIA 同步开源 Nemotron 3.5 Lightning,30B 参数 MoE 却只激活 3B,主打高吞吐 agent 执行层,输出速度明显提升。开发者侧则看到 Claude Code 围绕 MCP 的快速封装工具,以及多篇论文集中处理 agent 记忆膨胀、技能冗余与树结构自纠正问题。
商业变现
3 条
AI搜索可见性工具AI Peekaboo本月MRR突破5万美元
独立开发者John公开宣布其AI搜索可见性产品AI Peekaboo本月MRR已超过5万美元,并附上截图。该工具帮助企业追踪品牌在ChatGPT、Gemini、Perplexity等AI回答中的呈现情况。
生成式AI产品以约2万美元MRR挂牌出售
创始人Pranjal Soni在X上挂牌出售一款约2万美元MRR的生成式AI产品,要价20万美元。产品上线约两个月,日均新增约500美元MRR,但 churn 率约40%。
Shopify AI产品摄影应用Modelize 3个月达2千美元MRR
Modelize作为面向Shopify商家的AI产品摄影应用,在3个月内达到2千美元MRR。团队正寻找负责内容与增长的联合创始人继续扩张。
产品发布
4 条
NVIDIA 开源 Nemotron 3.5 Lightning 模型
Nemotron 3.5 Lightning 是 30B 参数 MoE 模型(仅 3B 激活),针对高吞吐量 agent 执行层优化,输出速度可达同类模型 4 倍。同时开源 NeMo Switchyard 路由库,支持权重、数据与配方的本地后训练。
SpaceXAI 发布 Grok 4.6 模型
Grok 4.6 聚焦长时程 agent 与复杂交互任务,在多项 agentic coding 与知识工作基准上达到与 GPT-5.6 Sol 相当的水平。API 定价保持每百万输入 token 2 美元、输出 6 美元,并同步上线 Cursor 与 Grok Build。
OpenAI 推出 ChatGPT 桌面应用 Linux 预览版
ChatGPT 桌面应用现支持 Ubuntu、Debian 与 Fedora 等发行版,集成 ChatGPT、ChatGPT Work 与 Codex。提供 .deb 与 .rpm 包,覆盖 x64 与 ARM64 架构。
Google 发布 Pixel 11 系列并强化 Gemini Intelligence
Pixel 11 系列搭载 Tensor G6,支持更主动的 Gemini Intelligence 功能,包括跨 40 多款应用的任务自动化、Rambler 语音转写与 Magic Capture。手机即日起开启预售。
X 热议
4 条
Elon Musk 预告 Grok 4.7 将于 3-4 周内就绪并加入大量 SpaceX 数据
Elon 表示 Grok 4.7 显著优于 4.6,初始训练已完成,正在补充海量 SpaceX 公司数据。预计该模型在真实世界工程任务上会有突出表现。
Jason Wei 讨论 AI 优势下人类仍可保留的价值护城河
基于特斯拉 FSD 体验,作者分析 AI 在感知与效率上的固有优势,并探讨私人知识、艺术娱乐及人类存在感作为人类持续价值的可能领域。
Twitch 默认开启频道内容用于 Amazon 生成式 AI 训练
Twitch 新增设置允许 Amazon 使用直播、VOD、聊天等内容训练 AI,默认开启。创作者需手动在隐私设置中关闭,他人直播中的评论也可能被纳入。
Notion 宣布已支持 Grok 4.6 模型
Notion 宣布 Grok 4.6 现已集成到其产品中,用户可在工作流中直接调用该模型。
GitHub 项目
3 条
mcp-execution:从 MCP 服务器生成 Claude Code SKILL.md 与 TypeScript 工具
v0.10.0 于 2026-08-12 发布,提供 mcp-execution-skill crate,可从 MCP 工具文件自动生成 Claude Code 的 SKILL.md,并支持 progressive loading 以大幅降低 token 占用。适合将现有 MCP 服务器快速接入 Claude Code 工作流。
cc-mcp-executor-skill:用子代理执行 MCP 工具调用的 Claude Code skill
通过子代理架构在隔离上下文中编写并执行 TypeScript/Python 代码来组合多个 MCP 工具调用,主会话无需加载全部 MCP schema,可显著减少 token 开销。提供现成安装方式与示例脚本。
AgentScope Java:生产级分布式长时运行 Agent 框架
提供事件流、权限控制、中间件与沙箱能力,面向企业级 Java 环境构建可控、可观测的长时 Agent。
开源产品
3 条
ComfyUI v0.32.0 发布
开源节点式图像与视频生成工作流平台更新,新增 LTX-2.5 原生支持、Qwen-Image 3.0 节点及多项性能优化,支持本地自部署完整生成流水线。
Ollama v0.32.9 发布
本地大模型运行产品更新,新增 Nemotron 3.5 Lightning 等模型支持,继续强化跨平台一键部署与 OpenAI 兼容 API。
Windmill v1.786.0 发布
开源低代码工作流与内部工具平台更新,强化 AI 会话与脚本生成能力,支持完整自托管部署与 Agent 沙箱。
报告观点
5 条
REDAgentBench:可执行红队测试与LLM Agent系统的忠实测量
提出可执行红队框架,在隔离沙箱中根据安全约束生成并验证攻击,直接检查服务收据与最终状态变化。揭示识别-执行差距,并显示简单策略提醒可显著降低确认违规率。
CLAUDE.md为何持续膨胀?Agentic编码中的灾难性记忆
分析真实仓库中agentic coding指令文件无限增长现象,称为灾难性记忆。通过对大量仓库指令生命周期的研究,提出prompt comments方法可大幅削减冗余指令并提升Agent指令遵循能力。
通过树结构记忆实现自纠正长时程搜索Agent
针对LLM搜索Agent上下文无界增长与轨迹噪声问题,提出ReTree树结构记忆机制。为每步构建有界推理上下文,将搜索建模为证据树,并通过回溯修正与剪枝处理矛盾。
SkillZip:通过发现可重用结构实现自进化Agent的评估无关技能压缩
自进化Agent积累技能时产生大量冗余。SkillZip采用类型化最小描述长度目标,在硬覆盖约束下寻找最短忠实结构解释,支持一次性与持续压缩模式,保留独特规则并降低更新成本。
Grothendieck常数的长时程AI研究:人机数学协作案例
详细记录使用AI研究系统改进Grothendieck常数已知界限的长期过程。讨论推理模型与编码Agent的分工、文件记忆与校准验证协议,以及人机协作中AI的优势与当前局限。
内容由 AI 检索生成,每日自动更新,可能存在错漏;事实与数据以源链接为准。资讯狗不对第三方链接内容负责。