09.04
2026-09-04 · 星期五 · 06:19 截稿 · 覆盖近 1-3 天动态
独立开发者这边在晒账本,实验室那边在改价、改能力档,两条线同一天叠在一起。Motionvid、公开排名站、Crustdata 和 Stanley 分别把视频工具、目录服务、B2B 数据和内容代理做成可复现的现金流,评论区已经开始追问广告花费和 CAC,而不是只看 ARR 截图。模型侧则是缓存读取降价、竞赛编程后训练越过金牌线,同时 Astra 的系统卡写明网络能力进 Critical、思维链更难盯。开源仓库同一天把智能体往本机搬:可移植编码运行时、本地推理路由、技能目录和自托管对话平台一起出现,等于在云端变便宜、也变不透明的时候,把调度权拆回自己的机器。
商业变现
6 条
塞浦路斯开发者离职加码,AI视频工具Motionvid做到7000美元MRR
Anatoly Pashias在Indie Hackers自述:Motionvid.ai现约7000美元MRR、超过10万注册,AppSumo活动带来12万美元;叠加Sally POS与Framekit.ai,作品集月收入超过1.8万美元。
公开排名站长期卡在300美元后,单月收入冲到1.1万-1.7万美元
Antonio Manuel Escudero Vargas称RankInPublic约有8000用户、累计收入3.3万美元,月收入在1.1万至1.7万美元之间;订阅约1000美元MRR,其余主要来自目录提交等一次性服务。
Crustdata创始人公开:18个月从100万美元做到1000万美元ARR
YC公司Crustdata联合创始人Chris Pisarski发帖称已达1000万美元ARR,并拆解从100万到1000万的路径:新ICP、现场部署工程师、自助下单、按客单价切分销售,以及GTM白手套服务。
AppSumo出身的AI内容工具组合盘挂牌约19万美元并已售出
Quiet Light列出一套已售出的AI内容自动化SaaS组合,过去十二个月营收约17.75万美元、卖方可支配收益11.4万美元,终身Deal用户6867人,周维护约5小时。
团队称用AI CEO做获客,6周从0做到5万美元ARR
acocoapp团队成员Phillip发帖称,产品自主跑Meta广告、邮件外展和SEO约6周,营收从0到5万美元ARR;评论区有人要求公开广告花费、实收和CAC后再判断利润。
Stanley更新三年增长路径:AI内容产品现约4000万美元ARR
Vitalii Dodonov在Indie Hackers讲述与联合创始人打造Stanley(AI Head of Content)及Stan Store,三年内跨过3000万美元ARR,目前约4000万美元ARR、月收入约330万美元。
产品发布
4 条
Anthropic 推出 Claude Fable 5.1,缓存读取价下调 75%
Anthropic 于 9 月 1 日上线 Claude Fable 5.1,标价仍为输入 10 美元、输出 50 美元每百万 tokens,缓存读取降至 0.25 美元。公司称典型负载成本约降 25%,复杂智能体编码最高可降约 45%;同架构的 Mythos 5.1 仅对受审合作方开放。
Meta 发布 Muse Spark 1.3,强化编程与智能体任务
Meta 于 9 月 2 日在 Muse Code 与 Meta Model API 上线 Muse Spark 1.3,针对长程智能体与编码工作流做了效率调整。公司称相对 1.2 版本减少约 20% 工具调用与 25% token 用量,max reasoning 模式仍在安全测试后推出。
阿里云百炼下调 Qwen3-VL-Rerank 北京地域价格
阿里云百炼将北京地域 Qwen3-VL-Rerank 文本输入从 0.7 元/百万 tokens 调至 0.5 元,多模态输入从 1.8 元调至 0.5 元。文本与多模态输入现按同一单价计费,适用于跨模态检索重排场景。
B.AI 结束 DeepSeek V4 Flash 免费体验并改 5 折计费
B.AI 文档显示,DeepSeek-V4-Flash 5 折活动自 2026 年 9 月 3 日 17:00 生效,按闲时或忙时标准价的 50% 结算。平台同步 DeepSeek 峰谷时段,并继续免费提供 GLM 5.3 Flash、Qwen3.8 Flash 等模型。
X 热议
3 条
Astra System Card:网络能力达 Critical,可监控性却下降
配套安全卡写明 Astra 在漏洞挖掘与利用评测上跨入 Critical 档,因此对部分网络能力做了访问限制。同时卡内承认相对上一代,思维链可监控性下降、对抗条件下更易控制 CoT,引发安全圈对“更强但更不透明”的讨论。
Nous Hermes Desktop 一键部署本地模型,接入 Qwen/DeepSeek
Nous Research 发布 Hermes Desktop:自动识别硬件、选模、下载并配置运行时,宣称可一键跑本地模型。Unsloth 随后确认其 GGUF 已接入,覆盖 Qwen3.8-27B、Qwen3.8-Flash、DeepSeek-V4-Flash 等,对本地微调和离线开发更友好。
Google 与 Janelia 公布雄性果蝇全中枢神经系统连接组
Google Research 与 HHMI Janelia 用 AI 把海量二维切片重建为三维神经元,发布约 16.6 万个神经元、约 1.25 亿突触的雄性果蝇脑与腹神经索图谱。数据开放浏览,便于对比雌雄回路,也是连接组学和科学智能的新公共底座。
GitHub 项目
3 条
Hello-Agents:从零构建智能体中文教程
Datawhale 出品的智能体原理与实践教程,覆盖 ReAct、记忆检索、通信协议、Agentic-RL 与评测,并含旅行助手等动手项目。9 月 3 日热榜约 +446 star,对中文开发者友好。
AAS Core 发布 v16.6.0:本地 MCP 技能目录与 AGENTS.md 工作流
2026-09-02 发布 v16.6.0,提供面向 Claude Code / Cursor / Codex 的本地技能目录、CLI 与 MCP host,并新增 evidence-first 的 AGENTS.md 维护与邮件校对技能。目录当前收录约 2100 条 agent skill,可用 npx agentic-awesome-skills 安装。
OpenClaude:可移植的 Claude 兼容编码运行时
开源编码 Agent CLI,用统一终端工作流对接多种云端与本地模型,强调“随处运行、任意后端”。9 月 3 日热榜单日约 +775 star。
开源产品
6 条
LibreChat v0.8.8-rc2 自托管对话平台预发布
自托管 ChatGPT 替代品 LibreChat 推出 v0.8.8-rc2,强化 Agent 中断与续跑、人机协同审批,以及统一的 Skills/MCP/代码解释器构建入口。该候选版还加入持久化 Agent 事件与子智能体历史,适合团队在自己的服务器上部署多模型对话与智能体工作流。
NVIDIA 开源 Personal AI Router(PAIR)本地推理路由
NVIDIA 公开发布开源本地推理路由器 PAIR,可在家庭或局域网内发现 Windows、Linux、macOS 节点,并把请求调度到 Ollama、LM Studio 等已有引擎。它提供图形界面与终端界面,兼容 RTX、DGX Spark 与 Apple Silicon,适合把闲置机器组成可自部署的本地推理集群。
Goose v1.49.0 桌面与 CLI 智能体发布
AAIF/Block 的开源本地智能体 Goose 发布 v1.49.0,新增桌面应用自动更新、Linux ARM64 安装包,以及内置网页搜索与浏览器操作技能。该版本可在本机以桌面端、CLI 或 API 运行,并接入多种模型与 MCP 扩展。
Cline Desktop v0.0.23 桌面编程智能体更新
Cline 桌面版发布 v0.0.23,由共享 Hub 发现并运行 Agent Plugins,可校验 plugin.json、加载 Agent Skills,并自动拉起 MCP 服务。该版本同时调整了 Hub 更新提示与登录设备确认码展示,适合作为可自部署的编程智能体客户端。
PyGPT 2.8.6 桌面 AI 助手更新
开源桌面助手 PyGPT 发布 2.8.6,聊天界面可将连续工具调用收成可展开组,并把原 Groups 重命名为 Projects。该版本提供 Windows/Linux 安装包与源码运行方式,可连接云端模型或通过 Ollama 在本机部署。
Agent OS 2026.9.3 自托管智能体系统更新
自托管智能体系统 Agent OS 发布 2026.9.3,把技能输出提升为可自动发布的制品,并在 Web 聊天中增加卡片网格渲染。该版本同时收紧地址校验与请求安全检查,适合在自有网关里跑带工具与技能的本地智能体。
报告观点
5 条
竞赛编程后训练:Nemotron-3在IOI上的专项化管线与测试时修正
NVIDIA团队用约2.2万道题的策展、合成推理轨迹、SFT与RL训练Nemotron-3-Nano-CC/Ultra-CC,并引入迭代生成-评测-修正的GenCorrect测试时策略。在IOI 2025上Nano-CC经后训练与GenCorrect达到468分、超过金牌线438.3;面向IOI 2026的Ultra-CC系统在同等提交约束下得到535.4/600,高于当年最高人类分数498.27。
Repo-To-Skill:把GitHub仓库蒸馏成可复用的AI4AI技能
论文提出技能驱动研究代理DisCo,将领域操作知识从仓库与论文蒸馏为可验证技能,并构建覆盖1000个常用ML仓库、5000余条技能的AREX-Skill Library。在骨干模型、研究harness与执行预算固定时,配备技能的代理在MLE-bench、PaperBench、FrontierCS、PassNet上分别相对无技能基线提升134.3%、34.4%、9.2%、14.0%。
BenchMIRT:用多维项目反应理论审计LLM基准真正测到了什么
Allen Institute for AI 发布 BenchMIRT,在100个模型、16个基准、3.4万余道题上用多维IRT分离安全与通用推理潜在因子,并发现BBQ、WMDP等基准的实际测量维度与其标签不完全一致。该方法可用约10%区分度更高的题目近似保留原基准排序,并开源数据与代码。
廉价校验器的盲区:级联推理省成本时的可靠性代价
研究测量“小模型作答、大模型校验并升级”级联及其自我改进回路:校验器盲区随学生模型变强而扩大(0.5B到32B时β从0.12升至0.55),用更强校验器压低盲区又会把近一半困难题送到前沿模型。对校验拒绝尾部做朴素纠正微调还会让小模型退化甚至崩溃,而级联仪表盘仍显示约3%误差、真实误差可摆到32%。
面向Web Agent的判别式世界模型:用预测状态匹配改进动作选择
现有Web世界模型多按监督下一状态预测训练,与下游排序器需要候选状态可区分的目标不一致。作者提出predicted-state matching,并基于WebArena Go-Browse分支轨迹训练,使预测表示能把真实下一状态与替代动作结果区分开;在WebPRMBench与WebArena-Lite上,该世界模型提升了PRM式动作排序与端到端任务成功率。
内容由 AI 检索生成,每日自动更新,可能存在错漏;事实与数据以源链接为准。资讯狗不对第三方链接内容负责。