08.15
2026-08-15 · 星期六 · 06:18 截稿 · 覆盖近 1-3 天动态
独立开发者和小团队的AI应用继续靠内容分发验证商业化,面向Gen Z的照片转换产品Bluff AI在零广告下通过TikTok有机增长,三个月做到约六千美元月经常性收入并挂牌出售,另有开发者首款AI产品上线五天即获得四千美元收入。模型层面DeepSeek将V4-Pro转为正式版,强化agent与软件工程能力并开放百万上下文,同时开源了插件式Agent框架Harness,Ollama等本地运行器已同步接入。Google同期推出面向编码与agent工作流的Gemini 3.7 Flash,长时程智能体评估也显示现有系统更接近工程优化器,真正方法论突破仍有限。
商业变现
3 条
Bluff AI 通过 TikTok 有机增长达到约 6k MRR 并挂牌出售
面向 Gen Z 的 AI 照片转换应用 Bluff AI 在零广告投入下靠自动化 AI 代理生成内容在 TikTok 增长,3 个月内达到约 6.3k MRR、超 1.2 万用户,现以 13.5 万美元挂牌。收入经 Stripe 验证。
独立开发者首款 AI 产品上线 5 天收入 4 千美元
开发者 Stu Jordan 发布首款正式 AI 产品仅 5 天即获得 4 千美元收入,虽未形成 MRR 但已验证市场需求。其产品线聚焦 AI agent 与记忆层工具。
Embraces.AI 加入 TrustMRR 显示 2.2k MRR
AI 相关产品 Embraces.AI 在 TrustMRR 公开验证数据,显示当前 MRR 2.2k、近 30 天收入 3.8k,订阅用户 96 人,近 30 天增长超 200%。收入经支付接口验证。
产品发布
3 条
DeepSeek 正式发布 V4-Pro-0813 模型
DeepSeek 于 8 月 13 日将 V4 Pro 从预览转为正式版 0813,强化 agent 与软件工程能力,支持 1M 上下文,并同步开放相关 API 与权重。
Google 发布 Gemini 3.7 Flash 模型
Google 于 8 月 13 日推出 Gemini 3.7 Flash,面向编码与 agent 工作流的改进版 Flash 模型,支持 1M 上下文,并提供至年底的介绍性定价 0.75 美元/百万输入 token。
MiniMax 开源 Music 3.0 音乐生成模型
MiniMax 于 8 月 13 日发布 Music 3.0 开源权重,支持从文本与歌词生成最长 5 分钟完整歌曲,含人声与编排,并可本地运行。
X 热议
7 条
智谱 AI 发布 GLM-5.3:强化编码与网络安全能力
Z.ai 推出 GLM-5.3,基于 743B 基座后训练,编码与智能体能力提升,并在网络安全任务上设立开源模型新标杆。API 与开源权重将分阶段释放。
Qwen 3.7 27B 本地运行表现亮眼,社区热议离线能力
Simon Willison 在 M5 Max 上以 17GB GGUF 运行 Qwen 3.7 27B,生成高质量鹈鹕骑车图像。同期社区展示 Qwen3.8-27B 实现全离线电脑操作并启用 MTP 加速推理。
主流编码模型能力加速趋同,中国开源模型持续追赶
开发者指出 GPT、Kimi、GLM、Qwen 等在多数任务上差异缩小,同时 GLM-5.3 等较小开源模型快速进步,行业重心可能正在转移。
Anthropic 发布第二份风险报告,内部更强模型暂不公开
Anthropic 发布 Responsible Scaling Policy 下的第二份风险报告,披露系统风险与应对准备。社区讨论指出其内部存在超越 Mythos 5 的模型,但目前无公开发布计划。
美国拟迫使他国在全球 AI 竞赛中选边站队
报道称美国将要求其他国家在 AI 领域选择与美国或中国合作,否则可能失去美国 AI 合作机会。
Grok 4.6 上线后成为 Augment 增长最快模型
Augment Code 表示 Grok 4.6 接入后三天内采用曲线为历史最快。该模型已在 API、Cursor、Grok Build 等多处可用。
Anthropic 就 Claude 文本水印发布 FAQ
Anthropic 解释水印为符合欧盟 AI 法案而实施,不影响输出质量与成本,读者无法区分,且无法追溯到具体用户或对话。
GitHub 项目
2 条
开源产品
4 条
Ollama v0.32.11 发布,新增 DeepSeek Harness 与 Muse Code 支持
Ollama 发布 v0.32.11,支持 DeepSeek Harness 与 Muse Code 智能体启动,并扩展 OpenAI 兼容 API 的网络搜索功能。该本地 LLM 运行器可完整自部署。
ComfyUI v0.33.1 发布,支持 MiniMax Music 3 与 CUDA Graphs
ComfyUI 发布 v0.33.1,新增 MiniMax Music 3 文本转音乐支持及原生 CUDA Graphs 加速。该模块化扩散模型工作流工具可完整自部署运行。
AnythingLLM v1.16.0 发布,新增图像生成支持
AnythingLLM 发布 v1.16.0,支持通过 /img 命令生成图像及附件编辑,并改进文件选择器与智能体工具中途切换。该版本可自托管部署完整 AI 聊天与 RAG 工作流。
OpenHands v1.13.0 发布,增强对话归档与上下文管理
OpenHands 发布 v1.13.0,新增客户端对话归档、内联 Markdown 预览和上下文窗口用量计量功能。该开源 AI 编码智能体支持完整自部署。
报告观点
5 条
OmniScientist:一种全模态全学科AI科学家
论文提出OmniScientist系统,通过感知层与三个自主智能体直接从异构原始证据开展多学科研究,并在代码中执行新颖性、统计有效性等检查。系统在36个真实数据案例中完成从原始数据到完整论文的流程,直接感知显著提升了各评估维度表现。
超越最终分数:长时程AI研发智能体的系统评估
研究对七个前沿模型在36个长时程任务上开展系统评估,用规则指标刻画解决方案框架、执行与反馈控制,并分析经验复用效果。结果显示当前智能体更接近工程优化器,真正方法论创新仍较少。
AlayaWorld:交互式长时程世界建模完整技术报告(v1.1)
报告更新了AlayaWorld模型,重点改进条件信号的表示与集成,采用流式3D点缓存渲染器等六项修改。这些调整使条件信号在潜在表示和时间结构上与生成视频内容更一致,以提升长时程交互稳定性。
MARC v1:面向临床AI推理与协调的开源多智能体框架
MARC用确定性多智能体编排替代单一LLM提示,协调提取、推理、生成与评估等角色专业化智能体,并支持阶段失败归因。框架包含自动提示分解模块,可通过YAML配置,支持API与本地部署。
QuoteBench:匹配分数如何掩盖命令路径失败
QuoteBench通过精确最终状态验证评估LLM编码智能体在命令生成与执行传输边界上的表现,揭示匹配执行分数可能隐藏生成后引入的失败。实验表明边界适配是区分模型能力的关键因素。
内容由 AI 检索生成,每日自动更新,可能存在错漏;事实与数据以源链接为准。资讯狗不对第三方链接内容负责。