08.18
2026-08-18 · 星期二 · 06:18 截稿 · 覆盖近 1-3 天动态
YC批次有位创始人把年化运行率从零做到约70万美元,合同以季付或半年付为主,续约率全满。语音AI公司Wispr Flow同步完成2.8亿美元B轮,估值20亿美元,连续四个季度收入增长超150%。另一边,稀有书商把AirTag塞进订单,追踪到亚马逊仓库后发现书籍被切断书脊快速扫描再销毁,直接送去喂AI训练。
商业变现
3 条
YC S26批次创始人从0到70万美元年化运行率
YC合伙人分享一位S26批次创始人在批次期间从0做到约70万美元年化运行率,合同以季付或半年付为主且续约率100%。该案例展示了AI相关B2B合同的快速变现路径。
语音AI公司Wispr Flow完成2.8亿美元Series B融资
Wispr Flow宣布完成2.8亿美元Series B融资,估值20亿美元,连续四个季度收入增长超150%,产品已被超1万家企业使用。公司同时发布自研语音模型Canto以提升准确率。
游戏AI工具ForgeGUI用户数突破50万
17岁创始人Giulio Greco的AI游戏资产生成平台ForgeGUI宣布用户数达到50万。该产品面向Roblox等平台开发者,采用免费+积分订阅模式,此前已完成种子轮融资。
产品发布
2 条
X 热议
7 条
Claude Code新增/design技能,支持CLI中UI设计工作流
ClaudeDevs宣布/design技能进入研究预览,可在CLI和桌面生成可编辑艺术板。用户挑选并调整后,由Claude直接实现UI代码。
OpenAI下一代模型Astra传闻本周推出,侧重智能体群与数学
多方消息称OpenAI本周可能发布Astra系列,强调多agent协同和数学能力。官方名称尚未确认,有人猜测或为GPT-6。
记者用AirTag追踪稀有书籍,揭秘亚马逊销毁图书用于AI训练
稀有书商在批量订单书籍中放入AirTag,追踪到亚马逊拉斯维加斯LAS8仓库的VGT3设施。员工切断书脊快速扫描后销毁原书,用于AI训练数据。
Mistral采用中国开源模型GLM,引发欧洲AI主权讨论
被视为欧洲AI主权代表的Mistral选择接入智谱GLM模型。评论指出可能带来指令偏见、网络安全风险以及与中国模型的价格竞争压力。
Anthropic Mythos 2训练完成但暂不发布,内部继续推进Mythos 3
据SemiAnalysis Dylan Patel透露,Anthropic的Mythos 2已完成训练却决定不对外发布。内部迭代循环仍在运行,聚焦后续改进。
谷歌购买破产航空公司Spirit Airlines企业内部数据用于AI训练
谷歌计划支付约1000万美元获取Spirit Airlines去标识的邮件、Teams消息、表格与运营数据。这些真实企业场景数据将用于模型训练与产品开发。
OpenAI宣布与SB Energy等合作建设俄亥俄大型AI数据中心
OpenAI将利用Pike County的PORTS-Pike设施获取算力,合作方包括SB Energy、NVIDIA和美国能源部。项目预计带来大量建设与运营就业,并提供社区投资与学生Codex额度。
GitHub 项目
2 条
claude-toolbox:Claude Code agentic 工作流配置集合
最小设计的 Claude Code 与 Codex 配置集合,包含预配置 MCP servers、11 个 workflow skills、sub-agents 与 multi-language 支持。
Claude Rules MCP Server:484 skills + 17 rules 服务
通过 HTTP 与 stdio 暴露 484 个 Claude Code skills 和 17 条 rules 的 MCP server,支持 progressive disclosure 与 token 认证。
开源产品
3 条
Hermes Agent 0.20.2 发布,完善多连接与 MCP 支持
该补丁版本整合大量更新,新增桌面多连接注册表支持本地与远程网关,以及 MCP 一键安装与健康检查。提升了 CLI、网关与会话稳定性。
InvokeAI 6.14.0 RC2 发布,支持 Wan 2.2 视频生成
新增基于 Wan 2.2 的文本转视频与图像转视频功能,并支持多 GPU 并行生成。同时加入多种新图像模型与 Intel XPU 支持。
Libre WebUI 0.23 发布,强化会话安全与团队协作
引入可撤销服务器端会话、作用域 API 密钥、管理员组管理与 OpenID Connect 登录。同时修复 Work 功能问题,统一支持 SQLite 与 PostgreSQL 部署。
报告观点
4 条
ScienceFlow:面向ML研究与科学发现的长时程智能体框架
提出ScienceFlow端到端自动研究智能体,通过可恢复的可执行工作空间状态与ESTRA转换机制支持长时程探索与修订。在完整MLE-bench上取得70.22% Any-Medal分数,显示状态管理与自适应执行对自主研究的关键作用。
Twin:用测试时数字孪生玩未知游戏
提出Twin系统,由前沿编码智能体在测试时编写可执行世界模型,用于完成持续学习任务如ARC-AGI-3游戏。提供完整重放与代码,展示测试时世界模型推理的潜力。
诱导无奖励评判准则以降低智能体评估中的过度计分
提出RubricForge方法,从真实轨迹诱导评判准则,改善无奖励评估中的忠实度,降低失败轨迹被过度计分的问题。在Tau-Bench与WebShop等基准上验证有效性。
LLM服务一年回顾:工作负载演进、缓存与负载均衡
分析Chutes一年生产LLM服务轨迹,揭示工作负载演变、用户-模型交互模式,并计划公开完整轨迹。为缓存策略与负载均衡研究提供真实生产数据基础。
内容由 AI 检索生成,每日自动更新,可能存在错漏;事实与数据以源链接为准。资讯狗不对第三方链接内容负责。