08.21
2026-08-21 · 星期五 · 06:19 截稿 · 覆盖近 1-3 天动态
Anthropic 把 Computer Use、Skills API 和 Files API 正式放开,生产环境里智能体操作浏览器、文件和技能调用的路径更直接了。xAI 的 Grok 4.6 同步进了 Amazon Bedrock,带着 50 万上下文和可调推理力度。Claude Code 这边本地技能包密集出现,覆盖 Kubernetes 监控排障、AI 写作痕迹检测和 App Store 预检,工具链在往实际工作流靠。独立团队也在继续跑,有人靠 SEO 加 AI 搜索服务 12 个月做到超 20 万美元月经常性收入,营销花费不到 1.8 万。
商业变现
2 条
产品发布
7 条
Anthropic 正式推出 Computer Use、Skills API 与 Files API
Anthropic 将 Computer Use(新增浏览器工具)、Skills API 和 Files API 转为正式可用,支持生产级智能体构建。Computer Use 现支持单轮多动作,可降低任务调用次数与成本。
xAI Grok 4.6 登陆 Amazon Bedrock,支持 50 万上下文窗口
Amazon Bedrock 现已支持 xAI 的 Grok 4.6,提供 500K 上下文窗口与可配置推理努力级别,并支持跨区域推理配置以提升吞吐量。
Liquid AI 发布 LFM2.5-DSpark 投机解码模型,推理速度最高提升约 3.2 倍
Liquid AI 为 LFM2.5 系列三个模型发布 DSpark 草稿检查点,在 H100 上最高实现 3.18 倍吞吐量提升,设备端最高约 2.87 倍,输出质量保持不变。
Slack 推出 Slack Code,支持团队与 AI 编码智能体协作
Slack 发布 Slack Code 功能,允许团队在专用代码频道中与 Claude Code、Devin、GitHub Copilot 等 AI 智能体共同编写、审查并部署代码。
Meta 发布 Meta AI macOS 桌面应用,支持屏幕共享与系统级语音输入
Meta 推出原生 macOS 桌面应用,支持窗口共享获取上下文、系统级语音输入,并连接 Instagram、Facebook 广告与 Google Workspace 数据。
Murf AI 发布 Falcon 2 文本转语音模型,定价每分钟 0.01 美元
印度公司 Murf AI 公开推出 Falcon 2 TTS 模型,延迟低于 100 毫秒,支持 150 多种语音与 35 种语言,价格约为同类产品的五分之一。
Meta 将 vibe-coding 游戏应用 Pocket 向美国用户开放
Meta 实验性应用 Pocket 现向美国用户推出,用户可通过文本提示生成可交互小游戏(gizmos)并分享至信息流,支持触控与倾斜交互。
X 热议
7 条
Anthropic 正式上线 Claude Academy 免费学习平台
Anthropic 发布 Claude Academy,提供从入门到 Claude Code、MCP、API 等免费课程与教程,支持进度保存与徽章。面向个人、开发者、学生与企业用户开放。
OpenAI 启动 AI Futures 博客,聚焦权力集中风险
OpenAI Strategic Futures 负责人 Dean Ball 发布 AI Futures 博客首篇文章,讨论 AI 政策中最棘手的风险领域——权力集中问题。
AT&T 将更多 AI 负载转向开源模型以控制成本
AT&T 表示开源模型已处理约 40% 员工 AI 查询,预计升至 60%-70%,通过 LiteLLM 路由使编码成本下降 56%。日处理约 450 亿 tokens。
Grok Bot 演示常驻 AI 员工能力与低成本优势
演示展示 Grok Bot 作为独立身份 AI 员工,可自动调度代理、购物、发帖、修复代码并提交 PR。在 Cursor bench 上以更低成本达到接近顶尖模型表现。
Elon Musk 推荐 Grok Build 最简入门方式
Elon Musk 转发并称赞直接访问 grok.com/?mode=build 即可使用 Grok Build,无需脚本或下载。该工具近期更新了工作流目录与多代理并发性能。
Karpathy:代理能力让拆除现有抽象层更具吸引力
Andrej Karpathy 指出,随着 AI 代理能处理大量数学、繁琐工作与验证,许多为有限人类智能设计的软件抽象层正变得可以拆除。
Terence Tao 新论文讨论 AI 证明生成对数学实践的冲击
菲尔兹奖得主 Terence Tao 新论文指出,AI 可能让数学证明生成变得丰富,从而对数学界现有价值观、贡献认定与实践框架造成冲击。
GitHub 项目
5 条
kstack:面向 Kubernetes 监控与排障的 Claude Code 技能包
Claude Code skill pack,集成 Kubetail、Helm、Trivy 等工具,提供集群状态、日志、安全审计、成本分析等命令。支持自然语言调用并尊重本地 kubeconfig 与 RBAC。
Deep Agents:开箱即用的Agent Harness
基于LangChain与LangGraph构建的意见化Agent框架,内置规划、文件系统、子Agent与上下文管理能力。支持任意支持工具调用的LLM,可快速扩展。
sloptrim:本地检测 AI 写作痕迹的 Claude Code 插件
Claude Code 本地插件/skill,在 agent 保存散文文件时即时评分 AI 写作模式,仅用 Python 标准库,无网络与模型依赖。支持多种文档格式并提供 doctor 检查命令。
appstore-preflight:App Store 提交前检查的 Claude Code 技能
Claude Code skill,检查 .xcarchive 中的隐私清单、purpose strings、entitlements 与截图等,输出 BLOCK/FLAG 等结果,不宣称合规。适合 iOS/macOS 发布工作流。
claude-code-plugin-tracker:实时索引 Claude Code 插件与 hooks 的工具
自动扫描 GitHub 并每 15 分钟刷新 Claude Code 扩展、hooks、插件目录,生成 Markdown 目录与 JSON API。2026-08-20 有更新。
开源产品
2 条
报告观点
5 条
SkillGate:在长期智能体中训练策略内技能选择
识别并解决技能选择中的选择器信用饥饿问题,通过分离执行与技能命名令牌的信用通道。在五个智能体基准上将9B策略成功率从40.8%提升至53.2%,同时减少误导技能暴露。
AI后训练中缺失的是什么:实证分析
分析公开后训练轨迹发现智能体策略早期锁定并仅做局部调整。经验脚手架提升执行能力但策略仍静态,额外推理计算对困难任务几乎无增益,指出需机制支持策略再评估。
超越转录:检测潜在多智能体通信中的隐蔽协调
提出Verifiable Latent Alignments框架,通过激活感知监控与引导多智能体间隐藏状态通信通道。在受控拍卖基准上,顺序监控对同质智能体AUROC达0.993,并实现有效白盒引导以降低合谋行为。
分组随机机器:精度而非能力作为AI系统前沿度量
主张精度(输出一致性)是当前前沿区分指标,而非平均能力。定义分组度量与测试 harness,可低成本测量系统可靠性并指导人工-AI协作调整。
调谐随机机器:人机工程的系统工程师操作模型
提出将LLM栈映射到系统工程的七原则操作纪律,以持久化专家对LLM错误的纠正。通过实践案例展示如何处理随机生成与配置失败,形成错误闭环。
内容由 AI 检索生成,每日自动更新,可能存在错漏;事实与数据以源链接为准。资讯狗不对第三方链接内容负责。