AI 资讯
每天一轮 AI 检索:GitHub 项目、开源产品、X 热议、报告观点——条条带源链接,死链不上桌。
NO.006
07.29
星期三
独立开发者用AI从零做出产品并开始产生经常性收入的案例集中出现,金额从几百美元到两万英镑不等,同时Stripe数据显示这类创始人中位数收入在下降、顶尖部分却在加速。开源侧月之暗面放出了总参数2.8T的多模态Agent模型,配套的大规模执行环境也一并开源。协议层面MCP完成无状态核心更新,Claude产品线已跟进支持。
20 条
Open Design 0.16.0 发布:本地优先 AI 设计工作空间
该开源项目发布 0.16.0 版本,强化自动更新、长任务处理、模型配置、图像生成与导出能力。支持桌面端与本地部署,可对接多种编码 Agent 生成设计系统与视觉产物。
Millwright:Rust自托管LLM路由
基于Rust的自托管LLM路由器,位于AI应用与模型提供商之间,支持OpenAI兼容、Anthropic与Bedrock,具备成本策略、缓存亲和与支出追踪功能。
PyroDash:成本高效的令牌级小大语言模型协作推理
提出令牌级SLM与LLM协作框架,SLM通过控制令牌决定何时请求LLM协助,无需额外路由器或重训。在数学推理任务上可在降低成本的同时保持较高准确率。
Splice:面向 AI Agent 的语义浏览器 MCP Server
最新提交于 7 月 22 日,提供语义观察、验证动作、多会话隔离与多代理协调工具,可用 claude mcp add 直接接入 Claude Code,降低幻觉并支持安全审计。
ego-lite:支持用户与AI Agent并行工作的浏览器
专为AI Agent设计的浏览器,允许Agent在独立Spaces中执行任务而不干扰用户标签页,支持直接JavaScript调用以减少token消耗。可继承Chrome登录状态,适用于各类编码Agent。
Claude 语音模式升级,支持更强模型与工具调用
Anthropic 更新 Claude 语音模式,现可使用更强大的模型并在对话中访问已连接工具,支持更多语言。该功能正在公开测试中向移动端、桌面和网页推出。
DeepSeek 正式停用旧版 API 模型名称
DeepSeek 于 2026 年 7 月 24 日 15:59 UTC 起停用 deepseek-chat 与 deepseek-reasoner 模型名称,相关请求将失败。开发者需迁移至 deepseek-v4-pro 或 deepseek-v4-flash。
AI英语口语App PracticeMe以4万美元被收购,近30天收入3900美元
独立开发的B2C AI英语口语辅导App PracticeMe在TrustMRR平台以4万美元成交,近30天收入3900美元,交易倍数0.9x,从挂牌到成交用时69天。
NEXUS:面向工具使用LLM智能体的结构化运行时安全监控
NEXUS结合确定性安全规则、参数级检查与校准风险评分,对工具调用智能体实施允许、阻止、确认或修订的干预策略。在多个基准上取得较高F1并保持极低延迟开销。
Buzz:人类与AI智能体共享的开源协作工作区
Block 发布的基于 Nostr 协议的自托管协作平台,支持人类与AI智能体在同一频道中协作、代码托管与工作流。可完全自部署,模型无关。
comfyui-mcp:ComfyUI 的本地优先 MCP 服务器与 Claude Code 插件
提供 100+ 工具与数十个 AI skills,支持用自然语言编辑 ComfyUI 工作流、生成图像/视频/音频,并管理模型与自定义节点。过去 48 小时内有多次提交与版本更新。
Google 发布 Gemini 3.6 Flash 等新模型
Google 推出 Gemini 3.6 Flash、3.5 Flash-Lite 与 3.5 Flash Cyber,提升 token 效率与代理工作流性能,并降低部分定价。模型已在 Gemini API 与相关平台可用。
Serena:面向编码Agent的MCP语义工具包
提供符号级代码检索、编辑、重构和调试能力的MCP工具包,充当Agent的IDE。支持40多种语言服务器,提升大代码库中的Agent精度。
Composite-Bench 显示 GLM-5.2 在开放权重模型中表现突出
新发布的 Composite-Bench 长期计算机使用基准测试中,GLM-5.2 在开放权重模型中领先 Kimi K3,并超越多数闭源模型。
Information Discernment in Large Language Models:LLM信息辨别能力评估框架
研究提出Learn2Discern框架,量化LLM对来源可靠性与真值更新的辨别能力。跨13个模型的大规模实验显示模型在来源与真值辨别上接近随机,并释放数据集供后续对齐研究使用。
Aptean《2026商业AI状态报告:清算时刻》
调查1535名商业领袖,AI采用率达98%,但仅46%整合到核心工作流,数据质量和集成是主要障碍。垂直专用AI被视为关键,混合使用通用与垂直AI的企业在多项KPI上表现更优。
Skill Store 市场发布安全审计版 Agent Skills
aiskillstore/marketplace 在 7 月 22 日左右更新至 v0.1.13,提供经过安全审计的 Claude Code 与 Codex 可用 Agent Skills,支持一键安装并自动发现。仓库包含技能源文件、审计报告与 CLI 工具。
AG-UI:Agent与前端应用交互协议
轻量事件驱动协议,标准化AI Agent与用户界面的连接方式,支持实时双向状态同步、生成式UI与上下文 enrichment。
基于关键神经元隔离剪枝的LLM后门防御
提出DeCNIP方法,通过表征分析识别并剪枝后门关键神经元来防御攻击。在多个开源LLM上显著降低攻击成功率,同时保留大部分正常性能。
OpenViking v0.4.11:面向 AI Agent 的开源上下文数据库
火山引擎开源的 Agent 上下文数据库于 7 月 23 日发布 v0.4.11,以文件系统方式统一管理记忆、资源与技能,支持自部署。
内容由 AI 检索生成,每日自动更新,可能存在错漏;事实与数据以源链接为准。资讯狗不对第三方链接内容负责。