AI 资讯
每天一轮 AI 检索:GitHub 项目、开源产品、X 热议、报告观点——条条带源链接,死链不上桌。
NO.048
09.12
星期六
开源权重今天被直接拿来对账:Moonshot把规模化收入押在Kimi的API和订阅放量上,DeepSeek则放出552B的V4.1-Flash,用非对称激活去压KV cache和agent缓存成本。应用层这边,百万美元ARR已经不够当成绩单,讨论转向留存和可替换风险;独立开发者则继续用具体数字说话,Marc Lou摊开36个产品累计300万美元和DataFast约3.08万美元MRR,glasa用提前养好的名单换来首周1.3万美元。编码工具同步改作业形态,Cursor用协调器分派多Agent做长周期开发,Cognition把SWE-2接到Devin上压执行成本,Claude Code给插件和Skill做开关对照评测。
4 条
Anthropic 推出 Claude Fable 5.1,缓存读取价下调 75%
Anthropic 于 9 月 1 日上线 Claude Fable 5.1,标价仍为输入 10 美元、输出 50 美元每百万 tokens,缓存读取降至 0.25 美元。公司称典型负载成本约降 25%,复杂智能体编码最高可降约 45%;同架构的 Mythos 5.1 仅对受审合作方开放。
Meta 发布 Muse Spark 1.3,强化编程与智能体任务
Meta 于 9 月 2 日在 Muse Code 与 Meta Model API 上线 Muse Spark 1.3,针对长程智能体与编码工作流做了效率调整。公司称相对 1.2 版本减少约 20% 工具调用与 25% token 用量,max reasoning 模式仍在安全测试后推出。
阿里云百炼下调 Qwen3-VL-Rerank 北京地域价格
阿里云百炼将北京地域 Qwen3-VL-Rerank 文本输入从 0.7 元/百万 tokens 调至 0.5 元,多模态输入从 1.8 元调至 0.5 元。文本与多模态输入现按同一单价计费,适用于跨模态检索重排场景。
B.AI 结束 DeepSeek V4 Flash 免费体验并改 5 折计费
B.AI 文档显示,DeepSeek-V4-Flash 5 折活动自 2026 年 9 月 3 日 17:00 生效,按闲时或忙时标准价的 50% 结算。平台同步 DeepSeek 峰谷时段,并继续免费提供 GLM 5.3 Flash、Qwen3.8 Flash 等模型。
1 条
5 条
腾讯混元推出Hy4 preview轻量版
腾讯混元9月1日将Hy4 preview权重从约1.5TB压至约214GB,并放出GGUF量化包。压缩后长文理解与多轮检索接近原版,可在llama.cpp、vLLM等框架及异构设备上部署。
Anthropic发布Claude Fable 5.1与Mythos 5.1
Anthropic于9月1日上线Fable 5.1,输入输出价仍为每百万token 10/50美元,缓存读取降至原先约四分之一,并放宽部分安全拦截。Mythos 5.1面向受信项目开放,面向编码与长程知识工作。
Meta上线Muse Voice Transcribe实时转写模型
Meta Superintelligence Labs于9月1日发布实时语音感知模型Muse Voice Transcribe,支持流式ASR、20人以上说话人分离与多语代码切换。开发者可通过Meta Model API调用,定价约每千音频分钟3美元。
Inception推出扩散推理模型Mercury 2.5 Preview
Inception于8月31日上线Mercury 2.5 Preview,以并行扩散生成替代逐token解码,宣称在常规GPU上可达约1107 token/秒。OpenRouter标价约0.04/0.15美元每百万token,并提供限时折扣至9月8日。
Runway发布界面世界模型Solaris
Runway于8月31日公布Solaris,基于Gen-4.5按帧实时生成可交互界面,无需预写应用代码。目前以研究预览与早期访问形式推出,面向无代码交互界面实验。
内容由 AI 检索生成,每日自动更新,可能存在错漏;事实与数据以源链接为准。资讯狗不对第三方链接内容负责。