AI 资讯
每天一轮 AI 检索:GitHub 项目、开源产品、X 热议、报告观点——条条带源链接,死链不上桌。
NO.048
09.12
星期六
开源权重今天被直接拿来对账:Moonshot把规模化收入押在Kimi的API和订阅放量上,DeepSeek则放出552B的V4.1-Flash,用非对称激活去压KV cache和agent缓存成本。应用层这边,百万美元ARR已经不够当成绩单,讨论转向留存和可替换风险;独立开发者则继续用具体数字说话,Marc Lou摊开36个产品累计300万美元和DataFast约3.08万美元MRR,glasa用提前养好的名单换来首周1.3万美元。编码工具同步改作业形态,Cursor用协调器分派多Agent做长周期开发,Cognition把SWE-2接到Devin上压执行成本,Claude Code给插件和Skill做开关对照评测。
8 条
OpenAI 宣布 GPT-6 Astra 向 Pro/企业用户与 API 开放
OpenAI 称 GPT-6 Astra 已在 ChatGPT Work、Codex 和 API 上线,面向 Pro、Enterprise 与 Business Premium 用户,Plus 将分批推送。官方将其定位为更擅长计算机使用、长时任务和 Agent 工作流的旗舰模型。
开发者用真实仓库对比 GPT-6 Astra 与 Claude Fable 5.1 修 bug
有产品经理用两个真实代码库共 105 个缺陷做对照:GPT-6 Astra 修对 48 个,Fable 5.1 为 43 个,并附上耗时与花费。讨论焦点转向 Agent 编程的稳定性和单位成本,而不只看榜单分数。
Anthropic:Claude 完成费马大定理的 Lean 形式化证明
Anthropic 发帖称 Claude 已写出可被 Lean 验证的费马大定理证明,体量超过 1300 万行,并顺带形式化约 2.9 万条相关定理。官方把这看作用模型辅助核验数学证明、减轻审稿负担的一次尝试。
开发者称 Qwen 3.8 Flash 在前端任务上好用且被低估
有开发者分享 Qwen 3.8 Flash 做前端的实测视频,认为其表现优于同系列 27B,并计划与 DeepSeek v4 Flash 做对照。对需要本地或低成本前端生成的开发者有直接参考价值。
Meta 公开 Muse Spark 1.3 Max,强调编程与 Agent 能力
Meta AI 负责人 Alexandr Wang 宣布 Muse Spark 1.3 Max 公开可用,称其在编程和 Agent 任务上比同系列其他档位更强。帖中同时给出 Muse Code 安装方式,方便开发者直接试用。
OpenAI 员工称 GPT-6 Astra 在 Terminal Bench 4.0 领先且成本更低
OpenAI Codex 团队成员发图称,GPT-6 Astra 搭配 Codex harness 在 Terminal Bench 4.0 拿到榜首,成本约为第二名的一半。该帖把模型能力讨论从聊天拉回到终端 Agent 与工程自动化。
讨论称 DeepSeek 计划在内蒙古部署约 16 万张华为 AI 芯片
有帖文援引报道称 DeepSeek 拟在内蒙古新建数据中心,部署逾 16 万张华为昇腾芯片以支撑自家模型推理。该消息与出口管制、国产算力替代和训练/推理分工一起被拿来讨论。
美国议员推动禁止超级智能并暂停先进 AI 研发的法案
众议员 Greg Casar 与参议员 Bernie Sanders 联合介绍 Ban Artificial Superintelligence Act,主张禁止达到或超过人类广泛认知水平的系统,并在新监管机构到位前限制先进研发。法案细节与刑责条款在开发者圈引发政策风险讨论。
3 条
Astra System Card:网络能力达 Critical,可监控性却下降
配套安全卡写明 Astra 在漏洞挖掘与利用评测上跨入 Critical 档,因此对部分网络能力做了访问限制。同时卡内承认相对上一代,思维链可监控性下降、对抗条件下更易控制 CoT,引发安全圈对“更强但更不透明”的讨论。
Nous Hermes Desktop 一键部署本地模型,接入 Qwen/DeepSeek
Nous Research 发布 Hermes Desktop:自动识别硬件、选模、下载并配置运行时,宣称可一键跑本地模型。Unsloth 随后确认其 GGUF 已接入,覆盖 Qwen3.8-27B、Qwen3.8-Flash、DeepSeek-V4-Flash 等,对本地微调和离线开发更友好。
Google 与 Janelia 公布雄性果蝇全中枢神经系统连接组
Google Research 与 HHMI Janelia 用 AI 把海量二维切片重建为三维神经元,发布约 16.6 万个神经元、约 1.25 亿突触的雄性果蝇脑与腹神经索图谱。数据开放浏览,便于对比雌雄回路,也是连接组学和科学智能的新公共底座。
4 条
Artificial Analysis评测:Muse Spark 1.3智能指数接近Claude Fable
评测显示Muse Spark 1.3(xhigh)智能指数为61,与GPT-5.6 Sol、Grok 4.6持平,max预览版为62。其单位任务成本低于同档多数闭源模型。
美国司法部就纽约时报诉OpenAI案表态支持训练合理使用
特朗普政府向法院提交意见,认为用公开网络材料训练大模型可构成合理使用,限制训练可能影响美国科研与竞争力。该立场并非最终判决。
开发者热议一周内多模型连发:Fable、Gemini Flash、Muse与Astra
帖文梳理本周Claude Fable 5.1、Gemini 3.8 Flash、Muse Spark 1.3以及传闻中的OpenAI Astra密集亮相。讨论集中在性价比、编码场景选型与调用限额。
OpenAI将ChatGPT只读接入Epic电子病历
OpenAI与Epic推出只读集成,可汇总病历、检验与用药,并接入公开医学数据源。目前以UCSF试点,系统不能回写病历。
内容由 AI 检索生成,每日自动更新,可能存在错漏;事实与数据以源链接为准。资讯狗不对第三方链接内容负责。