Token Plan 禁止应用后端、自动脚本与非交互批处理
qwen3.8-max-preview ID 现已路由到正式版 qwen3.8-max,但个人 Token Plan 服务条款仍限制自动脚本、应用后端和非交互批处理。
没有匹配观测。
qwen3.8-max-preview ID 现已路由到正式版 qwen3.8-max,但个人 Token Plan 服务条款仍限制自动脚本、应用后端和非交互批处理。
Kimi 官方要求完整回传历史 thinking 内容,并警告会话中途从其他模型切换到 K3 可能明显降低生成稳定性。
Kimi 的发布说明称 K3 对不明确意图或简单问题有时会执行超出需要的操作。
Meta 官方模型页将 Muse Spark 1.1 标为公开预览,并限定当前开发者区域。这意味着全球团队不能把发布公告直接等同于可采购的生产服务。
xAI 建议在长会话中设置 prompt_cache_key 或 x-grok-conv-id;否则请求可能落到冷缓存服务器并按完整输入价格计费。
Anthropic 的 Fable 5 防护说明明确要求 30 天安全留存,并注明该模型不支持 ZDR。该限制会直接影响受监管数据和内部敏感代码的部署边界。
小米延长了 UltraSpeed 封闭测试,但只对获批用户开放,且没有公布固定 GA 时间。
一项预印本研究在其测试设置中报告 Fable 5 的最坏情形攻击成功率为 6.1%。该数字只适用于论文的方法与样本,不能外推为真实世界总体风险率。
Qwen3.5-OCR 出现在阿里云中国区目录,但全球 Model Studio 目录没有同等可用端点。跨区部署需要单独确认。
加拿大隐私专员办公室认定 X/xAI 推出相关图像生成能力时未设置充分隐私防护,后续才增加措施。该结论针对已部署产品,不等同于对 API 基础模型能力的判定。
Moonshot 快速入门将 K2.7 Code 描述为始终思考的工具调用模型。长代理循环可能因此增加端到端延迟和输出成本。
官方集成文档要求应用识别 stop_reason=refusal,并通过服务端、SDK 或手动方式回退到其他 Claude 模型。
MiniMax 企业 API 价格页显示,512K 至 1M 输入范围的输入、缓存和输出单价均为 512K 以内费率的两倍。页面当前不再支持“限量供应”的说法。
美团变更日志列出 Chat、Thinking 与 Omni 系列的六个旧模型 API 于 5 月 29 日停止服务,并记录 LongCat-2.0 于 6 月 30 日上线。开放权重仍可下载不代表旧 API 连续性。
xAI 的 Grok 4.20 模型卡分别报告 30% AgentHarm 违规率、33% AgentDojo 提示注入成功率,以及在系统提示覆盖设置下 32% 的误用违规率。这些数字只适用于模型卡所述测试。
7 月 14 日一则 r/grok 讨论中,一名用户称其通过 Grok CLI 进行普通 JavaScript 编码会话约两小时后触及 SuperGrok 4.5 周额度;同一回复肯定了速度,但认为完成任务需要更多提示,并质疑套餐额度透明度。该单一公开线程只反映消费者订阅/Grok CLI 体验,不等同于 xAI API 限额,也不是总体样本。
一则近期 r/grok 帖文称当前 Grok 更常给出错误信息,讨论区也出现写作质量下降的反馈。单帖及回复只能作为待验证线索。
TechCrunch 汇总多位安全研究者反馈,称部分正常代码审查和安全资料阅读请求会触发 Fable 的防护或回退。
QwenCloud 已确认 qwen3.8-max-preview 仍可调用,但会自动路由到正式版 qwen3.8-max,扣费与用量统计也按正式版计算。
Moonshot 已公开 Kimi K3 完整权重、模型卡与 Kimi K3 License;先前“权重尚未发布”的观测不再是当前风险。
原记录描述的是截止日前的迁移风险,不能在截止日后继续显示为当前负面事实。当前别名解析目标和可用模型 ID 需要以实时 API 模型清单重新核对。
来源能够支持的范围只是一名用户当时无法选择 15 秒生成;它不能证明旧资产被删除。7 月 15 日确认后纠正原范围并转入历史。
官方 Seedream 5.0 Pro 页面现已提供 Get API 入口,并链接到 BytePlus Ark 对应模型条目。先前“API 可用性未确认”的负面观测已被一方证据纠正,转入历史。
该社区帖称模型可能回退或难以确认实际版本,但模型自报与单一用户推测不能证明当前路由状态。7 月 15 日确认时没有找到足够证据继续作为当前风险,转入历史。
6 月 12 日暂停访问,7 月 1 日恢复全球可用。中断已经结束,保留为供应连续性历史记录。