DeepSeek 发布 V4.1-Flash,API 价格同步下调
DeepSeek 发布 DeepSeek-V4.1-Flash,是全新模型结构系列中最小尺寸的模型,具备原生多模态视觉理解能力,评测包括 GPQA Diamond 90.9、HLE 36.8、Codeforces Rating 3471、Terminal-Bench 2.1 90.6 等。
第 2 页
DeepSeek 发布 DeepSeek-V4.1-Flash,是全新模型结构系列中最小尺寸的模型,具备原生多模态视觉理解能力,评测包括 GPQA Diamond 90.9、HLE 36.8、Codeforces Rating 3471、Terminal-Bench 2.1 90.6 等。
DeepSeek 正式发布 V4.1 Flash,全新 Causal-Encoder-Decoder 结构的 552B 参数 MoE 模型,输入激活 8B、输出激活 16B,具备原生多模态视觉理解,基准测试超越包括 DeepSeek V4 Pro 在内的旗舰模型。
作者指出 Meta 在少人关注的情况下重置了 Muse 的 token 用量额度,并引用官方「重置所有人用量」的原文作为佐证。
作者反馈持续使用 Claude Code 禁用 1M 上下文的设置,效果上未发现明显折扣,但 Token 消耗确实变慢。
Anthropic 官方开发团队建议在换模型或缩短输入之前,先检查输入层缓存、指令层规则匹配与推理层 Effort 设置,排除为无价值工作付费的情况。
OpenAI 发布 GPT-6 Astra,已在 ChatGPT Work、Codex 和 API 提供,定价为每百万输入 token $10、输出 token $50。
本文解释了 GPT-6 Astra 推理等级(低到最高及 Ultra)的含义与区别,指出推理等级是模型的努力程度而非模型能力,并针对 Plus 和 Pro 用户给出了省 Token 的档位选择建议。
OpenAI 发布 ChatGPT Images 2.5,延迟降低 50%,API 提供 Flare 与 Sunburst 双模型,主打精准编辑与多轮一致性。
OpenAI 推出 API 新图像模型 GPT-Image-2.5 Flare 和 Sunburst,主要改进包括更锐利的细节、更强的风格遵循,以及更多对图像编辑的控制。
OpenRouter 发布 openrouter:shell 服务端工具和 Files API,OpenRouter 上任何支持工具调用的模型都可在托管 Linux 容器中运行命令,两者现已在 beta 阶段开放。
Anthropic 介绍用 Claude Platform 降低成本、保持性能的三种方法:提高提示词缓存命中率、升级到前沿模型时清除提示词反模式、按任务校准 effort。