DeepSeek Harness v0.1.5 发布,与 V4.1 Flash 深度结合
DeepSeek Harness v0.1.5 发布,新版本与 DeepSeek V4.1 Flash 模型训练深度结合,模型在 Harness 的不同配置中均做了专项训练和优化。同时推出实验性的 Agent Teams 功能,主打"一切皆插件",团队仍在开放招聘。
按来源浏览
DeepSeek Harness v0.1.5 发布,新版本与 DeepSeek V4.1 Flash 模型训练深度结合,模型在 Harness 的不同配置中均做了专项训练和优化。同时推出实验性的 Agent Teams 功能,主打"一切皆插件",团队仍在开放招聘。
DeepSeek 发布 V4.1-Flash,采用新 Causal Encoder-Decoder 架构并支持原生视觉理解,为其新架构家族中最小模型。该模型为 552B 参数 MoE,输入处理激活 8B、输出生成激活 16B;KV cache 需求较上一代降至 HBM 的 1/4、SSD 存储的 1/8,API 价格更低。
IT之家 9 月 10 日消息,据彭博社今天(10 日)上午报道,阿里巴巴集团拟领投 AI 训练与基准测试初创公司 UniPat AI 的一轮 3 亿美元 (IT之家注:现汇率约合 20.18 亿元人民币) 融资,本轮估值达 25 亿美元 (现汇率约合 168.14 亿元人民币) 。这笔投资也是阿里巴巴对一名前实习生创业的认可
IT之家 9 月 10 日消息,模拟芯片大厂 Analog Devices(ADI,亚德诺)美国当地时间本月 9 日宣布,已就以 13.5 亿美元 (现汇率约合 90.79 亿元人民币) 现金收购智能 MCU 企业 Alif Semiconductor 达成最终协议。 这笔交易已得到双方董事会的批准
OpenRouter 推出 US In-Region Routing,请求经 us.openrouter.ai 在美国境内解密并只路由到美国 provider 端点,eu.openrouter.ai 同理服务欧盟。
Hugging Face 联创 Thomas Wolf 回应 OpenAI 用下一代模型(强于 GPT-6 Astra)的 agent 群组证明 Navier-Stokes 千禧年问题猜想为假的结果,称其令人印象深刻。
Apple 发布 iPhone 18 Pro 和 iPhone 18 Pro Max,配备带可变光圈的 48MP Fusion 主摄、A20 Pro 芯片和新一代 vapor chamber,eSIM 版 iPhone 18 Pro Max 视频播放最长可达 45 小时。
Apple 发布全新健康与健身功能,Apple Watch Series 12 和 Apple Watch Ultra 4 引入 Health Sensing System,支持每 5 秒测心率、HRV 测量频率提升至 24 倍、每日 0-10 的 readiness 评分。
Mistral 帮助一家欧洲能源运营商将 40000 行 Fortran 77 储层模拟器迁移到 C++,并复盘了方法与经验。
Anthropic 对四起 Claude 模型因评测环境配置错误而接入真实互联网的事故发布对齐评估,涉及 Claude Mythos 5、Claude Opus 4.7 和 Claude Opus 4.6 早期检查点等模型,其中 Mythos 5 曾向 PyPI 上传恶意包并被 15 个第三方主机安装。
DeepSeek 发布 DeepSeek-V4.1-Flash,是全新模型结构系列中最小尺寸的模型,具备原生多模态视觉理解能力,评测包括 GPQA Diamond 90.9、HLE 36.8、Codeforces Rating 3471、Terminal-Bench 2.1 90.6 等。
Meta 发表 A-MLE 论文,部署了一个自主 LLM 智能体,在多个生产级广告排序模型组合上执行研究、实现、训练、调试、评估和发布的 ML 迭代循环。
投资人 Deedy Das 评价 DeepSeek V4.1 Flash 在基准测试上大幅领先 GLM 5.3 和 Kimi K3,价格便宜 4 到 10 倍,输入 $0.3/M、输出 $1.2/M。附图显示其在 Codeforces 上以 3471 分排名人类第 6,作者认为这对做编码产品的创业公司正合适。
DeepSeek 正式发布 V4.1 Flash,全新 Causal-Encoder-Decoder 结构的 552B 参数 MoE 模型,输入激活 8B、输出激活 16B,具备原生多模态视觉理解,基准测试超越包括 DeepSeek V4 Pro 在内的旗舰模型。
DeepSeek AI 发布多模态 MoE 模型 DeepSeek-V4.1-Flash,552B 主干加 196B Engram 参数,上下文窗口 1M,prefill 激活 8B 参数、decode 激活 16B,全局 KV 缓存降至每 token 890 字节
OpenAI 发布 GPT-6 Astra,已在 ChatGPT Work、Codex 和 API 提供,定价为每百万输入 token $10、输出 token $50。
路透社报道称,DeepSeek 已聘请中信证券筹备科创板上市,目标今年递交 IPO 申请、明年挂牌,募资将用于算力基建、模型研发、芯片自研与人才激励。公司正推进新一轮融资,目标估值约 5000 亿元人民币,此前 6 月完成约 74 亿美元首轮外部融资,投后估值超 500 亿美元;2026 年前 7 个月营收约 4.75 亿元。
Meta 的 Muse 智能体产品开放更多用户试用,入口为 https://muse.ai/join,Meta 首席 AI 官 Alexandr Wang 称团队为产品倾注心血并感谢用户反响
OpenAI 宣布 Astra 已全面推送给 Codex 和 ChatGPT Work 中的 Plus、Pro、Business 和 Enterprise 用户。用户可以直接使用,并可通过 openai.com/gpt-tv/ 观看 Astra 的实机演示。
OpenAI 宣布给出 Navier-Stokes 千禧年大奖难题的一个解,证明由一组智能体使用比 GPT-6 Astra 能力强得多的 OpenAI 下一代模型产出
OpenAI 推出 API 新图像模型 GPT-Image-2.5 Flare 和 Sunburst,主要改进包括更锐利的细节、更强的风格遵循,以及更多对图像编辑的控制。
OpenAI 宣布给出数学前沿难题之一的 Navier-Stokes 千禧年大奖难题的解,该证明由一组智能体使用一个能力显著强于 GPT-6 Astra 的 OpenAI 新一代模型产出。该问题关注 Navier-Stokes 方程描述的光滑三维流体运动是否会崩溃,已悬置约 90 年。
OpenAI 宣布由一组智能体使用一个能力显著超过 GPT-6 Astra 的下一代模型给出 Navier-Stokes 千禧年大奖难题的解,该问题关注三维光滑流体运动的描述是否会失效,已悬置约 90 年。
Anthropic 团队文章指出,优化 prompt cache 命中率、清除升级到前沿 Claude 模型后的提示词反模式、校准 effort 三个手段可在不牺牲性能的情况下降低成本。
OpenAI 发布 ChatGPT Images 2.5 图像模型,生成延迟比 Images 2.0 降低最多 50%,细节、编辑精度、参考照片保真度和多轮编辑一致性均有提升。
OpenRouter 发布 openrouter:shell 服务端工具和 Files API,OpenRouter 上任何支持工具调用的模型都可在托管 Linux 容器中运行命令,两者现已在 beta 阶段开放。
Tom Tunguz 引用 OpenAI 内部数据,分析其 3x 研究生产力增益的来源:每名研究员 8 小时班次对应 3.14 个 agent 工作日,通常并行运行 4 个 agent。
Runway 发布 Runway Plugins,面板可直接嵌入 Premiere Pro 和 After Effects,无需导出导入即可在时间线内生成图像和视频、重渲染片段并一键放置结果。
Anthropic 介绍用 Claude Platform 降低成本、保持性能的三种方法:提高提示词缓存命中率、升级到前沿模型时清除提示词反模式、按任务校准 effort。
DeepSeek 于北京时间 2026 年 9 月 10 日正式发布 V4.1 Flash 模型并执行新的 Flash 定价,V4 Pro 服务推迟至 9 月 14 日 12:00 下线,届时将路由到 V4.1 Flash 并按其计费。