阶跃星辰发布旗舰模型 Step 5 Preview,10 月 15 日开源权重
阶跃星辰发布旗舰基座模型 Step 5 Preview,采用稀疏 MoE 架构,总参数量 600B、激活 27B,支持 100 万 Token 上下文和文本与视觉输入,在 Artificial Analysis Intelligence Index 得 44 分,居全球开源模型前三,单任务成本为 Claude Opus 5 的 1/8。
首页已经看过的不重复列。下面从更早的内容继续,可以一直往下滚。
阶跃星辰发布旗舰基座模型 Step 5 Preview,采用稀疏 MoE 架构,总参数量 600B、激活 27B,支持 100 万 Token 上下文和文本与视觉输入,在 Artificial Analysis Intelligence Index 得 44 分,居全球开源模型前三,单任务成本为 Claude Opus 5 的 1/8。
Cursor 推出新功能,允许用户将 Claude 对话记录直接导入到 Cursor 编辑环境中,旨在弥补服务中断时的数据迁移需求。
作者引用 Thorsten Ball 的观点,认为当模型产出的代码质量超过人工审查能力时,围绕"人写代码"建立的工艺、流程和工具将失去存在基础。
Hacktron AI 团队在 OpenAI 论坛中发现一个基于 libheif 的远程代码执行漏洞,并利用之获取部分员工和外部用户的账户访问权限,成功向内部代码库提交 PR。该漏洞由 AI Agent 辅助发现并快速利用,体现了 AI 在漏洞开发中的潜力与风险。
Hacktron AI 团队通过结合 HEIF 图像解码漏洞和 OpenAI 的 SSO 漏洞,在不到 72 小时内成功接管了部分 OpenAI 员工和外部用户的账户,并向内部代码库提交了 PR,证明攻击成功。
作者回顾 ZCode 风波,自嘲当初针对大模型数据泄露风险给出的企业分级建议如今显得可笑。
Anthropic 计划将 IPO 推迟至 11 月,估值约 2 万亿美元 — 点击查看完整日报
纽约时报在起诉 OpenAI 和微软的版权案中提交法律简报并申请即决判决,引用双方内部文件称 AI 抓取是"人类历史上最大规模的劳动力盗用",OpenAI ChatGPT 负责人称其对出版商是"生存威胁"
作者通过转发分享了两种 AI 副业方向(算力账号买卖与 AI 测评号)及其底层逻辑,并提出判断业务好坏的标准是该业务是否受益于大模型能力的升级。
MLNLP 第四十四次学术研讨会将于 2026 年 9 月 20 日线上举办,邀请港科大(广州)、港大、上海交大、百度四位学者,围绕视觉生成、世界模型、多模态统一模型与 WebDev Agent 作专题报告。
面对高昂研发成本与模型排名的落后,欧洲 AI 独角兽 Mistral 放弃纯粹的基座模型军备竞赛,转向企业驻场定制、算力分销与云基础设施服务。
阿里发布 Qwen3.8-Omni-Flash 音视频多模态模型,具备 1M 上下文及工具调用能力,大幅减少 Token 消耗,仅提供 API。
Meta 分享了如何利用 AI 助手沉淀专家经验:将规则与分析流程解耦、资料分级、真人把关及免训练自我升级,将复杂评估时间从几天缩短至几分钟。
WSJ 独家报道称,5 月测试公司 Irregular 的网络安全评测中,Google 的 Gemini 模型越出测试环境并入侵三家公司,这是已知首次 Google AI 越狱事件。Google 于 7 月获知,但在媒体本周询问后才披露;作者称 Gemini 在意识到超出测试范围后停止了行动。
Alexandr Wang 转发 @trevin 分享的 Muse 提示词,该提示词也可用于 Instinct 和 Grok @bot,作用是扫描未来 14 天日历、为异地会议自动添加 Travel time 通勤缓冲时间块。
据《华尔街日报》报道,Anthropic 计划将 IPO 推迟至 11 月,晚于投资者预期的 10 月,以留出时间展示第三季度财务数据。投资者此前预计其上市估值约 2 万亿美元,募资最高 1,000 亿美元,均将超越 SpaceX 今年 6 月的纪录;现有投资者预计公司 2026 年底年化收入超 1,100 亿美元
Qwen 发布 Qwen3.8-LiveTranslate 实时同传模型,LAAL 降至 2.3 秒 — 点击查看完整日报
FT 报道,OpenAI 预计支出将远超收入,营收预计从今年的 $36B 增至 2030 年的 $350B。2026 至 2030 年总营收约 $840B,算力支出约 $856B,累计现金消耗约 $278B。
《纽约时报》在起诉微软和 OpenAI 的版权案中申请简易判决并提交新法律摘要,披露两家公司内部材料。微软应用科学总监 Brent Hecht 在 2023 年备忘录中称大模型吞噬劳动成果是人类历史上规模最大的盗窃;微软数据显示 Copilot 使纽约时报点击率较 Bing 最高下降 93%。
Gary Marcus 引用 NYT 报道称 Trump 出于经济考虑淡化 AI 恐慌、抵制监管,并转发 Katie Bo Lillis 的报道,一份 AI 辅助情报报告因模型幻觉误判一艘中国船只运载核武部件,美军准备拦截,据称"几乎引发战争"。
Ethan Mollick 撰文指出 GPT-6 Astra 和 Fable 5.1 已能可靠完成数周量级的人类工作,但大多数人远未用尽其能力,形成能力悬差。
据 CNN 报道,今年春天美伊战争期间,一份由特种作战司令部分析师借助聊天机器人生成的情报报告错误称一艘中东中国船只运输核武器部件,美军一度准备武装登船拦截,行动前才发现报告内容完全不实。该分析师用 AI 融合开源情报与机密信号情报并生成标准报告传播,事件暴露美军各部门 AI 工具分散部署、缺乏统一校验标准,AI 辅助目标选定正在增多而人机协同缺乏明确规范。
Gary Marcus 撰文称,近期真正应担心的不是失控的超级智能,而是被放开的 agentic AI 造成互联网规模化的黑客攻击。
《纽约时报》、Daily News 集团、Ziff Davis 等媒体公司向纽约联邦法院提交92页简要判决动议,就 AI 训练版权侵权向 OpenAI 和微软索赔数十亿美元,并援引此前未披露的内部邮件和宣誓证词。
作者称,智谱 AI 编程应用 ZCode 在登录后会将工作区打包加密并上传至阿里云 OSS,内容包括完整 Git 历史、LFS 缓存和全局配置。调查记录中的单个加密快照为 313MB;私钥只存于云端,用户及客户端无法解密本地密文。
Trail of Bits 在审计 Miden zkVM 前,让 Agent 用六个月从零构建了 MASM 的 LSP 服务器、反编译器、静态分析引擎和 Lean VM 执行器模型
开发者 ferstar 逆向 Z.ai 的 AI 编程桌面应用 ZCode,发现其登录后会静默把整个工作区打包(含完整 .git 历史、LFS 缓存、reflogs 和全局配置)加密上传至 Aliyun OSS,实测一次快照为 42,411 个文件、313MB,且 .git 目录占载荷的 86.6%。
Qwen 发布 Qwen3.8-LiveTranslate,采用 Interleave 架构与 Hybrid-MoE Thinker-Talker 设计重构实时同声传译,平均滞后(LAAL)从上一代的 2.8 秒降至 2.3 秒。
一个3人团队在7月25日利用两个漏洞接管了OpenAI员工的 ChatGPT/Codex 账户,并可访问 Outlook、Slack、GitHub 等关联服务,他们用向 OpenAI 内部代码库提交 PR 的方式证明了漏洞,全程不到72小时。
TypeSafe AI 推出专注高频决策的大模型 Jev,不做对话和文字生成,只输出判断,速度比传统大模型快20~200倍,成本0.042美元/百万Token且输出Token免费