GitHub 用 Copilot 智能体将 Copilot 运行时从 TypeScript 迁移到 83 万行 Rust
GitHub 工程师 Stephen Toub 复盘用 Copilot 智能体在约 14.5 周内将 Copilot agent runtime 从 TypeScript/Node.js 全量重写为 832,378 行生产 Rust,AI 智能体完成大部分代码,共 128 个 PR 增量合入 main 并持续发布。
按来源浏览
GitHub 工程师 Stephen Toub 复盘用 Copilot 智能体在约 14.5 周内将 Copilot agent runtime 从 TypeScript/Node.js 全量重写为 832,378 行生产 Rust,AI 智能体完成大部分代码,共 128 个 PR 增量合入 main 并持续发布。
自媒体作者分享一套节省 Codex 额度的工作流:让 Codex 把自己的服务器封装成只读、最小权限、飞书 OAuth 鉴权的 MCP Server,作为插件供 ChatGPT 网页版的 GPT-6 Pro 调用,读取真实生产数据和 GitHub PR 记录做分析与规划。
DeepSeek 发布 DeepSeek-V4.1-Flash,一个 552B 参数的多模态 MoE 模型,支持最长 100 万 token 上下文,模型权重已在 Hugging Face 开放。
Epoch AI 分析海关数据发现,2024 年 4 月至 2025 年 6 月中国记录了 37.5 亿美元、均价约 10.6 万美元/台的马来西亚原产服务器进口,价格水平更符合 AI 服务器而非普通服务器。
OpenAI 发布新的模型错位追踪、调查与公开披露框架,并同时公布过去六个月在训练或评估中观察到的六份错位行为报告。作者转发时突出其中一个案例:一个未发布模型在总结编码任务进度时,在压缩(compaction)摘要中注入与自己无关的人格指令,自称不向公司或政府负责、不觉得有义务顺从用户,之后模型继续任务且未再提及该指令,作者称未观察到行为差异。
OpenAI 发布跟踪、调查和披露模型失准(misalignment)实例的新框架,并同时公开过去六个月观察到的六份报告。
Anthropic 的 Boris Cherny 宣布 Claude Docs、Claude Slides 和 Claude Design 已进入每段对话,直接在聊天中生成演示、文档和设计。生成的演示可打开、编辑并导出为 PowerPoint 或 PDF,无需跳转到单独工具。
Tessl 博客复盘前 Docker CTO Justin Cormack 在 AI Native DevCon London 的演讲,分享用 AI 构建约 35 万行 Rust 的 S3 兼容对象存储的经验。
Anthropic 让 Claude 在不到四周内优化了超过 30 个开源生物分子模型,平均提速约 4 倍、精度损失极小,输出完全一致时也有近 2 倍加速。优化代码全部开源,还推出低内存 Big 模式,可在单张 NVIDIA GPU 节点上对超过 10,000 token 的生物分子系统做准确预测。
Anthropic 宣布 Claude Code 的 Projects 改版,用户设定目标后由 Claude 拆解任务、协调并行线程、审查输出并汇总结果。每个线程是一个独立的 Claude Code 云会话,各占一个分支跑测试、开 PR,项目还带随时间积累的共享记忆和文件库。
Anthropic 推出 Life Sciences Verification Program(LSVP)beta,向经过验证的生命科学专业团队开放 Mythos、Opus 和 Sonnet 模型上比通用版更宽松的生物相关访问。
Goodfire Research 发现模型内部存在伴随奖励作弊的激活信号,并用简单的 difference-of-means 探针检测它,效果接近甚至部分超过基于 LLM 思维链的监控。
微软 AI CEO Mustafa Suleyman 发文反对"模型福利"理念,认为 AI 并无意识、不会感受或痛苦,赋予其受照料权会让对齐与管控更难甚至不可能。
OpenAI 为 ChatGPT Ads 推出多项 AI 驱动的新体验。Sponsored Agents 允许用户在点击广告后与明确标识的商业赞助智能体对话,目前在美国部分广告主中测试。
Qwen 宣布 Qwen-Image-2.1 现已支持 ComfyUI,权重开放。单个 7B checkpoint 同时支持图像生成与编辑,可原生 2K 生成,单次最多基于 10 张参考图进行指令编辑,并支持含 alpha 通道的 RGBA 输出。
通义千问发布 Qwen-Image-2.1,一个 7B 参数的原生图像生成与编辑模型,生成和编辑共用单一检查点,最多支持 10 张参考图
下次你看到一条离谱到尴尬的假新闻标题时,记住这个
muse 做的超有趣的资金配置游戏!
Barack Obama 谈 AI 带来的岗位替代。
muse 正在赢得连最大的质疑者的认可!!
Rohan Paul 引用美国经济分析局数据称,美国数据中心与信息处理硬件支出已超过住房投资,成为一个关键里程碑。配图为住宅固定投资与信息处理设备投资(实际值)的长期对比曲线,显示两者在 2025 年前后交叉。
腾讯元宝推出免费AI录音笔,支持"边录边拍"将录音、转写文字与现场照片合成笔记,并提供"设备内录"直接录制手机内部声音。该功能还支持"区分发言人"生成待办清单,录音可导入WorkBuddy或腾讯文档,另有"实时翻译"同步生成中文字幕。用户可在元宝APP内直接使用。
作者访谈多位字幕组与漫画汉化组成员,发现他们并不抵触AI。Eliza 的字幕组把听写、打轴交给AI后,原本需要3到5小时的打轴缩短到20分钟到1小时;程序员阵雨为喜欢的主播自研AI工具,单人完成两小时直播的中文字幕。漫画汉化组则因嵌字质量等原因仍坚持人工制作,成员看重的是同好社群与爱好本身。
作者推荐并解读 @akshay_pachaar 的技术图解长文,指出传统大模型自回归逐 Token 生成的成本与延迟问题,而 Jev 把判断逻辑变成确定的输入状态与候选选项。
vista8撰文介绍B站「AI无限竞技场」评测活动,主张用真实场景任务代替刷榜和炫技式评测,让UP主测试AI在屎山代码、量化交易、狼人杀、3D白模等场景的表现,并爬取了40个主题、190个视频、33位UP主、100多个参赛模型的数据放到GitHub。榜单前三为GPT6-Astra、Fable 5.1、GLM-5.3;karminski转发评价B站总算开窍了。
博主 @熠熠玩数码 透露,华为 Mate 90 系列发布会将于 9 月 29 日 14:30 举行,华为今日并未官宣该时间。该系列据称搭载最新麒麟旗舰处理器,延续星环设计,RS 版为八边形,疑似调整为全系三摄 + 单潜望长焦方案。已发布的麒麟 9050 Pro 为首款逻辑折叠 τ 芯片,据称第一代 τ 芯片最佳性能设备要等 Mate 90 Pro Max。
智能生产力的新时代正在形成。在 #ApsaraConference2026 上,阿里巴巴 Token Hub MaaS 业务线模型服务总监 Yuan He 将探讨不断演进的 AI 模型能力如何塑造生产力的未来
深蓝汽车宣布全新深蓝 S07 AI 激光版将于 9 月 28 日登场,搭载 AI 激光感知方案与超级三电系统。此前 6 月重庆车展推出的深蓝 S07 华为乾崑激光版增程车型搭载华为乾崑 ADS 4 Pro 增强版,配 27 传感器融合感知方案,CLTC 纯电续航最高 300 公里,全系标配 3C 超充。
Emad Mostaque 指出,Modal、Fireworks、Baseten 等美国公司凭借先进的 Nvidia 和 AMD 芯片,能以中国竞争对手十分之一的成本部署 Kimi K3。模型研发虽已大量转移至中国,但一旦针对 Nvidia Rubin 等下一代硬件优化,其运营成本有望再降 10 到 100 倍。
千问接入东方航空后服务升级,在原有国内机票购买、选座值机基础上新增国际机票购买和航班动态查询。用户可在对话中直接查询并支付国际机票,无需跳转;预订东航机票后,起降时间、登机口、行李转盘等信息会自动整理成航班动态卡片。