Claude Code 禁用 1M 上下文设置的实际效果反馈
作者反馈持续使用 Claude Code 禁用 1M 上下文的设置,效果上未发现明显折扣,但 Token 消耗确实变慢。
首页已经看过的不重复列。下面从更早的内容继续,可以一直往下滚。
作者反馈持续使用 Claude Code 禁用 1M 上下文的设置,效果上未发现明显折扣,但 Token 消耗确实变慢。
Apple 发布全新健康与健身功能,Apple Watch Series 12 和 Apple Watch Ultra 4 引入 Health Sensing System,支持每 5 秒测心率、HRV 测量频率提升至 24 倍、每日 0-10 的 readiness 评分。
Apple 发布 iPhone 18 Pro 和 iPhone 18 Pro Max,配备带可变光圈的 48MP Fusion 主摄、A20 Pro 芯片和新一代 vapor chamber,eSIM 版 iPhone 18 Pro Max 视频播放最长可达 45 小时。
作者以 GPT-6 Astra 的視覺操作表現為切入點,提出其能力躍升更可能來自 GUI 環境、軟體操作影片預訓練與強化學習的結合,並將 Agent 競爭的 Scaling Law 概括為對交互環境的擴展。
SafeEvolve 通过轨迹驱动的 Harness 演化与两阶段 SFT-RL 训练,让 Agent 的安全机制与模型 Policy 从真实执行经验中协同进化,在 AgentDojo 和 AgentHarm 上显著降低攻击成功率并提升任务效用。
Datawhale 发布九月组队学习活动,涵盖 LLM 推理与显存优化、Agent 工程实践、AI 工具应用、算子开发和深度学习等 11 门课程,强调动手实践与开源协作。
Anthropic 官方开发团队建议在换模型或缩短输入之前,先检查输入层缓存、指令层规则匹配与推理层 Effort 设置,排除为无价值工作付费的情况。
这是一则严肃的招聘启事,团队正在寻找对 AI 有热情、真诚、聪明的年轻人,共同打造生活方向的 AI Native App,并构建一个效率与自由交织、Agent 与人融合的小团队。
OpenAI 发布 GPT-6 Astra,已在 ChatGPT Work、Codex 和 API 提供,定价为每百万输入 token $10、输出 token $50。
8 月 AI 产品趋势显示,用户从网页转向手机系统和浏览器侧边栏等入口,办公智能体如阿里千问办公和腾讯 WorkBuddy 增长迅猛,头部格局向 B 端和入口集中,垂直赛道冷热不均。
实测讯飞星火 X2.5,通过 3D 粒子交互网页、财报拆解、论文实证、电商数据筛查和游戏官网设计等任务,验证其在代码与智能体能力上的交付水平,并探讨 Agent 从聊天走向交付、国产算力从适配走向全链路闭环的行业趋势。
Hugging Face 联创 Thomas Wolf 回应 OpenAI 用下一代模型(强于 GPT-6 Astra)的 agent 群组证明 Navier-Stokes 千禧年问题猜想为假的结果,称其令人印象深刻。
在深圳的物理 AI 峰会上,四家出海企业分享了从众筹爆款到全球化交付的真实经历,强调热度和生意是两回事,真正的商业信号藏在交付、渗透率和复购中,而非炫酷的 Demo 或概念炒作。
2026 年 8 月 AI Web 数据显示,千问办公和 WorkBuddy 等办公智能体增长爆发,整体网站访问下降,表明 AI 使用正从打开网站向各类入口深度渗透。
作者发现 OpenAI 新推出的 Sketch 画板只在 GPT 网页端可用,Codex 和 ChatGPT 聊天界面都没有。
路透社报道称,DeepSeek 已聘请中信证券筹备科创板上市,目标今年递交 IPO 申请、明年挂牌,募资将用于算力基建、模型研发、芯片自研与人才激励。公司正推进新一轮融资,目标估值约 5000 亿元人民币,此前 6 月完成约 74 亿美元首轮外部融资,投后估值超 500 亿美元;2026 年前 7 个月营收约 4.75 亿元。
OpenAI 因 Astra 需求空前导致算力紧张,Codex 用户频繁收到算力不足提示,Tibo 称正加紧调配算力,若无法缓解可能暂停新的 Pro 订阅。
蚂蚁百灵发布首个金融增强开放模型 Ling-3.0-flash-Fin,瞄准投资研究完整工作流,并同步开源金融搜索 Agent 评测基准 FinFIRST,推动金融 AI 从“会回答”走向“能干活”。
作者判断未来员工离职会带走一批 AI 员工,对公司影响巨大,因此 AI 资产治理正在成为必然趋势。
OpenAI 推出 ChatGPT Images 2.5 提升生成速度与编辑精度,并公布对 Navier‑Stokes 千禧年难题的构造性解法,展示 AI 在图像和高阶数学领域的最新突破。
HAM-VLN 通过四层分层记忆和深度几何绑定的世界图,将大模型推理与记忆检索合并,令零样本视觉语言导航在三大基准上刷新 SOTA,且上下文 Token 削减 67%。
花叔用 800 字故事让视频 Agent「够搭」自动拆成 17 场戏、生成设定图和视频片段,拼出 5 分钟成片,并验证了成片后局部修改不推倒重来的能力,认为 AI 视频创作进入更可控的「单反级交付时代」。
EMNLP 2026 论文提出 SCOPED-Hiring 框架,揭示 LLM 多智能体招聘系统中即使最终录用率看似公平,决策轨迹中仍存在隐藏的不公平,并通过诊断驱动的 Fair Skills 修复将公平负担降低 72.3%。
清华团队开源的教育 AI Agent OpenMAIC 登上联合国教科文组织讲台,其 v1.0 版本通过课程级规划、教学法 Skill 和名师课堂复刻等功能,将 AI 备课从单课生成推向整门课程的深度交互,并揭示教育正成为 Token 消耗的下一个大场景。
《经济学人》分析指出,AI 目前在美国已创造约 100 万个新岗位,净增效应远超因 AI 导致的裁员,就业增长主要由高技能 AI 岗位及基础设施带动的蓝领岗位驱动。
腾讯开源 teamai-cli,用 Git 与 PR 审核流程把 skills、规则、hooks、MCP 同步到 10 种 agent,解决「最会用 AI 的人经验烂在自己电脑上」的问题。
ChatGPT 发布了 Images 2.5 版本,主打更快的生成速度、更高的图像保真度和基于评论的编辑功能。
本文解释了 GPT-6 Astra 推理等级(低到最高及 Ultra)的含义与区别,指出推理等级是模型的努力程度而非模型能力,并针对 Plus 和 Pro 用户给出了省 Token 的档位选择建议。
OpenAI 发布 ChatGPT Images 2.5 图像模型 — 点击查看完整日报
OpenRouter 推出 US In-Region Routing,请求经 us.openrouter.ai 在美国境内解密并只路由到美国 provider 端点,eu.openrouter.ai 同理服务欧盟。