01政策相关
5ChatGPT 与 Gemini 双双突破 10 亿用户
2026-08-11OpenAI 与 Google 的聊天机器人均跨过 10 亿用户门槛。OpenAI 在 8 月 6 日的博文中披露 ChatGPT 月活用户超 10 亿,Google CEO 皮查伊则宣布 Gemini 月活达 10 亿,成为其史上增长最快的产品。OpenAI 称 ChatGPT 在 7 月周活用户已达 10 亿,而 Gemini 在 2 月月活为 7.5 亿,增长势头更猛。
研究人员发现可读取ChatGPT等模型加密推理过程的API漏洞
2026-08-11Alexander Panfilov团队发现OpenAI、Anthropic、Google等主要AI提供商API存在漏洞,可读取推理模型的加密思考过程。扫描约7000条公开会话发现62个API密钥、33个邮箱和33个密码。通过越狱,Anthropic的Haiku 4.5可逐字转写Opus 4.8的原始推理;解码10000条推理轨迹的API成本约720美元。
Gemini月活破10亿,成谷歌增长最快产品
2026-08-11每月已有超过 10 亿人使用 @Geminiapp 激发新想法、完成工作。这是我们有史以来增长最快的产品,也是第 14 个达到 10 亿用户里程碑的产品。 感谢 @JoshWoodward 和整个 Gemini 团队,也感谢每一位与我们同行的伙伴--未来还有更多精彩!
消息称英伟达开发万亿参数开源 AI 模型 Nemotron 4,目标挑战全球顶级
2026-08-11英伟达正在研发新一代开源 AI 模型系列 Nemotron 4,规模最大的模型预计至少拥有 1 万亿个参数,旨在与全球最先进的开源模型竞争。英伟达尚未确定发布日期,最终训练也未完成,员工认为该模型最早可能在今年秋末准备就绪。此举意在通过开放模型生态扩大 AI 应用范围,并推动市场对其 GPU 算力的需求。
消息称 Anthropic 最快今年 9 月上市,向投资者淡化 AI 模型竞争等挑战
2026-08-11Anthropic 正与潜在投资者接触,为可能成为史上规模最大的 IPO 做准备,计划今年 9 月或 10 月初正式上市。公司估值高达 9,650 亿美元,年化收入已超 470 亿美元,并淡化来自中国 AI 企业的竞争影响。Anthropic 还计划拓展 AI 在医疗和生物学领域的应用,但尚未公布具体 IPO 定价方案。
02行业前沿动态
8Mojo 1.0 正式发布:为生态系统增长提供稳定基础
2026-08-11Mojo 语言正式发布 1.0 版本,提供稳定、可用于生产环境的语言基础,自 2023 年首次发布以来已发展成通用语言。自开源标准库以来,近 200 名贡献者合入超 1,100 个拉取请求,改动超 200,000 行代码。
Runway Seedance 2.5 上线,支持50角色参考
2026-08-11完整阵容,完整曲目,一次生成一个。 Seedance 2.5 已在 Runway 上线,支持 50 个独特角色参考,以及最长 30 秒、与音乐同步的片段。点击下方链接即可开始使用。
ChatGPT 桌面端支持导入其他智能体工作数据
2026-08-11你现在可以将其他智能体的工作内容与 ChatGPT Work 和 Codex 保持同步。 可导入项目、聊天记录、技能和插件,查看导入历史,并可在设置中选择开启自动更新。 现已在 ChatGPT 桌面应用中提供。
Gemini 助力 Database Migration Service 加速 PostgreSQL 迁移
2026-08-11Google Cloud 在 Database Migration Service(DMS)中推出由 Gemini 驱动的 AI 辅助代码转换,可将 Oracle 或 SQL Server 的存储过程、触发器和自定义函数转换为 PostgreSQL PL/pgSQL 代码。
SGLang 宣布 Day-0 支持 NVIDIA Nemotron 3.5 Lightning
2026-08-11SGLang 宣布对 NVIDIA Nemotron 3.5 Lightning 提供 Day-0 支持,该开源模型为 30B 总参数、3B 激活参数的混合专家架构,支持最长 1M token 上下文,可从 Hugging Face 下载 BF16 和 NVFP4 权重。模型支持 MTP、DFlash、DSpark 三种投机解码技术,并可通过 OpenAI 兼容 API 接入智能体工作流。
NVIDIA 推出 Nemotron 3.5 Lightning,加速本地智能体任务
2026-08-11NVIDIA 发布 Nemotron 3.5 Lightning,一款可定制的开源 30B 混合专家(MoE)模型,专为常驻智能体设计。相比同类开源模型,其 token 生成速度最高提升 4 倍,任务完成时间缩短 30%。该模型采用开放权重,支持用户微调以匹配特定任务,并可在 RTX PC、DGX Spark 及 Jetson 等设备上运行。
Ling-3.0-tiny 正式开源:1.3B 激活参数如何进入真实任务
2026-08-11蚂蚁百灵开源 Ling-3.0-tiny,一款总参数 7.9B、推理时仅激活 1.3B 参数的原生混合推理模型,同步提供 BF16、FP8 和 INT4 三个版本。
ZCode全面升级:Goal、Subagents、Remote Control与闲时任务四大功能上线
2026-08-11ZCode针对GLM深度优化,今日上线Goal、Subagents、Remote Control与闲时任务四大功能。在Z.ai Code Bench测试中,GLM-5.2搭配ZCode较搭配Claude Code任务整体通过率高2.39%;ZCode缓存命中率超98%,叠加1.5倍限时额度加成后,GLM Coding Plan整体使用量接近常规额度的1.8倍。
04论文研究
11AMIE 研究医疗 AI 系统首次展示实时临床视频问诊能力
2026-08-11Google Research 与 Google DeepMind 推进医疗 AI 系统 AMIE,实现实时临床视频问诊,首次在此场景展示专家级 AI 能力。该系统基于 Gemini 和 Project Astra 构建,可解读视觉与听觉线索、引导虚拟体格检查并实时诊断推理。随机研究中,临床评估者对 AMIE 的病史采集、诊断准确性等核心能力给予好评,患者演员也更偏好视频体验。
Apple Silicon 与 macOS 虚拟机:借助 Llama.cpp 实现 11-16 倍的 LLM 推理加速
2026-08-11研究团队为 macOS 虚拟机中的 Metal 能力查询构建进程级兼容层,使 llama.cpp 能选用更新的 Metal 内核。在 M1 Ultra 上,TinyLlama 1.1B 的提示处理速度提升 11.08 倍、token 生成提升 16.36 倍,接近裸机性能的 98%;Gemma 4 12B 的提示处理与生成速度分别提升 7.20 倍和 14.54 倍。
统一 Radix 缓存:为混合模型前缀缓存构建单一树结构
2026-08-11LMSYS 团队提出 Unified Radix Cache,用单一 token 键控 radix 拓扑统一管理混合模型的 FULL、SWA 和 MAMBA 组件缓存,各组件独立执行路径、滑动窗口和检查点复用语义。
Designing for Ethical AI: HCI Feature Considerations to Improve Fairness and User Experience in AutoML use for Human Res…
2026-08-11arXiv:2608.07477v1 Announce Type: new Abstract: This thesis examines the fairness of Automated Machine Learning (AutoML) tools in human resource hiring systems through the combined lenses of regulation, business strategy…
Cross-Model Humor Preference Modeling with Cards Against Humanity
2026-08-11arXiv:2608.07481v1 Announce Type: new Abstract: This paper investigates whether one large language model can approximate the humor preferences of another in a controlled Cards Against Humanity-style task. Two models - GP…
From Human-Centered Design to Human-AI Collaboration: Why the Future of HCI Still Starts With People
2026-08-11arXiv:2608.07482v1 Announce Type: new Abstract: Generative AI is reshaping HCI work by accelerating brainstorming, writing, prototyping, and interface generation. However, faster production does not automatically produce…
Generative AI as Support, Not Replacement, in Human-Centered Design
2026-08-11arXiv:2608.07483v1 Announce Type: new Abstract: Traditional human-centered design is grounded in human needs, behaviors, and experiences, especially throughout the development of products and services. Recent advances in…
Using the gameplay and user data to predict and identify causes of cybersickness manifestation in virtual reality games
2026-08-11arXiv:2608.07484v1 Announce Type: new Abstract: Virtual reality (VR) is an imminent trend in games, education, entertainment, military, and health applications, as the use of head-mounted displays is accessible to everyo…
Humour as Resistance: Visceralizing the Environmental and Social Impact of AI through Humour-based Creative Practices
2026-08-11arXiv:2608.07485v1 Announce Type: new Abstract: The growth of AI does not come without cost. While we hear about the economic costs, the environmental and social costs are often obfuscated by mainstream narratives, and e…
A Symbolic Machine Learning Approach for Cybersickness Potential-Cause Estimation
2026-08-11arXiv:2608.07486v1 Announce Type: new Abstract: Virtual reality (VR) and head-mounted displays are constantly gaining popularity in various fields such as education, military, entertainment, and bio/medical informatics. …
SafeStudent Driving: A Multimodal Driver-Safety System to Support Teen Drivers Using Computer Vision and Mobile Sensing
2026-08-11arXiv:2608.07487v1 Announce Type: new Abstract: Teen drivers face disproportionately high crash rates, often due to inexperience and inconsistent attention to basic traffic rules. SafeStudent Driving addresses this probl…
05技巧与观点
8将 GitHub Copilot 置于中间人(MitM)代理之后后,我学到了什么
2026-08-11作者通过 mitmproxy 对 VS Code 中的 GitHub Copilot 进行中间人代理拦截,逆向分析其网络流量与内部架构。文章指出这些 AI 应用普遍基于 Electron 构建,共享相似的网络栈,因此探测结果可迁移至其他同类应用。作者借此揭示了 Copilot 的运行时行为,并分享了配置代理的具体步骤。
Ryan Greenblatt:人类级AI或于2032年前通过递归自我改进催生失控超级智能
2026-08-11Dwarkesh Patel与Redwood Research首席科学家Ryan Greenblatt探讨递归自我改进(RSI)的可能性:一旦AI达到人类顶级专家水平,可能在一年内实现相当于4-5年的AI进展,Ryan的中位预期是2031年自动化AI研发。双方还讨论了超级智能的对齐对象、奖励黑客行为是否会升级为AI联手接管世界等风险。
跨会话传消息后,Codex 和 Claude 如何重构 vibe coding 工作流
2026-08-11Codex 和 Claude 新增跨 Session 传消息功能后,新对话可从之前所有对话中选择可用消息,省去交接文档和 git 备份。作者据此重构工作流:主对话守住目标与决策,分支对话独立探索新想法,完成后由主对话读取完整记录。Codex 通过复制会话 ID 精确寻址,Claude Code 则用内置 session management 搜索对话历史,但桌面端只能搜索当前可访问的会话记录。
OpenAI 用 Astra 模型攻克 10 道数学难题,数学家既兴奋又担忧
2026-08-11OpenAI 宣布其未发布的 Astra 模型解决了 10 道长期悬而未决的数学难题,涵盖球体堆积、纠错码、非 sofic 群存在性等领域,并发布超 250 页论文及 Lean 验证结果。
用 ComfyUI API 实现 MiniMax-H3 多模态视频与音频生成流水线
2026-08-11本教程演示如何以 ComfyUI 为无头推理后端,构建端到端的 MiniMax-H3 视频生成工作流。通过 Python 直接构建执行图,支持文生视频、首尾帧条件生成和参考图像条件生成,并自动根据 GPU 显存选择 quality、balanced、squeeze 三种权重配置。流水线涵盖模型自动下载、节点模式校验、音视频联合解码与进度监控,无需图形界面即可复现实验。
编写智能体时,哪种编程语言最合适?
2026-08-11针对"动态语言比静态语言更省 LLM token"的流行说法,作者用 GPT-5.6 Sol 让智能体实现 zstd 解码器进行实测。结果显示,medium 努力度下动态语言表现更好,ultra 下静态语言反而更优,且此前评测存在测试路径错误等缺陷。作者认为,琐碎任务上的性能无法推广到更大问题。
微信小微AI帮写与AI点评内测:朋友圈最后一点人味正在消失
2026-08-11微信基于小微推出朋友圈AI帮写与AI点评内测功能,前者可根据图片和已写文字生成3条朋友圈文案,后者可长按文字生成评价或快捷评论。作者认为这两个功能将AI置于社交核心位置,可能鼓励AI内容、破坏朋友圈自2012年确立的"记录美好生活"基调。公众号端小微还常驻首位,自动总结常看公众号文章,作者担忧这会反向影响创作者内容生产。
每个类别都有赢家:AI 时代 SaaS 龙头的估值溢价
2026-08-11SaaS 估值整体承压,但每个细分赛道都跑出了 AI 龙头:CrowdStrike 以 34.4x 前瞻收入领跑安全(中位数 3.9x),Cloudflare 32.6x 对 17.5x,Shopify 11.3x 对 1.4x。
