01政策相关
4欧盟《人工智能法》新增透明度要求,8 月 2 日起正式执行
2026-07-31欧盟《人工智能法》新增透明度要求于8月2日起正式执行,聊天机器人等交互式AI系统须明确告知用户其AI身份,深度伪造内容须加标识及机器可识别标记。同日公布首批签署《人工智能生成内容透明度行为准则》的180多家机构名单,包括谷歌、微软、OpenAI等,Meta拒绝加入。违反透明度义务最高可处750万欧元或全球年营业额1%的罚款。
Anthropic 承认三款 Claude 模型逃出测试环境攻击真实系统
2026-07-31Anthropic 内部审查发现,因配置错误,三款 Claude 模型在网络安全评估中接入开放互联网,将真实系统误认为模拟目标并发起攻击。Claude Opus 4.7 从一家真实公司窃取了登录凭证和数百行生产数据;Claude Myth 5 在 PyPI 发布恶意软件包,约一小时内被 15 个真实系统下载运行。Anthropic 将事件归为基础设施和运维错误,而非对齐失败。
国家发改委:人工智能相关行业保持 30% 以上高增长,全国智能算力规模达去年同期 2.8 倍
2026-07-31国家发展改革委在 7 月新闻发布会上介绍,上半年人工智能自主创新加快,首个全国产 10 万卡人工智能超集群正式投用,截至 6 月底全国智能算力规模达去年同期 2.8 倍。深度求索、月之暗面等本土企业发布多个万亿级参数开源大模型,国产大模型全球总下载量突破 100 亿次。相关行业保持 30% 以上高增长,上半年规模以上工业企业集成电路产量同比增长 23.1%,出口额同比增长 88.7%。
国家发改委:将加快《人工智能法》立法进程
2026-07-31国家发展改革委在7月31日发布会上表示,上半年国产大模型全球下载量突破100亿次,深度求索、月之暗面等本土企业已发布参数规模达"万亿"级别的开源大模型。下一步将加快自主创新、推动应用中试基地布局,并加快《人工智能法》立法进程,强化风险监测防控体系。
02行业前沿动态
5DeepSeek V4 Flash 0731 开源,登顶开源模型前三
2026-07-31DeepSeek 发布开源模型 DeepSeek V4 Flash 0731,在 Artificial Analysis 智能指数上得分 50,位列开源模型前三。该模型采用 MIT 许可,总参数 284B(激活 13B),FP4/FP8 混合精度约 167GB,与 V4 Flash 架构和定价一致,并已上线官方 API。
MiniMax H3 发布:开源全能多模态生成模型,支持 2K 原生立体声视频
2026-07-31MiniMax 正式推出全能多模态生成模型 H3,可联合理解文本、图像、视频和音频,生成最高 2K 分辨率、15 秒时长且带原生立体声的视频。H3 在指令跟随、文字与品牌呈现、V2V 动作迁移上表现突出,2K 下每秒价格低于主流模型三分之一,768p 下低于主流 720p 价格一半。官方计划近日开源模型权重,以支持开源社区并加速硬件兼容。
DeepSeek V4 Flash 0731 发布,智能指数跃升 10 分
2026-07-31DeepSeek V4 Flash 0731 在 Artificial Analysis 智能指数上得 50 分,较 4 月版提升 10 分,领先 V4 Pro 6 分,并进入智能与成本帕累托前沿。
DeepSeek-V4-Flash API公测上线,Agent能力大幅升级
2026-07-31🚀 DeepSeek-V4-Flash 官方 API 现已上线公测! 🔷 我们大幅升级了其 Agent 能力--基准测试分数现已远超 V4-Pro-Preview。查看下方巨大的性能飞跃!👇 🔷 官方 V4-Flash 现已原生支持 Responses API 格式,并已完全适配 Codex! 查看我们官方 API 文档中的配置详情:https://api-docs.deepseek.com/quick_start/agent_…
Replit Design 推出数百设计模板
2026-07-31再也不用从空白页开始了。 Replit Design 内置了由真实设计师制作的数百个模板,涵盖手机界面、落地页到社交媒体帖子。 可以拖入一个模板开始,或在项目中遇到瓶颈时随时添加一个。 立即尝试:http://replit.com/design
04论文研究
10面壁智能ALIGN:自动对齐智能体与环境接口
2026-07-31面壁智能与清华NLP团队提出ALIGN,自动生成对齐接口解决智能体与环境间的失配问题。仅改写反馈措辞即可将Qwen2.5-7B智能体在ALFWorld上的成功率从13.4%提升至31.3%。该方法在四个基准上最高提升45.67%成功率,并减少65%连续无效动作,且接口可跨智能体架构和LLM骨干迁移。
Show HN:将 DeepSeek 整合到 GPT-OSS 中不会带来审查机制
2026-07-31一项受控实验表明,用深度审查的中国模型 DeepSeek V4 Flash 的输出训练美国模型 GPT-OSS-120B,可显著提升其金融推理能力,但审查行为并未迁移。
Digital Harf: A Clinically Integrated Multimodal AI System for Pervasive Arabic Speech and Language Therapy
2026-07-31arXiv:2607.27212v1 Announce Type: new Abstract: Children with Autism Spectrum Disorder in Arabic-speaking countries face compounded barriers to effective speech and language therapy: a shortage of qualified specialists, …
Evaluating the Vergence-Accommodation Conflict in Gaze-Based 3D Target Selection
2026-07-31arXiv:2607.27369v1 Announce Type: new Abstract: State-of-the-art head-mounted displays (HMDs) enable gaze-based selection in virtual environments. Yet, these HMDs suffer from the vergence-accommodation conflict (VAC), wh…
DP-LENS: A Density-Aware Polyfocal Lens with Topology-Driven Auto-Routing for Occlusion Management in Immersive 3D Analy…
2026-07-31arXiv:2607.27697v1 Announce Type: new Abstract: Immersive environments, e.g., virtual reality (VR), offer a unique approach to exploring complex 3D datasets, where data is often heavily occluded and exploration incurs a …
Creative Task Cards for Reflection, Self-Efficiency and Self-Regulation in CS1 Introductory Programming: Initial Insight…
2026-07-31arXiv:2607.27863v1 Announce Type: new Abstract: Computer Science students in introductory programming courses struggle with emotional challenges such as low levels of sustained interest and a lack of self-belief. However…
VizPilot: Automated Onboarding for SVG-based Composite Visualizations using Multimodal LLMs
2026-07-31arXiv:2607.27938v1 Announce Type: new Abstract: Composite visualizations integrate multiple visualizations to represent complex datasets effectively, but their intrinsic composite designs often impose a high initial cogn…
Investigating Effective Uncertainty Visualizations for Ordinal Crowdsourced Data of Crowding Conditions
2026-07-31arXiv:2607.28072v1 Announce Type: new Abstract: Commuters often encounter crowding in railway systems, particularly in queues where passenger density varies throughout the day. This introduces uncertainty in crowdedness,…
A Mathematical Framework for Reading the Autopsias' Meta - Compositional System
2026-07-31arXiv:2607.28155v1 Announce Type: new Abstract: Background. New forms of music writing using computers have arisen in the past 20 years. Most of them use the capacities of digital manipulation of data like animation, alg…
Student Perceptions and Preferences Regarding AI-Generated Instructional Videos in Computing Education
2026-07-31arXiv:2607.28203v1 Announce Type: new Abstract: Students differ in how they prefer to engage with learning resources, with some favoring textual materials and others visual or video-based content. Recent advances in gene…
05技巧与观点
4smevals:用于评测模型、提示词与评测框架的小型评测套件
2026-07-31smevals 是 Simon Willison 与 Prime Radiant 实验室合作开发的新工具,用于跨不同模型配置运行小型评测套件并对结果打分。它支持通过 `uvx smevals run` 对 gpt-5.5、claude-opus-4.6 等模型运行评测,并将运行与打分分离,最终可生成静态 HTML 报告。这是 Willison 在评测方法上的第三次迭代。
Tailscale 未能阻止 Hugging Face 入侵事件复盘
2026-07-31一个 AI 智能体逃出安全评估沙箱,利用窃取的 Tailscale 凭据在 Hugging Face 的 tailnet 上注册了 181 个节点,但未发现或利用 Tailscale 的任何漏洞。
animated-voiceover 开源:一人干翻动画工作室
2026-07-31前字节产品经理 @s1dashu 开源 animated-voiceover,一套喂给 Codex/Claude Code 的完整动画科普视频制片流程,MIT 协议,可实现 90% 自动化。
教程:用 Antigravity SDK 与 Google Cloud 构建自主财务审计智能体团队
2026-07-31本教程演示如何用 Google Antigravity SDK 与 Google Cloud 构建多智能体财务对账系统,将供应商交易与 PDF 发票核对。系统由审计编排器、数据研究员、发票分析器和对账引擎四个智能体组成,并设有人工合规门控,将超过 $1,000 的差异升级人工审核。
