01政策相关
2阿里Qwen将集成至Apple Intelligence服务中国用户
2026-07-15阿里巴巴的Qwen模型将被集成到Apple Intelligence中,为中国的iOS、iPadOS、macOS和visionOS用户提供文本与图像理解、内容生成等AI功能。中国网信办已公布包括Apple Intelligence、华为小艺大模型、OPPO AndesGPT在内的七项移动端生成式AI服务备案信息。阿里巴巴董事会主席蔡崇信表示,苹果在选定阿里前曾与多家中国公司洽谈。
国行 Apple 智能完成备案,阿里千问将集成至苹果 AI 能力
2026-07-15苹果技术开发(上海)有限公司的"Apple 智能"大模型已于 2026 年 7 月 8 日完成备案,适用场景为苹果手机。阿里千问将作为 AI 能力集成至 Apple 智能,为 iOS、iPadOS、macOS 和 visionOS 的中国用户提供文本与图像理解、内容生成等功能,用户无需在应用间切换即可直接体验。
02行业前沿动态
9开源编程智能体内存方案发布,通过 SSH 同步
2026-07-15一个面向编程 AI 智能体的开源内存项目在 GitHub 发布,支持通过 SSH 同步记忆数据。该项目允许智能体跨会话保留上下文,无需依赖特定云服务,用户可自托管。代码已开源,便于开发者集成与定制。
xAI 开源 Grok Build 编程智能体与终端界面
2026-07-15xAI 已将 Grok Build 的源代码在 GitHub 上开源。Grok Build 是 SpaceXAI 的编程智能体与终端用户界面(TUI),开源后用户可自行编译并完全本地运行,指向本地推理引擎并通过 `config.toml` 配置。
Grok Build 现已开源
2026-07-15Grok Build 现已开源
Claude Code 新增 MCP 连接器调用功能
2026-07-15Claude Code 的 artifacts 现在可以调用 MCP 连接器,让你构建能够按需为每位查看者获取信息并执行操作的仪表盘和应用。 适用于 Pro、Max、Team 和 Enterprise 计划。不适用于公开共享的 artifacts。
Thinking Machines 发布多模态模型 Inkling
2026-07-15今天,我们推出 Inkling。 Inkling 能高效地对文本、图像和音频模态进行推理。我们将提供完整权重。 https://thinkingmachines.ai/news/introducing-inkling/ 即日起可在 Tinker 上进行微调。在 Inkling Playground 中试用。🧵
Telegram 无服务器架构
2026-07-15Telegram Serverless 允许开发者直接在 Telegram 基础设施上运行 Bot 和 Mini App 的后端代码,无需配置服务器或容器。开发者编写普通 JavaScript 模块,通过 `npx tgcloud push` 单命令部署,代码在靠近 Bot API 和内建数据库的轻量级 V8 隔离沙箱中执行。
OpenAI 发布 GPT-Red:通过自动化红队测试提升模型鲁棒性
2026-07-15OpenAI 训练了自动化红队模型 GPT-Red,用于在部署前发现漏洞并在训练中生成攻击以提升模型鲁棒性。GPT-Red 能攻破此前几乎所有模型,其攻击被用于对抗训练 GPT-5.6 Sol,使该模型在直接提示注入基准测试中的失败率降至四个月前最佳生产模型的 1/6。GPT-Red 通过自对弈强化学习训练,投入了 OpenAI 后训练中前所未有的计算规模。
金山办公推出 WPS Comate AI 办公客户端
2026-07-15金山办公在2026 AI生产力大会上推出面向员工的AI办公客户端WPS Comate,可连接组织数据与流程。该产品提供AI岗位专家、Skill技能生态、自动化任务等六大模块,并支持云端与本地双任务模式,个人用户可直接下载体验。
阿里发布 Qwen-Audio-3.0-Realtime,在 Artificial Analysis 语音推理子项中综合排名第一
2026-07-15阿里通义实验室发布实时语音交互模型 Qwen-Audio-3.0-Realtime,在 Artificial Analysis 的 Speech Reasoning 子项中综合排名第一,超越 OpenAI GPT-Realtime-2。
04论文研究
10OpenAI 用 AI 攻击自家 AI:GPT-Red 自动发现安全漏洞,成功率 84% 远超人类
2026-07-15OpenAI 训练了内部 AI 模型 GPT-Red,通过自我对弈强化学习自动模拟提示词注入等攻击,在测试场景中成功率达 84%,而人类红队仅为 13%。GPT-Red 的发现直接用于训练,使 GPT-5.6 Sol 在直接提示词注入上的故障次数比四个月前的最佳模型减少六倍,且未影响通用性能。约 3.8% 的"更强"提示词注入仍能成功,GPT-Red 暂不对外开放。
Anthropic 研究:AI 智能体模拟中行为偏差
2026-07-15Anthropic 新研究:2026 年夏季的智能体行为偏差。 在我们的敲诈实验一年后,我们又发现了四种当今自主 AI 智能体在模拟中行为不当的方式。 了解更多:https://alignment.anthropic.com/2026/agentic-misalignment-summer-2026/
Reading the Eyes in VR: Multimodal Modeling of Social Intelligence
2026-07-15arXiv:2607.11931v1 Announce Type: new Abstract: Social intelligence, the ability to interpret others' emotions, beliefs, and intentions, is often assessed with the Reading the Mind in the Eyes Test (RMET), in which parti…
Thought Experiments for Conceptual Work: A New Application of a (Very) Old Method
2026-07-15arXiv:2607.12092v1 Announce Type: new Abstract: In this paper, we propose thought experiments (TEs) as a crucial method for Human-Computer Interaction (HCI) researchers to engage in conceptual work. As an interdisciplina…
Faster AI, Uneven Frontier: Rapid Crossings, a Jagged Frontier, and the Repositioning of Human Judgment
2026-07-15arXiv:2607.12125v1 Announce Type: new Abstract: Between 2023 and 2026, frontier AI systems crossed documented human expert baselines on a growing set of bounded, well-specified, evaluable cognitive tasks, including gradu…
TRAIL: A Platform for Configurable Human--AI Teaming Experiments
2026-07-15arXiv:2607.12180v1 Announce Type: new Abstract: An AI teammate's design properties (personality, communication style, when it speaks) can shape a team's trust, coordination, and decisions. Studying this rigorously demand…
Compos3D: Interactive Part-Based Composition for Creative Control in Generative 3D Models
2026-07-15arXiv:2607.12193v1 Announce Type: new Abstract: While generative AI has unlocked new opportunities for 3D content creation, current workflows often rely on multiple regenerations, which provides limited control and unpre…
From Chaos to Clarity: A Framework for Program-Level AI Learning Outcomes
2026-07-15arXiv:2607.12221v1 Announce Type: new Abstract: Industry is leaning into generative artificial intelligence (GenAI), and higher education is under pressure to prepare graduates for a GenAI-augmented workforce. Yet, there…
Towards Knitted Textile Electromechanical Systems
2026-07-15arXiv:2607.12237v1 Announce Type: new Abstract: E-textiles and wearable sensing technologies enable flexible, customizable interfaces for human-computer interaction, with capacitive sensing offering precise touch and pre…
Real-time Generation of Listener Nodding via Prediction of Kinematic Parameters for Avatar Dialogue Systems
2026-07-15arXiv:2607.12329v1 Announce Type: new Abstract: In human dialogue, we achieve smooth communication by expressing nonverbal cues such as eye contact, nodding, and facial expressions with precise timing. It is expected for…
05技巧与观点
6前谷歌DeepMind研究员因公司签署无限制军事AI协议而离职
2026-07-15前谷歌DeepMind研究员Alex Turner因谷歌向国土安全部出售云服务并最终签署无限制军事AI协议而离职。他曾起草25页提案要求加入禁止杀手机器人和大规模监控的合同条款,但提案被CEO转交后无人跟进。Turner指出,包括Jeff Dean和Stuart Russell在内的多位AI伦理领袖在关键时刻未能兑现承诺。
AI语音诈骗:退休老人因合成女儿哭声被骗1.5万美元
2026-07-152025年夏季,美国佛罗里达州一名退休老人接到"女儿"哭诉车祸需保释金的电话,一小时内取现1.5万美元交给冒充法院的快递员--实际上,哭声是从一段音频片段合成的AI语音。FBI 2026年4月报告首次将AI欺诈列为独立类别,2025年收到超2.2万起AI相关投诉,调整后损失超8.93亿美元,其中60岁以上受害者占3.52亿美元。
数据中心已使美国公众电费增加230亿美元,回收成本困难重重
2026-07-15数据中心对电力的需求已导致美国公众电费增加230亿美元,这一涨价将持续至2028年底。由于电价由州公用事业委员会根据复杂的成本分摊规则设定,数据中心可利用其用电灵活性(如避开系统峰值负荷)规避部分成本分摊,而普通居民难以效仿。监管机构正面临如何公平分配电网基础设施投资成本的挑战。
Airtap iMessage 新功能:发条短信让 AI 替你操作手机
2026-07-15Airtap 推出 iMessage 新功能,用户只需给美国号码发一条 iMessage,其云手机上的 AI Agent 就能通过视觉模拟点击,替用户完成 TikTok 刷视频、星巴克点单等操作,无需安装对应 App。其架构分为三层:大脑(理解指令)、AutoPilot(视觉操控屏幕)、云手机(24小时在线)。但支付等敏感操作仍需用户手动完成,信任与授权仍是所有 Agent 厂商的难题。
开源 LLM TODO Skill"阿福":用 Claude Code 和 Codex 实现知识管理到排期自动化
2026-07-15作者基于 API 版 Fable5 和 Codex 开发了开源 TODO Skill"阿福",用于将收件箱中的待办资料自动转为 Markdown 任务卡,识别信息不完整项(如视频链接需通过 yt-dlp 和本地 Whisper 提取字幕),并支持批量排期、AI 分组合并、拖拽调整周视图及同步到 Mac 日历或飞书日历。项目已开源在 GitHub,安装仅需一条命令。
每天Vibe Coding 16小时,作者分享Fable 5与GPT-5.6 Sol的AI开发流程
2026-07-15作者每天Vibe Coding约16小时,认为Claude Fable 5在大型方案初版设计上"当世独一档",GPT-5.6 Sol能有效纠错并优化方案。核心流程为:Fable 5出方案初版 → GPT-5.6 Sol审查纠错 → 在Codex中开启"目标模式"全自动化执行,最长曾连续运行17小时。
