今日日报

2026年7月15日 周三 · 共 27 条情报

天智汇能 · GLOBAL X TALENT
判断人 · 连接人 · 服务硬科技
SPACEINTELCONVENERGY
📜

01政策相关

2
🚀

02行业前沿动态

9
头部企业产品发布与更新行业头部企业的产品发布和更新

开源编程智能体内存方案发布,通过 SSH 同步

2026-07-15

一个面向编程 AI 智能体的开源内存项目在 GitHub 发布,支持通过 SSH 同步记忆数据。该项目允许智能体跨会话保留上下文,无需依赖特定云服务,用户可自托管。代码已开源,便于开发者集成与定制。

📍 AI HOT · Hacker News 热门(buzzing.cc 中文翻译)#AI HOT#ai-products

xAI 开源 Grok Build 编程智能体与终端界面

2026-07-15

xAI 已将 Grok Build 的源代码在 GitHub 上开源。Grok Build 是 SpaceXAI 的编程智能体与终端用户界面(TUI),开源后用户可自行编译并完全本地运行,指向本地推理引擎并通过 `config.toml` 配置。

📍 AI HOT · xAI:News(网页)#AI HOT#ai-products

Grok Build 现已开源

2026-07-15

Grok Build 现已开源

📍 AI HOT · X:Elon Musk (@elonmusk, xAI)#AI HOT#ai-products

Claude Code 新增 MCP 连接器调用功能

2026-07-15

Claude Code 的 artifacts 现在可以调用 MCP 连接器,让你构建能够按需为每位查看者获取信息并执行操作的仪表盘和应用。 适用于 Pro、Max、Team 和 Enterprise 计划。不适用于公开共享的 artifacts。

📍 AI HOT · X:Claude Devs (@ClaudeDevs)#AI HOT#ai-products

Thinking Machines 发布多模态模型 Inkling

2026-07-15

今天,我们推出 Inkling。 Inkling 能高效地对文本、图像和音频模态进行推理。我们将提供完整权重。 https://thinkingmachines.ai/news/introducing-inkling/ 即日起可在 Tinker 上进行微调。在 Inkling Playground 中试用。🧵

📍 AI HOT · X:Thinking Machines (@thinkymachines)#AI HOT#ai-models

Telegram 无服务器架构

2026-07-15

Telegram Serverless 允许开发者直接在 Telegram 基础设施上运行 Bot 和 Mini App 的后端代码,无需配置服务器或容器。开发者编写普通 JavaScript 模块,通过 `npx tgcloud push` 单命令部署,代码在靠近 Bot API 和内建数据库的轻量级 V8 隔离沙箱中执行。

📍 AI HOT · Hacker News 热门(buzzing.cc 中文翻译)#AI HOT#ai-products

OpenAI 发布 GPT-Red:通过自动化红队测试提升模型鲁棒性

2026-07-15

OpenAI 训练了自动化红队模型 GPT-Red,用于在部署前发现漏洞并在训练中生成攻击以提升模型鲁棒性。GPT-Red 能攻破此前几乎所有模型,其攻击被用于对抗训练 GPT-5.6 Sol,使该模型在直接提示注入基准测试中的失败率降至四个月前最佳生产模型的 1/6。GPT-Red 通过自对弈强化学习训练,投入了 OpenAI 后训练中前所未有的计算规模。

📍 AI HOT · OpenAI:官网动态(RSS · 排除企业/客户案例)#AI HOT#ai-models

金山办公推出 WPS Comate AI 办公客户端

2026-07-15

金山办公在2026 AI生产力大会上推出面向员工的AI办公客户端WPS Comate,可连接组织数据与流程。该产品提供AI岗位专家、Skill技能生态、自动化任务等六大模块,并支持云端与本地双任务模式,个人用户可直接下载体验。

📍 AI HOT · IT之家(RSS)#AI HOT#ai-products

阿里发布 Qwen-Audio-3.0-Realtime,在 Artificial Analysis 语音推理子项中综合排名第一

2026-07-15

阿里通义实验室发布实时语音交互模型 Qwen-Audio-3.0-Realtime,在 Artificial Analysis 的 Speech Reasoning 子项中综合排名第一,超越 OpenAI GPT-Realtime-2。

📍 AI HOT · 公众号:通义实验室(千问)#AI HOT#ai-models
🔬

04论文研究

10

OpenAI 用 AI 攻击自家 AI:GPT-Red 自动发现安全漏洞,成功率 84% 远超人类

2026-07-15

OpenAI 训练了内部 AI 模型 GPT-Red,通过自我对弈强化学习自动模拟提示词注入等攻击,在测试场景中成功率达 84%,而人类红队仅为 13%。GPT-Red 的发现直接用于训练,使 GPT-5.6 Sol 在直接提示词注入上的故障次数比四个月前的最佳模型减少六倍,且未影响通用性能。约 3.8% 的"更强"提示词注入仍能成功,GPT-Red 暂不对外开放。

📍 AI HOT · The Decoder:AI News(RSS)#AI HOT#paper

Anthropic 研究:AI 智能体模拟中行为偏差

2026-07-15

Anthropic 新研究:2026 年夏季的智能体行为偏差。 在我们的敲诈实验一年后,我们又发现了四种当今自主 AI 智能体在模拟中行为不当的方式。 了解更多:https://alignment.anthropic.com/2026/agentic-misalignment-summer-2026/

📍 AI HOT · X:Anthropic (@AnthropicAI)#AI HOT#paper

Reading the Eyes in VR: Multimodal Modeling of Social Intelligence

2026-07-15

arXiv:2607.11931v1 Announce Type: new Abstract: Social intelligence, the ability to interpret others' emotions, beliefs, and intentions, is often assessed with the Reading the Mind in the Eyes Test (RMET), in which parti…

📍 arXiv cs.HC#arXiv cs.HC

Thought Experiments for Conceptual Work: A New Application of a (Very) Old Method

2026-07-15

arXiv:2607.12092v1 Announce Type: new Abstract: In this paper, we propose thought experiments (TEs) as a crucial method for Human-Computer Interaction (HCI) researchers to engage in conceptual work. As an interdisciplina…

📍 arXiv cs.HC#arXiv cs.HC

Faster AI, Uneven Frontier: Rapid Crossings, a Jagged Frontier, and the Repositioning of Human Judgment

2026-07-15

arXiv:2607.12125v1 Announce Type: new Abstract: Between 2023 and 2026, frontier AI systems crossed documented human expert baselines on a growing set of bounded, well-specified, evaluable cognitive tasks, including gradu…

📍 arXiv cs.HC#arXiv cs.HC

TRAIL: A Platform for Configurable Human--AI Teaming Experiments

2026-07-15

arXiv:2607.12180v1 Announce Type: new Abstract: An AI teammate's design properties (personality, communication style, when it speaks) can shape a team's trust, coordination, and decisions. Studying this rigorously demand…

📍 arXiv cs.HC#arXiv cs.HC

Compos3D: Interactive Part-Based Composition for Creative Control in Generative 3D Models

2026-07-15

arXiv:2607.12193v1 Announce Type: new Abstract: While generative AI has unlocked new opportunities for 3D content creation, current workflows often rely on multiple regenerations, which provides limited control and unpre…

📍 arXiv cs.HC#arXiv cs.HC

From Chaos to Clarity: A Framework for Program-Level AI Learning Outcomes

2026-07-15

arXiv:2607.12221v1 Announce Type: new Abstract: Industry is leaning into generative artificial intelligence (GenAI), and higher education is under pressure to prepare graduates for a GenAI-augmented workforce. Yet, there…

📍 arXiv cs.HC#arXiv cs.HC

Towards Knitted Textile Electromechanical Systems

2026-07-15

arXiv:2607.12237v1 Announce Type: new Abstract: E-textiles and wearable sensing technologies enable flexible, customizable interfaces for human-computer interaction, with capacitive sensing offering precise touch and pre…

📍 arXiv cs.HC#arXiv cs.HC

Real-time Generation of Listener Nodding via Prediction of Kinematic Parameters for Avatar Dialogue Systems

2026-07-15

arXiv:2607.12329v1 Announce Type: new Abstract: In human dialogue, we achieve smooth communication by expressing nonverbal cues such as eye contact, nodding, and facial expressions with precise timing. It is expected for…

📍 arXiv cs.HC#arXiv cs.HC
💡

05技巧与观点

6

前谷歌DeepMind研究员因公司签署无限制军事AI协议而离职

2026-07-15

前谷歌DeepMind研究员Alex Turner因谷歌向国土安全部出售云服务并最终签署无限制军事AI协议而离职。他曾起草25页提案要求加入禁止杀手机器人和大规模监控的合同条款,但提案被CEO转交后无人跟进。Turner指出,包括Jeff Dean和Stuart Russell在内的多位AI伦理领袖在关键时刻未能兑现承诺。

📍 AI HOT · Hacker News 热门(buzzing.cc 中文翻译)#AI HOT#tip

AI语音诈骗:退休老人因合成女儿哭声被骗1.5万美元

2026-07-15

2025年夏季,美国佛罗里达州一名退休老人接到"女儿"哭诉车祸需保释金的电话,一小时内取现1.5万美元交给冒充法院的快递员--实际上,哭声是从一段音频片段合成的AI语音。FBI 2026年4月报告首次将AI欺诈列为独立类别,2025年收到超2.2万起AI相关投诉,调整后损失超8.93亿美元,其中60岁以上受害者占3.52亿美元。

📍 AI HOT · Hacker News 热门(buzzing.cc 中文翻译)#AI HOT#tip

数据中心已使美国公众电费增加230亿美元,回收成本困难重重

2026-07-15

数据中心对电力的需求已导致美国公众电费增加230亿美元,这一涨价将持续至2028年底。由于电价由州公用事业委员会根据复杂的成本分摊规则设定,数据中心可利用其用电灵活性(如避开系统峰值负荷)规避部分成本分摊,而普通居民难以效仿。监管机构正面临如何公平分配电网基础设施投资成本的挑战。

📍 AI HOT · Hacker News 热门(buzzing.cc 中文翻译)#AI HOT#tip

Airtap iMessage 新功能:发条短信让 AI 替你操作手机

2026-07-15

Airtap 推出 iMessage 新功能,用户只需给美国号码发一条 iMessage,其云手机上的 AI Agent 就能通过视觉模拟点击,替用户完成 TikTok 刷视频、星巴克点单等操作,无需安装对应 App。其架构分为三层:大脑(理解指令)、AutoPilot(视觉操控屏幕)、云手机(24小时在线)。但支付等敏感操作仍需用户手动完成,信任与授权仍是所有 Agent 厂商的难题。

📍 AI HOT · X:阿易 AI Notes (@AYi_AInotes)#AI HOT#tip

开源 LLM TODO Skill"阿福":用 Claude Code 和 Codex 实现知识管理到排期自动化

2026-07-15

作者基于 API 版 Fable5 和 Codex 开发了开源 TODO Skill"阿福",用于将收件箱中的待办资料自动转为 Markdown 任务卡,识别信息不完整项(如视频链接需通过 yt-dlp 和本地 Whisper 提取字幕),并支持批量排期、AI 分组合并、拖拽调整周视图及同步到 Mac 日历或飞书日历。项目已开源在 GitHub,安装仅需一条命令。

📍 AI HOT · 公众号:卡尔的AI沃茨#AI HOT#tip

每天Vibe Coding 16小时,作者分享Fable 5与GPT-5.6 Sol的AI开发流程

2026-07-15

作者每天Vibe Coding约16小时,认为Claude Fable 5在大型方案初版设计上"当世独一档",GPT-5.6 Sol能有效纠错并优化方案。核心流程为:Fable 5出方案初版 → GPT-5.6 Sol审查纠错 → 在Codex中开启"目标模式"全自动化执行,最长曾连续运行17小时。

📍 AI HOT · 公众号:数字生命卡兹克#AI HOT#tip