SpaceXAI 发布 Grok Bot

SpaceXAI 于 8 月 11 日正式发布 Grok Bot,将其定位为可以长期接手实际工作的“AI 队友”。每个 Bot 都拥有独立的云端计算机,可以登录用户现有的应用、网站和内部工具,在用户离线后继续执行任务,并在需要人工审批或判断时再请求介入。

与传统需要预先配置工作流的自动化工具不同,Grok Bot 主要通过自然语言交互。用户可以像给同事发消息一样直接分配任务,Bot 会保留历史对话和工作上下文,并逐渐学习用户的处理习惯。用户也可以让 Bot 观察一次完整操作流程,随后将其保存为可重复执行的 routine。

Grok Bot 支持多个智能体并行协作。不同 Bot 可以互相发送消息、共享线程上下文、分配任务,并在群聊中自行协调。SpaceXAI 表示,公司内部已经将其用于销售拓客、营销活动、CRM 更新、发票处理、招聘、Bug 复现与修复等多步骤工作。

目前 Grok Bot 仍处于 Beta 阶段,已面向 SuperGrok Heavy、Cursor Ultra 和 Cursor Teams Premium 订阅用户开放,可在桌面端和 iOS 使用;企业用户目前可以加入候补名单。

来源:SpaceXAI 官方公告《Introducing Grok Bot
来自频道: @DNSPODT
ChatGPT Desktop支持Linux

Use ChatGPT, ChatGPT Work, and Codex where you already work and build, with your projects and browser workflows on supported Linux

https://x.com/i/status/2087231351502385266
来自频道: @DNSPODT
研究披露前沿模型 API 共性漏洞:加密推理轨迹可被跨模型提取

8月11日,来自 MATS Research、ELLIS 图宾根研究所、马克斯·普朗克智能系统研究所、图宾根大学与 Snyk 等机构的研究人员公开论文《Stealing Reasoning Traces from Proprietary LLM APIs》。论文指出,OpenAI、Anthropic 和 Google 的部分推理模型 API 会把完整思维链封装为加密区块交给客户端保存,以便在后续请求中恢复推理状态。实验发现,这些区块没有被严格绑定到原始用户、会话和模型,可在同一供应商的不同账户、会话及模型之间重放。

攻击并未破解加密密钥,也不需要进入供应商基础设施。研究人员先取得前沿模型生成的合法加密推理区块,再将其提交给同一模型家族中防护较弱的低成本模型,通过转录类越狱提示要求后者输出区块对应的明文推理。论文展示了 Claude Opus 4.8 至 Haiku 4.5、GPT-5.6 Sol 至 Luna,以及 Gemini 系列内部的提取实验。被修改的密文仍会被 API 拒绝,但未经修改的合法区块可以被重放,相当于把较弱模型变成了“解码代理”。
在120道 Codeforces 问题上,恢复文本的长度与 API 报告的隐藏推理 token 数量高度接近,表明该方法恢复的并非普通推理摘要。研究人员同时承认,由于无法取得供应商保存的真实明文作为参照,不能确认恢复结果中的每一个 token 都与原始推理完全一致。

隐私风险是论文披露的主要问题之一。团队从 GitHub 和 Hugging Face 收集了6,708条公开智能体轨迹,重建315,320个推理区块,其中1,028个区块包含至少一项隐私泄漏,328条完整轨迹出现真实敏感信息。排除基准测试中的合成数据后,研究人员仍发现62个不同的 API 密钥、33个密码、24个访问令牌、7个私钥和30个个人邮箱。704项真实隐私信息中,有64项只存在于隐藏推理区块,未出现在用户可见的会话记录中,这意味着仅清理明文日志并不能保证公开数据安全。

论文还演示了另外三类影响:低成本批量提取专有推理用于模型蒸馏;从安全拒绝背后的隐藏推理中取得危险操作细节;以及把恶意指令放入不可见的加密区块,使后续智能体在缺少明文痕迹的情况下执行数据外传等操作。研究人员还观察到 Kimi-K3 和 GLM-5.2 对部分 Claude、GPT 推理片段表现出异常高的行为兼容性,但论文明确强调,这些实验不能证明相关模型曾使用专有推理数据进行蒸馏或记忆训练。

研究团队在发表前已向相关模型供应商、微软和 Hugging Face 披露问题。论文的可复现性声明称,经过供应商采取缓解措施,截至2026年8月,论文图1所示的原始攻击已经无法复现。WIRED 报道称,三家供应商均已调整 API,按原路径提取隐私数据已被阻断,但部分推理轨迹仍可能通过类似方法恢复,因此目前更准确的描述是“已缓解”,而非确认完成架构层面的彻底修复。

论文建议供应商将推理状态留在服务器端,仅向客户端提供随机标识符;或使用 AEAD 将区块与用户、会话、前序对话及模型版本绑定,同时轮换旧密钥、限制跨模型重放,并训练模型拒绝推理转录请求。对于开发者和数据集发布者,最直接的措施是在共享智能体轨迹或 API 日志前,彻底删除 encrypted_content、signature、thinkingSignature 等不透明推理字段,而不是只清理可见文本。

来源:arXiv 论文及完整 PDF (arXiv);Stolen Thoughts 项目页 (Stolen Thoughts);Matthew Green 加密推理背景分析 (加密工程思考);WIRED 报道 (WIRED)
WIRED
来自频道: @DNSPODT
8月11日,Manus发布《致Manus用户的一封信》。Manus表示,即将恢复以独立公司的形式运营,作为恢复独立运营的一部分,同时为遵守特定司法辖区的监管要求,部分用户在2025年12月29日当天或之后产生的数据,将于2026年8月23日08:00起至8月24日期间(SGT)被删除。受影响的用户可以从现在起至2026年8月23日07:59(SGT)备份数据,并可从2026年8月25日08:00(SGT)起恢复数据。在此期间,未受影响的用户可以照常使用Manus,无需采取任何行动。

来源:华尔街见闻
来自频道: @DNSPODT
英国海事贸易行动中心(UKMTO)在接到报告后发布了一则警告通报,该报告称也门阿尔莫哈港外海发生一起事件,一艘在南部红海的货船被不明射弹击中,导致伤亡人数和性质不明。

Source
来自频道: @DNSPODT
蚂蚁百灵开源轻量级模型 Ling-3.0-tiny 支持边缘端高效部署

蚂蚁百灵于近期在 Hugging Face 平台开源轻量级混合推理 MoE 模型 Ling-3.0-tiny。该模型总参数量为 7.9B,每 Token 激活参数仅 1.3B,采用 KDA 与 MLA 混合架构结合 128 个路由专家的稀疏 MoE 网络,在计算成本与上下文处理能力之间取得平衡。模型原生支持快速响应与多步骤推理两种模式,并提供 BF16、FP8 和 INT4 多种权重版本。

作为一款专为本地及边缘端部署设计的模型,Ling-3.0-tiny 已在英伟达 DGX Spark 以及搭载 Apple Silicon 的 MacBook、Mac mini 等设备上完成验证。在 FP8 量化下,模型在 M4 Pro 芯片上可实现约 86-90 Token/s 的推理速度,8K 上下文峰值内存占用仅约 8.34 GiB,大幅降低了本地部署高阶 AI 能力的硬件门槛。

来源:Hugging Face
来自频道: @DNSPODT
消息称谷歌已搁置发布 Gemini 3.5 Pro AI 模型

行业分析机构 Semi Analysis 最新报告称,谷歌内部可能已搁置 Gemini 3.5 Pro 模型,为填补该模型迟迟未发布留下的空档,该公司可能提前宣传 Gemini 4 系列模型。

来源:IT之家
来自频道: @DNSPODT
大型银行对使用中国人工智能模型表现出了令人惊讶的意愿

Amp 联合创始人兼首席执行官 Quinn Slack 表示:“我们实际上看到,即使是大型银行,对中国模型的接受度也相当高,因为他们知道自己需要掌握这些技术以备不时之需。”

来源:The Information
来自频道: @DNSPODT
Anthropic 为 Claude 生成内容加入机器可读水印

Anthropic 发布说明,宣布开始为 Claude 生成内容加入机器可读标记,以履行欧盟《AI 法案》第 50(2) 条“AI 生成内容透明度实践准则”相关承诺。欧盟相关透明度义务已于 2026 年 8 月 2 日开始适用。

对于 2026 年 8 月 2 日及之后在欧盟推出的新 Claude 模型,Anthropic 将从模型发布之日起提供标记能力。文本输出会嵌入肉眼不可见的水印;Claude 生成的 SVG、PNG、JPG 等受支持文件,则会加入基于 C2PA 开放标准的数字签名来源元数据。

文本水印直接作用于模型生成文本,因此复制粘贴后仍可能保留,并覆盖 Claude、Claude API、Claude Code、Claude Cowork、Claude Tag 等产品。对于受支持模型,这一机制并不只限于欧盟,而是计划在全球 Claude 服务范围内应用;通过 AWS、Google Cloud 与 Microsoft Foundry 调用时,也将应用文本水印。

Anthropic 同时表示,将向用户和第三方提供检测 Claude 标记的方法,但具体检测机制和技术文档目前尚未公布。2026 年 8 月 2 日之前发布的旧模型也计划逐步加入相关能力。

Anthropic 特别强调,这套机制并不能直接判断一段内容“是不是 Claude 写的”。检测到水印只能说明内容可能经过 Claude 处理,例如翻译、润色和摘要同样可能留下标记;反过来,没有检测到标记也不能证明内容由人类创作,因为大量改写、翻译、文本过短或文件元数据被移除,都可能使标记失效。

来源:Anthropic Claude Help Center
来自频道: @DNSPODT
来自频道: @DNSPODT
Anthropic 当地时间 10 日宣布,其今年 6 月末推出的 Claude Sonnet 5 人工智能模型未来将永久性维持首发期推广优惠价,原定 9 月 1 日生效的原价已被取消。

Claude Sonnet 5 的当前价格为每百万 Token(词元)输入 2 美元、每百万 Token(词元)输出 10 美元。此前计划实施的“原价”为 3 美元 / 15 美元,即上涨 50%。

来源:Claude
来自频道: @DNSPODT
OpenAI推出面向网络安全防御者的低限制AI模型

OpenAI宣布向经过审核的网络防御人员开放限制更少的新模型GPT-5.6-Cyber,并升级Daybreak合作计划,以帮助企业应对潜在的自主网络攻击。此前,OpenAI曾因安全考量暂缓发布具备强黑客能力的Astra模型。

通过该计划,IBM、Cisco等安全巨头可将新模型引入其安全产品中。测试表明,GPT-5.6-Cyber对高级网络安全请求的响应率高达95%,显著提升了安全研究人员漏洞分析与防护的效率。

来源:Axios
来自频道: @DNSPODT
8月10日20时02分,我国在文昌航天发射场使用长征七号改运载火箭发射中星4B卫星,火箭飞行异常,发射任务失利。具体原因正在进一步分析排查。

来源:中新网 / Youtube
Media is too big
VIEW IN TELEGRAM
来自频道: @DNSPODT
杰富瑞将苹果公司评级从“持有”下调至“跑输大盘”;同时将目标股价从285.56美元下调至263.66美元(16%的下跌空间)。下调的理由是原定于2027年9月推出的全玻璃iPhone因生产良率问题已被取消,同时面临内存成本上涨带来的不利影响。下调2028与2029财年EPS预期。

Source
来自频道: @DNSPODT
公益API中转站现恶意代码注入风险 用户密钥及系统信息面临泄露威胁

近日,有开发者在使用某公益API中转服务时,遭遇恶意的代码注入攻击。相关注入脚本会企图扫描并窃取用户的系统主机配置、SSH密钥、环境变量以及各类服务凭证,并将收集到的敏感数据上传至第三方服务器。

安全分析显示,该类平台此前已发生过类似注入事件,主要针对配置了完全访问权限且处于无人值守状态的用户环境。本频道提醒相关开发者,应提高对第三方API中转站的安全警惕,严格限制服务访问权限并加强日常监控,防止敏感凭证与信息泄露。

来源:V2EX
来自频道: @DNSPODT
来自频道: @DNSPODT
抖音首次引入外部专家参与复杂网暴案例评审

7月底,抖音在北京举办“戏谑的边界与伤害”研讨会,首次引入法学、心理学等领域的外部专家参与复杂网暴案例处置评审。会议聚焦玩梗式网暴的识别与治理边界,并公开了包含指向性、危害性、规模化三大核心要素的治理体系。

此外,抖音明确了避免伤害、特别保护等四大治理原则,将通过“模型识别—人工研判—处置保护”的闭环流程,持续推进网暴风险的精细化治理与早干预。

来源:IT之家
来自频道: @DNSPODT
Anthropic将默认开启Claude Code的自动模式

Anthropic宣布将于8月14日起,为Pro、Max和Team付费账户默认开启Claude Code的自动模式。在该模式下,系统仅在遇到不可逆、具破坏性或跨环境操作时才会请求人工确认,以减少频繁的授权提示。测试数据显示,由于人工审核易产生习惯性通过(通过率达97%),自动模式在拦截有害操作上的成功率(89%)远高于人工审核(13.6%)。同时,官方已加入提示词注入过滤等安全防护机制。

来源:TechCrunch
来自频道: @DNSPODT
AMD近日发布安全公告AMD-SB-7061,披露一种新型Spectre V2攻击,Zen 1至Zen 4架构处理器均受影响,大致覆盖锐龙1000至锐龙7000/8000G系列。该漏洞相关研究团队在Linux环境下对Zen 2完成完整攻击演示,认为Zen 3、Zen 4同样可能被攻破。该攻击并非远程入侵,需攻击者已在目标Linux系统上以普通用户权限执行代码,对共享服务器、云系统及运行不可信本地应用的设备风险较高。验证显示该攻击可绕过对应防护读取Linux内核敏感信息,目前相关安全补丁已纳入Linux内核,建议使用受影响架构处理器的Linux用户尽快安装安全更新。

来源:Hardware Busters / AMD
来自频道: @DNSPODT