∞ 英特尔披露256核Xeon 7细节:Diamond Rapids延期至2027年 目标HPC高端市场
英特尔日前在Hot Chips大会上公布了下一代Xeon 7服务器处理器平台Diamond Rapids(代号DMR)的更多技术细节。该平台原计划于2026年推出,配置最高192个核心及16条内存通道,但目前已确认延期至2027年上市。与此同时,英特尔将旗舰型号的核心数量进一步提升至256个性能核心,直接对标同样最高256核的AMD第六代EPYC Venice系列。

与以往面向更广泛服务器市场的产品不同,Diamond Rapids将聚焦高性能计算领域。该平台完全取消超线程技术,也就是业界常说的同步多线程(SMT),并且仅提供面向高核心数市场的高端AP版本。原本规划中的8通道Diamond Rapids-SP产品已被取消,因此DMR不会覆盖AMD产品线的所有层级,而是专注争夺最顶端的HPC市场。
英特尔后续的Coral Rapids产品预计将重新引入超线程技术,并可能带来新一代SP系列处理器。不过,从架构复杂度来看,Diamond Rapids仍是英特尔迄今最精密的Xeon处理器之一。其设计思路在一定程度上让人联想到AMD在2019年借EPYC Rome引入的模块化Chiplet路线:将计算、I/O与内存功能拆分,再根据不同产品需求灵活组合。经过数代产品的探索后,英特尔似乎终于找到了更适合自身的多芯粒整合方式。
Diamond Rapids单颗处理器最多可由22个芯粒组成,并可按计算能力、缓存容量和内存配置的需求进行增减。这些芯粒主要分为三类:最多16个采用Intel 18A-P工艺制造的计算芯粒、4个采用Intel 3-T工艺制造的计算构建块基础芯粒,以及2个基于Intel 3工艺打造的可扩展Fabric Hub芯粒,后者负责连接系统中的各个部分。

其中,18A-P是英特尔18A制程的改良版本,属于2nm级工艺技术。英特尔称,在相同性能下,该工艺可将功耗降低18%;在相同功耗下,则可带来最高9%的性能提升。除了制程收益外,Diamond Rapids还将采用全新的性能核心微架构,因此实际性能表现还会受到核心IPC改进的影响。
每个计算芯粒最多集成16个核心及其对应的二级缓存。最多4个这样的计算芯粒会通过Foveros 3D直接混合键合技术堆叠在一个计算构建块基础芯粒之上。基础芯粒则集成三级缓存:每个计算构建块提供320MB L3缓存,顶级Diamond Rapids型号的L3缓存总容量最高可达1.28GB。

英特尔没有使用EMIB嵌入式多芯粒互连桥来连接计算模块与I/O、内存模块,而是采用更接近UCIe-S风格的封装互连方案,即通过有机封装基板而非硅桥传输数据。英特尔将这一新型芯粒架构称为“扇出式互连架构”。
两枚可扩展Fabric Hub芯粒整合了内存控制器与I/O接口,其设计理念与AMD近几代EPYC服务器处理器中的I/O Die有相似之处。通过复制此类芯粒,英特尔能够扩展内存通道和互连能力。两枚Fabric Hub合计可提供最多16条DDR5内存通道,标准DDR5内存速率最高可达8000MT/s,采用MRDIMM时则可达到12800MT/s。
在扩展连接方面,Diamond Rapids最高支持128条PCIe 6.0、CXL 3或UPI 3通道,此外还提供8条PCIe 4.0通道,后者可能用于板载网络、USB或基板管理控制器等辅助I/O设备。

这一设计也反映出英特尔对内存访问方式的调整。此前的Granite Rapids-AP默认呈现为三个非统一内存访问(NUMA)节点,而Xeon 7 Diamond Rapids希望提供统一内存访问(UMA)架构。由于采用了新的封装互连方式,计算构建块可以直接与两枚Fabric Hub通信,避免了经由额外跳转访问不同I/O模块的问题。英特尔认为,这种设计既有助于实现UMA,也能控制先进封装成本。
不过,DMR平台仍有不少关键参数尚未公布。英特尔尚未说明核心最高频率,也没有披露新性能核心相较Granite Rapids的IPC提升幅度。缓存层级的具体细节同样有限,目前仅能确认其L3缓存容量将非常可观。
指令集方面,Diamond Rapids将支持更新后的AMX矩阵扩展指令,新增FP8支持,以提升CPU执行机器学习任务时的效率。该处理器也将成为首批完整支持AVX 10.2的产品之一。AVX 10.2旨在改进英特尔早期AVX-512实现的一些局限,对高性能计算和超级计算应用具有重要意义。
虽然UMA预计会成为默认配置,但对于需要将大量核心拆分为较小资源域的HPC工作负载而言,NUMA支持仍然十分关键。英特尔尚未详细说明DMR将如何实现NUMA划分,但从架构上看,该处理器理论上可被划分为两个、四个甚至更多子NUMA集群,是否开放这一能力可能主要取决于BIOS设置。

产品分层也是另一个未解问题。目前已知英特尔将推出256核和192核版本,但尚不清楚会将核心数下探至何种程度。理论上,英特尔可将产品裁剪为仅含一个计算构建块和一个16核计算芯粒的版本;但更现实的判断是,Diamond Rapids的最低配置可能会落在64核至128核之间。
从已公布规格看,Diamond Rapids有望成为英特尔近年来最具竞争力的一代高端Xeon。AMD的Venice EPYC和英特尔的DMR都将提供最高256个核心、16条内存通道、超过1GB的三级缓存,以及相近的互连能力;双方旗舰产品的热设计功耗预计也都将在600W左右。
英特尔的明显短板在于没有超线程技术。在某些高度依赖线程数量的工作负载中,即便双方核心性能接近,AMD仍可能凭借SMT取得两位数的性能优势。但在HPC领域,超线程并不总能带来收益。例如,用于全球超级计算机排名的HPL基准测试,通常未必能从超线程中获益。Arm此前甚至表示,同步多线程在部分场景下可能弊大于利。
这也让Diamond Rapids存在被英特尔定位为低延迟AI代理沙箱处理器的可能性,例如承载AI生成的Python代码执行环境,或用于编译并运行C、Rust代码的隔离容器。但即便如此,DMR大概率仍不会成为英特尔的高出货量产品,尤其是在英伟达正推动自研Vera CPU作为AI系统首选主机端处理器的背景下。
最终,Diamond Rapids的市场表现仍将取决于价格与性价比。AMD当年推出EPYC Rome时,未必能在单核心性能上压倒英特尔,但它凭借更高的核心数、更丰富的I/O和更大的内存扩展能力,提供了更具吸引力的单位成本价值。如果英特尔能够以更低价格交付更多核心,那么对特定客户而言,即便AMD拥有更强的绝对性能,Xeon 7仍可能具备竞争力。
∞ 逆向工程师拆解Windows 11性能服务:能力强大 但并非“间谍软件”
近期,Windows 11 的性能表现持续受到用户批评,而一个名为“Windows Health and Optimized Experiences”的后台服务也因此引发关注。此前有说法称,该服务会监控处理器、温度和电池信息,并每隔 15 分钟向微软发送数据。对此,逆向工程师 Xusheng Li 对其核心服务 whesvc 展开分析,结论是:该服务确实拥有相当广泛的系统权限,但现有脚本主要用于性能诊断,并未发现自动上传用户数据或进行屏幕监控的迹象。

微软工程师 Scott Hanselman 此前曾解释,该服务的定位是在 Windows 检测到运行卡顿或响应迟缓时,收集针对性的性能诊断数据。相关追踪信息会先保存在本地,用户可通过“反馈中心”自行选择是否提交。Xusheng Li 的逆向分析基本印证了这一说法,但也显示其底层实现远比普通性能诊断服务更复杂。
分析显示,whesvc 服务本体的体积并不大,关键功能主要位于 windiag.dll。该动态链接库内嵌 Lua 5.4.7 脚本语言,微软还随系统提供了 whesvc_assets.dll,其中包含 84 个已编译的 Lua 脚本,分别负责不同的诊断场景。
Xusheng Li 发现,该脚本引擎向脚本开放了 79 项原生函数,可调用的能力范围相当广泛。其中包括读取和修改 Windows 注册表、执行文件操作、创建及控制进程、查询 WMI(Windows 管理规范)、采集 ETW(Windows 事件追踪)数据、检查安全令牌、获取电源与温度信息、下载符号文件、生成 .cab 压缩包,以及发起 HTTP 请求等。
此外,这套机制还包含通用的外部函数接口(FFI),允许脚本与原生 DLL 及不同的 Windows 句柄交互。单从能力层面看,这一底层引擎的权限确实远超普通性能诊断所需的范围,也因此容易引发用户对隐私和系统控制权的担忧。
不过,功能强大并不等同于被用于不当行为。逆向结果显示,微软随系统提供的脚本大多只将这些能力用于常规诊断任务。例如,注册表相关功能主要用于在服务重启后保存自身计数器;一个驱动信息模块可修改 Windows Driver Verifier 设置,但该功能需特定环境变量触发,并服务于内存监控流程。研究者认为,这可能是 whesvc 在实际使用中最具侵入性的操作之一。
部分脚本还会调用微软自家的工具。例如,有脚本会启动 powercfg.exe 生成 Sleep Study 睡眠报告,另一路径则会调用 wpr.exe,对 Windows Performance Recorder 生成的性能追踪记录进行合并处理。
在实际诊断能力方面,whesvc 可以在应用程序无响应时收集追踪信息,监测输入延迟和显示异常,识别启动缓慢的应用,并检测长期停留在等待状态的系统服务。其电源模块则可用于排查异常耗电、分析阻止电脑进入睡眠状态的因素,以及响应持续性的功耗问题。
以 memory_handle_leak 模块为例,该模块专门用于排查内存泄漏。它会在多个时间间隔内追踪内存和句柄数量,并结合连续增长情况及线性回归斜率,尝试区分潜在内存泄漏与正常的资源增长。
争议较大的“每 15 分钟上传数据”说法,也在此次分析中得到澄清。system_summary 模块确实会生成时长为 900 秒、即 15 分钟的 JSON 系统摘要,但这些数据默认保存在本地。尽管服务具备网络通信能力,研究者并未发现任何会随意发起 HTTP 请求的脚本场景;在全部 84 个脚本中,唯一被识别出的 URL 指向微软公开符号服务器,而这一功能据称在普通零售版 Windows 安装中处于禁用状态。
因此,Xusheng Li 表示,自己曾专门寻找可能存在的可疑行为,但没有发现证据表明该服务会秘密录制屏幕,也没有发现诊断追踪数据会在未经用户操作的情况下自动上传至微软。此前在网络上传播的“Windows 11 借此服务暗中监控用户”的说法,缺乏相应技术依据。
整体来看,微软为 Windows 11 构建的是一套以 SYSTEM 权限运行的通用系统诊断引擎,能够处理注册表、文件、进程以及原生代码执行等任务。其底层能力显然比性能排障本身所需的功能更为强大,但当前随系统提供的脚本仍被限制在性能诊断范围内。换言之,whesvc 的权限设计或许值得继续关注,但现有分析并不支持将其直接定性为“间谍软件”。
∞ ChatGPT Work新增网站登录能力 可代为完成预约、报销与账单处理等任务
OpenAI宣布,ChatGPT Work现已获得一项重要更新:AI代理能够登录需要身份验证的网站,并在用户完成登录后继续执行此前必须由人工接手的网页操作。此前,遇到用户名、密码或安全验证码等认证环节时,ChatGPT无法继续完成任务。

在新机制下,ChatGPT Work检测到网站登录页面后,会将认证步骤交由用户亲自处理。用户可自行输入账号、密码及安全验证码,也可继续使用现有的密码管理器自动填充信息。OpenAI强调,ChatGPT不会看到用户录入的凭据,这些信息既不会暴露给模型,也不会用于训练,用户名和密码同样不会被ChatGPT保存。
用户成功登录后,ChatGPT Work即可继续浏览相关网站,并完成后续任务。已通过认证的网站会保留登录会话,以便在未来的任务中继续使用;如有需要,用户也可以在ChatGPT设置中清除某个网站或全部网站的浏览器数据。
借助这一能力,ChatGPT Work可协助用户处理更完整的线上事务。例如,为新住所开通水电等公共服务;预约车管所、护照办理或宠物医疗服务;通过保险门户查询医疗费用;筛选并预约保险网络内的医生;准备车辆注册续期材料;查找并保存符合条件的房源;安排包裹上门取件或取消票务订单;提交报销材料;筛选求职候选人并起草联系邮件;以及从电子邮件中提取发票后提交至财务软件。
不过,即使用户已经完成登录,涉及重要结果的操作仍需用户确认。例如,在最终提交预约或进行付款前,ChatGPT仍会要求用户明确授权。
这项网站登录支持正通过网页端和移动端向ChatGPT Plus、Pro及Business用户陆续推出。
与此同时,OpenAI还升级了ChatGPT的“计划任务”功能。ChatGPT Work如今不再只能按预先设定的时间运行,也可以响应外部事件触发任务。目前支持的新触发条件包括收到新的Gmail邮件、Slack频道消息,以及GitHub拉取请求活动。用户还可将计划任务分享给他人,让对方自行调整任务内容并连接自己的账号。
计划任务功能现也开始向ChatGPT免费用户开放,但存在一定限制:免费账户最多只能创建3个处于活动状态的任务,无法使用基于Webhook的事件触发机制,重复任务的执行频率也最多只能为每天一次。
∞ DeepSeek前7月营收4.75亿元 较2025全年增长9倍
据两名知悉该公司财务数据的人士透露,这家中国AI实验室正全力推进第二轮融资。2026年前7个月,DeepSeek实现营收约4.75亿元人民币(折合7070万美元),约为其2025全年营收的十倍(即增长9倍)。

两位知情人士补充称,今年1‑7月DeepSeek净亏损约7.15亿元人民币,而2025全年净亏损为9.35亿元。公司正与现有投资人及新投资人就本轮融资展开磋商,计划募资500亿元人民币,目标估值5000亿元人民币。
DeepSeek暂未回复邮件置评请求。
今年前7个月,DeepSeek整体毛利率44.6%;通过API对外输出模型调用服务的毛利率高达82.9%。作为对比:OpenAI一季度营收57亿美元,毛利率39%;Anthropic二季度营收115亿美元,预计2026年毛利率将从2025年的40%提升至63%。
上述尚未公开披露的营收及经营数据,反映出近几个月业务增速显著。媒体上月报道,DeepSeek年化营收已经达到4亿‑5亿美元区间。
营收快速增长,有望助推本轮融资谈判,也为后续潜在IPO铺路。该公司6月刚刚完成首轮500亿元融资,随即启动第二轮融资;已聘请投行筹备明年上市事宜。
营收走高,背后是DeepSeek开源模型的落地使用规模持续扩大。其旗舰V4系列,尤其是轻量化版本V4‑Flash,凭借低成本与扎实性能,受到全球开发者欢迎。
DeepSeek近期已经采取举措进一步拉动收入。本月早些时候,公司上调API接口定价。以旗舰V4‑Pro模型为例,高峰时段输出每百万token价格上调至3.96美元,非高峰时段1.98美元,远高于此前0.87美元的水平。
∞ 顺丰被曝变相降薪 月薪15%划为季度绩效
近日多名顺丰员工在社交平台爆料,收到内部邮件通知启动薪酬结构调整,将原有固定月薪的15%划归季度绩效部分,需要考核达标方可全额获取。不少员工对此提出质疑,认为该调整属于变相降薪,调侃为 “付押金上班”。薪资争议尚未平息,顺丰公司内部加码的着装管控规则同时引发员工吐槽。
新规明确着装不得露膝盖、禁止穿着洞洞鞋,同时不允许佩戴帽子,有员工无奈吐槽 “秃头的都要哭了”。多重管理细则落地后,不少员工心态失衡,认为职场工作演变为过度管束。

有顺丰内部员工向媒体证实调薪信息,本次薪酬结构调整仅针对非一线岗位,一线快递员不在调整范围内。
财报数据显示,顺丰控股近年整体经营保持稳健。2026年第一季度,公司实现营业收入741.42 亿元,同比增长6.14%;归母净利润25.26 亿元,同比增长13.05%。
其中在成本端,公司推进经营激活策略,结构性降本成效显现,一季度毛利101.9亿元,同比提升9.7%,毛利率13.7%,同比上涨0.4个百分点。
