
对北美的Office 365用户而言,这一周他们过得并不愉快。
6月23日,众多用户的Lync Online通信服务宕机数小时。6月24日,Office 365平台连接Exchange Online(在线交流)故障导致部分用户无法登录或在这一天内长时间无法及时收到他们的邮件。
6月26日,微软Office 365工程部门副总裁拉杰什·杰哈(Rajesh Jha)在一篇博文中向众多用户道歉,并解释了Office 365北美分公司数据中心产生故障的原因。
杰哈表示,相继发生的Lync Online通信服务和Exchange Online在线交流服务故障之间“并不相关”。
Lync Online通信服务故障致使很多用户无法登录微软的Lync Online统一通信服务,微软将其归因于外部网络连接失败故障。
杰哈解释道:“尽管链接故障在几分钟内便得以修复,但随之而来的流量高峰导致若干网络元素过载,继而延长了我们一些客户无法访问Lync功能的持续时间。”
杰哈还承认,Exchange Online在线交流服务故障导致“一些用户的外部绑定邮箱电子邮件(该公司收到和发出的邮件)延迟。”此外,一小部分用户根本不能访问其Exchange电子邮件服务。然而,微软Service Health Dashboard并未向所有用户通知该服务故障,反而显示一切运行正常。
杰哈说道:“至于Exchange Online在线交流服务故障,主要是由一处文件目录功能间歇性失效引发的,其间歇性失效导致一处目录分区不再响应用户身份验证请求。”
尽管杰哈坚称仅“一小部分用户”无法访问其电子邮件,但他们无法访问服务的时间却是“持久的”。然而,杰哈指出:“本次故障的本质在广泛的邮件发送系统中引起了意想不到的问题,由于未知的代码漏洞导致许多用户的邮件流延迟。”
微软团队最终将邮件发送系统与其失效的目录分区分离开来,继而解决导致其目录分区失败的根本问题。杰哈表示,微软正“致力于对这种模式的进一步强化”。
杰哈表示,微软还计划在用户Service Health Dashboard中发布一个“事后报告”(PIR),其间将包含本次故障的详细分析,和微软对此做出的回应,以及公司将来会采取哪些措施来防止类似问题的发生等。
目前为止还未有消息表明微软正计划做什么,如果有,那或许会与对本周受到影响的用户进行经济赔偿相关。
好文章,需要你的鼓励
本文介绍LT-OPD训练框架,通过让极限压缩的多模态大模型在自己生成的内容上接受满血版模型指导,并配合渐进式课程学习,在仅保留5%视觉token时把性能保留率从68.6%提升到82.3%,且不增加推理成本。
本文解读ALIGNOPSD方法,该方法针对AI智能体训练中"决策与时间戳错配"问题,通过先对齐功能相同的决策场景再打分,并按可变长度决策段分配信用,在ALFWorld、WebShop、Search-QA三大任务上相比GRPO提升5.5%至8.7%。
本文介绍自适应一致性图(ACG)方法,通过持久化执行记忆图与预算感知的上下文构建,帮助AI智能体在长任务中减少信息失联,在多项基准测试中相比ReAct等基线方法提升了任务成功率。
多智能体AI协作时重复计算KV缓存浪费严重。PReCache提出预计算低秩缓存和中性基础缓存重构两项设计,免训练实现最高3.1倍加速、2.3倍吞吐提升,且准确率仅比不共享方案低1.1个百分点。