
7月17日,阿里云数据库RDS产品正式发布数据压缩功能,该功能可将用户数据进行压缩,压缩后有效降低用户的数据存储成本和运维难度。目前这是国内云计算行业中唯一提供此类功能的服务商。

众所周知,当一个数据库的数据空间达到TB级别时运维将会变得十分困难。尤其是数据迁移和备份操作,不仅耗时将会成倍增长,成功率也会大幅下降。无论用户是自建数据库还是使用云服务,迅速膨胀的存储空间还会带来存储成本的增加。
阿里云RDS for MySQL推出的表级别数据压缩,在保证用户数据完整性的条件下压缩比可以达到5倍,典型应用甚至可以达到10倍以上。
以某些参与内测的实例为例,原本超过2TB的InnoDB表进行压缩后数据空间骤降至400GB,节省了80%数据空间的同时也带来了成本的下降。除此之外数据迁移和备份操作的时间也大幅缩减。
为什么数据压缩可以达到如此水平?据阿里云数据库负责人表示,RDS for MySQL引入了TokuDB技术。TokuDB是一个事务型的MySQL引擎,通过zlib、quicklz、lzma等算法的选择,不同类型的数据都能达到理想的压缩效果。整个压缩过程数据保证无损失,压缩完成后应用无需进行代码改造。
据了解,目前阿里云数据库RDS for MySQL 5.6已经内置了TokuDB技术,用户可以通过命令行或者DMS服务对现有的表进行压缩。
提供超大型数据库的压缩功能是阿里云解决客户数据库庞大的方案之一。但对于不想压缩的客户,阿里云也另外准备了2000G存储空间的服务,同样可以解决用户的需求。
凭借在数据库领域的长期深入应用与实践,阿里云在数据库领域具备领先优势。此前已经同时支持MySQL、SQL Server 和PostgreSQL关系型数据库。阿里云还是全球性数据库组织WebScaleSQL成员,其他成员包括了Facebook、 Google、Twitter和LinkedIn。
好文章,需要你的鼓励
论文提出CAST框架,通过多智能体系统把任务成败的粗略反馈转化为逐步动作的详细批评理由,训练出更懂节制的批评模型,再用它优化执行策略,让8B小模型在可靠性指标上反超120B大模型,提升智能体在真实动态环境中的稳定表现。
论文提出NavMCP框架,用意图、观察、记忆三条通道把VLM推理与导航基础模型NFM结合,解决具身问答中长距离探索问题,在多个基准和真实机器狗测试中均取得最优效果。
研究发现教师模型批改学生生成内容时噪声率高达50%,但学生依然能进步。作者发现真正起作用的是压制学生自己低概率词,据此提出无需外部监督的OPSA方法,在AIME24等数学测试上带来最高307%的提升。
PaperGym提出一套把科研论文转化为AI训练环境的方法,解决科研计划生成缺乏可验证奖励的难题,通过问题答案分离降低评分标准泄露,结合自蒸馏与强化学习两阶段训练,让小模型在多个基准上超越更大规模的商业模型。