
据悉,语音识别技术公司Novauris成立于2002年,总部设在英国,该公司十多年来一直致力于提高语音识别技术的研究,而苹果可能现已将这家公司收入麾下。
据科技博客网站TechCrunch于当地时间本周四报道称,苹果去年收购了语音识别技术公司Novauris,但无论是苹果还是Novauris,双方当时都未对外披露这笔交易。不过TechCrunch称其周四已向Novauris办公室致电确认并证实了这一消息。
苹果一直非常积极地致力于Siri的研究改良,希望能使得这个iOS移动操作系统中的虚拟个人助理更加有效地理解用户命令并执行。而自2011年Siri首次在苹果iPhone 4S上推出以来,这款应用就一直面临着来自其他虚拟助手应用的激烈竞争,如谷歌推出的Google Now和微软最新发布的Cortana。
Nouvaris擅长为设备提供自动语音识别技术,能够访问存储在本地设备或远程服务器上的信息,迅速进行查询回复。苹果目前的Siri主要是通过设备获取查询信息,然后将其传递到苹果远程服务器上,最终找到答案后再返回用户设备中。当然,我们现在还尚不清楚Novauris的语音识别技术将会从哪个方向帮助苹果改良Siri。
据TechCrunch表示,Novauris员工已于去年秋季加盟Siri团队。当TechCrunch致电Novauris办公室时,该公司回应称“苹果”,并证实苹果已于去年收购了这家公司。
正如过去一样,苹果不会证实它是否真的收购了Novauris,该科技巨头仅仅向TechCrunch表示,苹果会定期收购一些“小型技术公司”,但并不披露其“目的或计划”。
好文章,需要你的鼓励
这篇论文提出一种插件式2D动作接口,让已训练好的3D运动语言模型无需修改或微调即可直接理解2D姿态输入。实验证明2D输入效果媲美3D输入,且在真实视频场景下配合专门的降噪适配器,2D方案比3D姿态估计更省算力、更实用,为动作理解模型的现实部署提供了新路径。
研究团队让8种AI智能体独立完成100项真实科研任务,深度剖析800份研究轨迹后发现,即便是最强模型,也普遍存在"发现问题却不修正"的现象,背后根源指向AI缺乏检验自身产出、主动纠错的元认知能力。
WorldRover是一套面向可探索世界建模的合成视频数据引擎,基于虚幻引擎构建,能让同一段探索轨迹在保持路线与场景一致的前提下,重新渲染为多种视角和外观状态,并同步提供深度、光流、长程点追踪等丰富标注,最终发布WorldRover-10M数据集,含2190万帧、202.7小时视频。
这篇论文指出,现有多目标强化学习训练大模型时存在"一刀切"分配优化精力的问题,提出SA-MRPO方法,根据每个奖励目标的饱和程度动态调整其权重,在数学推理、自适应推理、代码生成等任务上均取得优于现有方法GDPO的效果。