生成式AI的创新和发展速度前所未有,而这仅仅是一个开始。人们使用这项技术的方式、场景和原因将会非常广泛,甚至超乎想象。初步估计显示,生成式AI市场规模将达到1万亿美元。

生成式AI不仅有望改变人们搜索和创作内容的方式,还能够改善日常生活。借助生成式AI,智能手机能够成为真正的数字助手,让用户自然地沟通交流,并获得贴切的回答。PC用户可以利用这项技术阅读或撰写电子邮件、起草文档和自动创建演示文稿。在驾乘汽车时,对话式车内助手可以对汽车充电、购买停车券或在回家途中预订晚餐提供建议。商店的AI服务台和智能购物车能够根据每周特惠、预算金额和家庭偏好,帮助消费者拟定食谱。
为了释放这项技术的全部潜能并满足日益增长的需求,生成式AI既需要云,也需要数十亿能够以低功耗进行高性能AI计算的网联终端,如智能手机、PC和汽车。这就是混合AI。混合AI计算架构在云端和终端进行分布式处理,能够优化效率并提升整体用户体验。
生成式AI处理可以直接在终端侧运行,也可以按需发送到云端,或者将两者相结合——无论采取何种方式,对用户而言都是无缝实现的。
用户期望拥有与传统搜索类似的体验,那就是能够瞬间显示搜索结果。要满足这样的期望,还要保证服务质量,仅利用云端处理的成本太高,尤其是在需求高峰期,因此难以实现规模化。
数据中心能耗高且价格昂贵。据估计,每一次基于生成式AI的网络搜索查询(query),其成本是传统搜索的10倍。以每天超过100亿次查询计算,每年的增量成本可能达到数十亿美元。网络搜索只是生成式AI变革多个行业的众多方式之一。
除成本外,在云端进行全部推理处理还面临隐私、可靠性和性能方面的挑战。当请求进入云端、数据离开终端时,就会产生潜在的安全问题。事实上,由于收集和存储个人数据等监管和合规问题导致模型被禁用或暂时禁用的情况已经出现。
混合AI势不可挡。随着人们不断探寻使用生成式AI的新方式,对云基础设施的需求将激增。混合AI处理将是计算的下一次转型,正如我们所看到的从大型主机演进到台式机,再到今天云和我们手中的终端相结合的模式一样。
利用高性能、低功耗终端的处理能力,将能够高效推动生成式AI的规模化扩展。云端和终端将协同工作,通过强大、高效且高度优化的AI功能,打造下一代用户体验。
本文原载于Fortune.com:https://fortune.com/2023/05/15/qualcomm-ceo-ai-is-going-to-touch-every-corner-of-our-lives-devices-tech-cristiano-amon/
好文章,需要你的鼓励
这篇论文提出一种插件式2D动作接口,让已训练好的3D运动语言模型无需修改或微调即可直接理解2D姿态输入。实验证明2D输入效果媲美3D输入,且在真实视频场景下配合专门的降噪适配器,2D方案比3D姿态估计更省算力、更实用,为动作理解模型的现实部署提供了新路径。
研究团队让8种AI智能体独立完成100项真实科研任务,深度剖析800份研究轨迹后发现,即便是最强模型,也普遍存在"发现问题却不修正"的现象,背后根源指向AI缺乏检验自身产出、主动纠错的元认知能力。
WorldRover是一套面向可探索世界建模的合成视频数据引擎,基于虚幻引擎构建,能让同一段探索轨迹在保持路线与场景一致的前提下,重新渲染为多种视角和外观状态,并同步提供深度、光流、长程点追踪等丰富标注,最终发布WorldRover-10M数据集,含2190万帧、202.7小时视频。
这篇论文指出,现有多目标强化学习训练大模型时存在"一刀切"分配优化精力的问题,提出SA-MRPO方法,根据每个奖励目标的饱和程度动态调整其权重,在数学推理、自适应推理、代码生成等任务上均取得优于现有方法GDPO的效果。