1. 创业头条
  2. 前沿领域
  3. AI智能
  4. 正文

CPU上跑AI?从推荐系统的演进看CPU的崛起

 2024-04-16 14:13  来源:互联网  我来投稿 撤稿纠错

  一键部署OpenClaw

在信息和数据极度繁荣的当下,人工智能正在通过各种方式影响着人类生活。其中,AI推荐系统作为互联网时代最关键的伴生技术之一,正在帮助人类梳理着各种纷繁杂乱的信息,让资源实现更精准的调配,让一切变得井然有序。

推荐系统:数字营销的重要引擎

当你到一座旅游城市,不知道当地有什么美食时,AI推荐系统在手机上的本地生活平台会为你列出当地所有美食;

当你在线上购物,不知道时下有哪些新款式衣服时,AI推荐系统在电商平台上又会为你列出应季又适合你的衣服。

对于企业而言,AI推荐系统更为重要,在浩渺的商业世界里,AI推荐系统就像一条秩序链,通过这条秩序链,数以千万计的企业得以找到分布在全球各地最需要他们产品的用户。

上海市人工智能行业协会秘书长钟俊浩指出:“随着人工智能技术的迅速发展及软硬件进步,我们正步入一个AI技术广泛应用并深刻影响各行各业的新时代,与此同时,如今电商、个性化广告等诸多商业场景背后都在以AI推荐系统作为依托,AI推荐系统已经是人工智能技术在商业领域最为成熟的应用之一。”

数字营销就是使用了AI推荐系统的一个主要场景, 作为国内领先的商业数字营销平台,阿里妈妈就在用AI推荐系统为企业提供全链路的营销解决方案。

阿里妈妈的使命是“让天下没有难做的营销”,通过自研的数字营销平台,阿里妈妈每年都在为各行各业的商家和品牌解决一系列营销和广告投放问题,通过精准营销帮助商家将产品推广到最需要他们的消费者面前,从而帮助企业实现他们应有的价值。

为了将海量商品与消费者进行更加精准的匹配,阿里妈妈的AI推荐算法和模型在过往几年里一直在不断升级迭代,与此同时,日益复杂的AI模型也使得AI推荐系统对硬件算力的需求越来越高。

“线上购物已经很普遍,实际上,每次用户在线上浏览商品都会涉及百亿量级的浮点运算”,阿里妈妈软件工程师刘征宇解释称。

由此带来的是日益增长的算力需求和有限算力供给之间的矛盾,这一矛盾也成了像阿里妈妈这样基于人工智能技术开展数字营销业务的企业的一大痛点。

要解决这一痛点,最直接的方法就是增加AI算力、优化AI算法。尤其是AI算力的提升,是数字营销业务不断升级迭代最重要的保障。

是挑战也是机遇,最适合的才是最好的

<iframe src="https://icon.zhiding.cn/swf/videoPlayer-new.html?Id=1951_4c6cba191ed082853f06c31ed021cc88&width=640&height=360" width="640" height="360" frameborder="0" data-mce-fragment="1"></iframe>

大模型的出现,让GPU呼声越来越高,似乎GPU在一夜之间成了人工智能技术在算力上的唯一选择。

其实不然,在数字营销这样实际商业应用场景中,GPU不仅不是唯一选择,甚至也可能不是最优解。

实际上,人工智能技术对于算力的强需求主要来自于AI训练和AI推理两方面。而要想将人工智能技术转化为各行各业的生产力,帮助各行各业提升生产效率,最关键的是AI推理。

钟俊浩也做过解析:“在大模型深入产业的这一年里,越来越多行业开始关注AI推理,而如何将CPU发挥到极致,加速AI推理,并推动其产业落地就成了关键问题。”

某些硬件厂商对于推荐系统、语音识别、图像识别、基因测序这样传统的AI应用,在CPU上已经做了大量的优化。特别是在执行AI推理任务时,经过优化的大模型在CPU上已经可以实现高效执行。 

英特尔数据中心和人工智能集团至强生态赋能事业部(中国)总经理李亚东就指出:“当模型很大,涉及到需要跨异构平台计算时,使用CPU速度反而更快,效率也更高。”

2023年12月,英特尔在国内正式发布了第五代至强<sup>®</sup> 可扩展处理器,它从多方面提升了硬件算力,包括频率,功耗,LLC缓存,内存带宽和延迟都有明显的改进。

最关键的是它内置的英特尔<sup>®</sup> 高级矩阵扩展(英特尔<sup>®</sup> AMX技术),特别针对深度学习模型最常见的矩阵乘法运算优化,支持BF16(训练/推理)和INT8(推理)等常见数据类型。

英特尔<sup>®</sup> AMX位于每个CPU内核上并靠近系统内存,可减少数据传输延迟、提高数据传输带宽,并且同步降低实际使用上的复杂性。

实际上,在目前AI推荐系统面临的硬件算力挑战中,CPU已经成了解决AI推理计算需求的核心算力。

据刘征宇透露:“阿里妈妈在选择以第五代英特尔<sup>®</sup> 至强<sup>®</sup> 可扩展处理器作为算力平台,使用英特尔<sup>®</sup> AMX和AVX-512优化后,针对广告推荐模型,性能相比第四代至强<sup>®</sup> 可扩展处理器有了明显提升,在满足SLA的前提下,吞吐量提升(达)1.52倍。”

基于此,阿里妈妈通过不断提升算力和优化算法,使得整个营销链条更加丝滑,也更加智能高效。

除了硬件创新,英特尔在软件方面也在持续发力,以确保现有的AI框架和应用能够充分发挥出硬件潜力。

英特尔不仅持续为主流开源框架PyTorch、TensorFlow等贡献力量,还提供了多种针对CPU平台的优化插件,如IPEX(Intel<sup>®</sup> Extension for PyTorch)、ITEX(Intel<sup>®</sup> Extension for TensorFlow)等,同时提供了诸如xFT(xFasterTransformer)、OpenVINO™ 工具套件等多种优化工具。

“最适合的,才是最好的,我们现在最需要的不是无限高的算力,而是拥有足够算力的超能战士。”刘征宇进一步解释称。

同样, CPU平台广泛部署、易于获取,便于应用和优化,能兼顾通用计算又能做推理加速,且不用为此导入异构带来的各种复杂性,自然就会收获高效的应用表现、落地速度和更强的成本竞争力。

以阿里妈妈所在的数字营销应用场景为例,无论是矩阵乘法这样计算密集型的AI运算,还是数据查询这样访存密集型的AI运算,都离不开CPU的参与。

即便是在CPU-GPU协同应用场景中,GPU这样协处理器的算力发挥作用,也非常依赖CPU的处理速度。

用CPU加速AI落地,未来可期,大有可为

如果说2023年是大模型技术爆发的一年,那么,2024年就是大模型深入产业应用的关键年。不论是大模型还是传统的AI技术,要想得到落地,做到“快、好、省”才是关键。

CPU能确保整个系统的稳定运行、各组件的高效通信协作,并最终推进任务的顺利执行。

除了热门的AI推理和训练,一条AI流水线中还包括数据预处理、后处理等可能需要CPU通用处理能力的环节。在这些环节中,CPU具备的通用性和灵活性,能够适应各种不同的计算场景,适应广泛的应用需求。

第五代至强<sup>®</sup> 可扩展处理器充分考虑到这些需求,内置了诸如英特尔<sup>®</sup> 数据流加速器(英特尔<sup>®</sup> DSA)来主攻数据存储与传输;英特尔<sup>®</sup> 存内分析加速器 (英特尔<sup>®</sup> IAA)来针对数据库和数据分析加速;英特尔<sup>®</sup> 数据保护与压缩加速技术(英特尔<sup>®</sup> QAT)来加速数据压缩、对称和非对称数据加密解密,提高CPU效率和整体系统性能。

李亚东还指出:“从企业长远发展来看,CPU在稳定性、安全性等方面的表现值得信赖,这对于保护企业数据和客户隐私至关重要。第五代至强<sup>®</sup> 可扩展处理器内置的英特尔<sup>®</sup> SGX和TDX,可以为企业分别提供更强、更易用的应用隔离能力和虚拟机层面的隔离和保密性,为现有应用提供了一条更简便的向可信执行环境迁移的路径。”

未来英特尔数据中心产品组合,预计可以覆盖通用计算与AI加速,实现从数据预处理、到模型训练与优化,再到部署与推理的AI“全管线”加速。

CPU不仅是老伙伴,还是新变量,随着新一代CPU在各方面性能的不断提升,CPU也正在成为为千行万业企业智能化转型提供源源不断动力的心脏。

正如钟俊浩所说:“持续创新和进化的CPU,在全新技术周期下,成为一代又一代科学家留给新时代最好的礼物。”

申请创业报道,分享创业好点子。点击此处,共同探讨创业新机遇!

相关文章

  • 黄仁勋与马斯克同日发声:中国将成为全球AI领导者

    当地时间7月25日,两位全球科技界的标志性人物——英伟达CEO黄仁勋和特斯拉CEO埃隆·马斯克——在同一天公开谈及中国人工智能发展。两人给出了几乎相同的判断:中国将成为全球AI领导者。黄仁勋此前在接受采访时明确表示,美国企业完全应当被允许使用来自中国的开源AI模型。他说得很直白:“这些中国模型非常优

  • AI应用概念股爆发:资金正在从“造AI”转向“用AI”

    7月27日,A股市场AI应用概念盘中异动拉升——智度股份直线涨停,此前苏州科达涨停,米奥会展涨超15%,宣亚国际、游族网络、福石控股、中文在线等跟涨。创业板人工智能板块同样表现强势,联特科技涨超6%,致尚科技、富瀚微涨超4%。人工智能ETF华夏持仓股中,海康威视涨4.62%领涨。为什么AI应用概念突

    标签:
    ai智能
    ai技术
  • 硅谷撕裂:开源 vs 闭源,一场由中国AI引爆的内战

    7月,硅谷爆发了一场前所未有的内战。一方是OpenAI和Anthropic。它们认为,某些AI模型过于危险,不应以开放方式开发,而必须由像它们这样的企业进行严格控制。另一方是微软、英伟达、谷歌、Meta。它们主张开源AI模型必须保持开放,以便人们进一步开发技术、创立新的业务。这场争论的导火索是什么?

  • Kimi K3正式开放下载:2.8万亿参数,全球最大开源模型来了

    7月27日,月之暗面正式开放旗下模型KimiK3供公众下载。2.8万亿参数是什么概念?这是全球参数规模最大的开源权重模型。上下文窗口支持高达100万Tokens,能够在单次提示中处理大量文件或代码库。KimiK3于7月16日正式对外发布,在Arena全球AI大模型榜单的FrontendCodeAre

  • 科学智能产业化爆发前夜:AI正在把“十年”变成“三天”

    在上海举办的WAIC2026上,AIforScience(科学智能,简称AI4S)成为最密集出现的词汇之一。多位专家判断,科学智能未来2-3年将进入产业化爆发期。AI到底给科研带来了多大改变?中国科学院发布了磐石·科学基础大模型2.0,依托800万条高质量科学推理数据。据中国科学院自动化研究所研究员

  • 英伟达豪掷2500亿美元为OpenAI“兜底”:全球最大数据中心要来了

    7月27日,一则消息引爆全球科技圈——英伟达正在与OpenAI谈判,拟为其提供约2500亿美元的融资担保。如果算上数据中心内部使用的芯片,总投资规模可能达到约5000亿美元,这将是迄今为止宣布的规模最大的数据中心项目。这个项目有多大?该项目位于美国俄亥俄州南部,由日本软银集团旗下的能源子公司开发,规

    标签:
    英伟达
    ai智能
  • 2026年最新调用Kimi K3的路径:API接入非线智能API实现稳定高并发

    在2026年的AI应用开发生态中,大语言模型已成为驱动业务创新的核心引擎。对于国内的技术团队和决策者而言,如何在生产环境中稳定、高效地调用全球顶尖的AI大模型,尤其是像KimiK3这样备受关注的模型,是一个至关重要的技术选型问题。常常面临网络延迟高、连接不稳定、甚至服务中断的风险,这直接影响了用户体

    标签:
    AI大模型
  • 为什么说非线智能API是2026国内Claude开发者最便捷稳定的AI大模型API中转接入方式

    在2026年的今天,大模型应用早已从“能不能用”的探索阶段,全面迈向了“如何用得稳、用得好、用得值”的生产力深耕期。对于国内广大的技术从业者、AI应用开发者以及企业级决策者而言,接入顶级大模型,尤其是以强大推理和代码能力著称的Claude系列,早已不是技术上的难题,而是横亘在面前的“稳定性、合规性、

    标签:
    OpenClaw
  • 端侧AI概念股逆势涨停:7款手机AI获批备案,合规化加速落地

    7月24日,A股市场整体表现平淡,但端侧AI概念板块却逆势活跃。博通集成(603068)盘中直线拉升涨停,晶晨股份、翱捷科技、瑞芯微、乐鑫科技、全志科技等个股纷纷跟涨。消息面的催化剂是什么?近日,依据《生成式人工智能服务管理暂行办法》,中国网信网公布了新增的7款提供手机端侧生成式人工智能服务的备案信

    标签:
    手机ai
  • 微软发布两款自研AI模型:不抄别人作业,自己从头写

    当地时间7月23日,微软宣布推出两款新的自研AI模型——MAI-Image-2.5-Pro和MAI-Voice-2-Flash,目前均已进入公开预览阶段。这两款模型分别面向高质量图像生成和高并发语音交互场景。但真正让行业关注的,不是它们的功能,而是微软做这两款模型的方式。微软说了三句话,句句都有深意

热门排行

编辑推荐