苹果大模型系列之 MLX 有多快?对 10 个 Apple Silicon 芯片和 3 个 CUDA GPU 进行全面基准测试,MLX、PyTorch MPS 和 CUDA GPU 上主要操作和层的基
发布时间
阅读量:
阅读量
简介
自发布以来不足两月,Apple 机器学习研究团队推出的最新成果 MLX 已在机器学习领域取得突破性进展。该框架迅速获得业界关注,这一成绩令人瞩目,目前 GitHub 上已有超过 12,000 个星标,同时 Hugging Face 平台上的社区成员数量持续增长,现已突破 500 人。
此前的文章中,我们曾展示 MLX 在训练基础图形卷积网络(GCN)时的性能表现,并与多种设备进行对比测试,包括 CPU、PyTorch 的 MPS 以及 CUDA GPU。测试结果十分积极,充分体现了 MLX 在提升模型运行效率方面的巨大潜力。
本次进一步探索中,我们对神经网络中广泛应用的多个核心操作进行了更为深入的性能评估与分析。

推荐文章
《Code Llama系列教程之 在 苹果笔记本macOS 上本地运行 Code Llama (打造自己的代码AI)》 指定权重1,涵盖llama类、本地类以及苹果类
《如何在个人苹果电脑 MacOS 上运行 Meta 的新模型 SeamlessM4T,进行语音/文本翻译和转录》 拥有权限1,涉及苹果
全部评论 (0)
还没有任何评论哟~
