奔腾2 CPU+128MB内存成功运行Llama大模型：速度还挺快--快科技--科技改变未来

正文内容 评论（0）

奔腾2 CPU+128MB内存成功运行Llama大模型：速度还挺快

2024-12-30 10:38:46 出处：快科技作者：黑白编辑：黑白评论(0)

#奔腾 #Windows 98

快科技12月30日消息，据媒体报道，EXO Labs最近发布了一段视频，展示了在一台26年历史的Windows 98奔腾2 PC上运行大模型（LLM）。

这台主频350MHz电脑成功启动进入Windows 98系统，随后EXO启动了基于Andrej Karpathy的Llama2.c定制的纯C推理引擎，并要求LLM生成关于“Sleepy Joe”的故事，令人惊讶的是生成速度相当可观。

EXO Labs的这一壮举并非偶然，该组织自称为“民主化AI”而生，由牛津大学的研究人员和工程师组成，他们认为，少数大型企业控制AI对文化、真理和社会的其他基本方面是不利的。

因此，EXO希望建立开放的基础设施，训练前沿模型，并使任何人在任何地方都能运行它们，这项在Windows 98上的AI演示，展示了即使在资源极其有限的情况下也能完成的事情。

EXO Labs在文章中详细描述了在Windows 98上运行Llama的过程，他们购买一台旧的Windows 98 PC作为项目基础，但面临了许多挑战。

将数据传输到老设备上就是一个不小的挑战，他们不得不使用“老式的FTP”通过古老机器的以太网端口进行文件传输。

编译现代代码以适应Windows 98可能是一个更大的挑战，EXO找到了Andrej Karpathy的llama2.c，可以总结为“700行纯C代码，可以运行Llama 2架构模型的推理”，Karpathy曾是特斯拉的AI主管，也是OpenAI的创始团队成员。

利用这个资源和旧的Borland C++ 5.02 IDE和编译器（以及一些轻微的调整），代码可以被制作成Windows 98兼容的可执行文件并运行，GitHub上有完成代码的链接。

使用260K LLM和Llama架构在Windows 98上实现了“35.9 tok/s”的速度，根据EXO的博客，升级到15M LLM后，生成速度略高于1 tok/s，Llama 3.2 1B的速度则慢得多，为0.0093 tok/s。

【本文结束】如需转载请务必注明出处：快科技

责任编辑：黑白

文章内容举报

文章价值打分

当前文章打分0 分，共有0人打分

0
0
0
打赏
|

分享好友:
分享至QQ
分享至微博
分享至QQ空间
|

生成海报

本文收录在

#奔腾 #Windows 98 #大模型

好物推荐

换一波

关注我们

微博：快科技官方
快科技官方微博
今日头条：快科技
带来硬件软件、手机数码最快资讯！
抖音：kkjcn
科技快讯、手机开箱、产品体验、应用推荐...

正文内容 评论（0）

相关资讯

文章价值打分

本文收录在

热门文章

换一波

好物推荐

换一波

关注我们

微博：快科技官方

今日头条：快科技

抖音：kkjcn

热点推荐

好物推荐

图片信息

正文内容 评论（0）

相关资讯

文章价值打分

本文收录在

热门文章 换一波

好物推荐 换一波

关注我们

微博：快科技官方

今日头条：快科技

抖音：kkjcn

热点推荐

好物推荐

图片信息

正文内容评论（0）

热门文章

换一波

好物推荐

换一波