传送

借道虚空,瞬至原文

传送阵已启动
Mayx的博客 Mayx的博客 炼气期

近期LLM的部署与应用经历(3)

用更多的方式探索AI! 起因 在一年前,我整了张RTX4090 48GiB魔改版用来跑DeepSeek-R1 70B的4bit量化模型,不过都已经过了这么长时间,这个模型也已经是过时的东西了……我之前在Mac Studio M3 Ultra上试了一下OpenAI在半年前出的gpt-oss-120b模型,感觉效果还挺不错,只不过因为M3 Ultra的GPU实际性能比不上正经高端的独显,所以它在上下文...

2026-03-01 3383 字 12 阅
共 11 篇 | 总阅 107 次

3 秒后传送至原文