刚刚!活水模型(42model)上线科研大模型 Intern-S2-397B
上海人工智能实验室开源的 3970 亿参数科研大模型书生-S2,官方全精度约 807GB。我们把它压到 98GB,一台 128GB 内存的 Mac 就能本地运行。
小编的话:读论文、推公式、查一个跨学科的概念,科研里最费神的往往是那几步推理。可是没发表的数据、还在写的稿子,你未必愿意上传到云端。活水模型今天上线科研大模型 Intern-S2-397B(书生-S2),一台 128GB 内存的 Mac 就能在本地跑起来。
深夜改论文,卡在一段推导上。你想找个懂行的帮手一起捋一遍,又不想把尚未发表的实验数据贴进网页里的对话框。
书生-S2 能帮上的就是这一步。按官方介绍,书生-S2 的科研能力在开源模型里排在前列;现在,这个模型可以装进你自己的电脑。
书生-S2 从哪里来
书生-S2 由上海人工智能实验室研发,2026 年 9 月以 Apache-2.0 许可开源,正式名称是 Intern-S2-397B,总参数 3970 亿。
据官方介绍,书生-S2 的通用能力(知识、代码、智能体)达到开源模型第一梯队。在生命科学与材料结构相关的理解、生成和设计任务上,比如 Biology-Instructions、Mol-Instructions,它大幅领先其他开闭源旗舰模型。在 IMO-Proof、AdvancedMathBench 等强调长程严谨推理的竞赛数学与高等数学基准上,它整体领先现有开源模型,并达到 Gemini 3.1 Pro 等顶尖闭源模型的水平。
书生-S2 用的是 MoE(混合专家)结构。好比一个有 512 位专家的团队,每写一个 token(模型处理文字的最小单位)只请其中 10 位出场,所以计算量不大;可哪一步会请到谁事先不知道,所有专家都得常驻内存,对内存的要求一点不低。
内存于是成了难点。官方全精度权重约 807GB,8 比特版也要 400 多 GB,普通电脑装不下。活水模型做的,是把书生-S2 压缩成一台 128GB 内存的 Mac 装得下的版本。量化就是降低数值精度来缩小体积,我们把它压到 98GB,平均每个参数不到 2 比特,同时把对压缩最敏感的部分(比如每个字都要经过的注意力层)保留在 8 比特。压缩后,我们在一份它从没见过的中文文档上和 8 比特版逐字对比,81.2% 的位置两者选出的下一个字相同。
书生-S2 强在哪里,在本机跑得怎样
我们在 Apple M3 Max(128GB 内存)上实测了四道题:一句话解释量子纠缠、写一段 150 字的长城简史、一道火车到站时间的应用题、一段 Python 代码。火车题和代码题给出了正确答案;两道中文题在我们设的输出长度内还没写完思考过程、没给出最终答案,但思考里写出的草稿准确、通顺。下面这张是火车题的原始输出:

书生-S2 会先写思考过程再作答。在我们测的几道题里,它都先把条件、步骤、验算写一遍,再给出结论,你能看到答案是怎么得出的。
速度方面,在这台电脑上每秒生成约 6 到 15 个 token,视上下文长短而定。电脑配置不同,速度也会不同。
同样来自实测的局限,用之前要知道:
- 速度偏慢。 先想后答,在我们测的几道题里,思考过程都比答案长得多,一个问题要等上一阵。适合认真推一道题,不适合随口闲聊。
- 压缩很激进。 每个参数不到 2 比特,与原版相比多少有损失,所以它归在「前沿」实验模型里。上面的对比只在一台电脑、一份中文文档上完成,重要结论请回到原始文献核对。
- 只含文本部分。 官方原版能看图,这个版本暂不支持图片输入。
如何下载
- 打开活水模型桌面版,点左侧「模型」,切到「发现」;
- 在能力分类里选「科研」,找到 Intern-S2-397B(卡片上标着「前沿」);
- 点「一键下载」,弹出「下载前自检」;
- 在「存到哪块盘」里选一块外置盘(没有列出的话点「注册其它盘…」添加),自检会查这块盘的格式、剩余空间和读写速度;
- 勾选「我已知晓风险」,点「下载」。
模型文件 98GB,需要至少 128GB 内存的电脑,外加一块剩余空间 100GB 以上的外置盘。80GB 以上的前沿模型一律存到外置盘,不占用系统盘;盘越快,下载和加载越快。下载完成后会自动校验文件完整性。如果列表里还没有它,重启一次活水模型即可刷新。
如何使用
科研类模型在桌面版里没有单独的对话页面,装好后卡片上会提示「在 agent 客户端中使用」。有两种用法。
第一种,在命令行里直接问它,一问一答:
42model run intern-s2 "用三句话解释什么是 KL 散度"
第二种,让你常用的 AI 客户端调用它。活水模型在本机提供标准接口,在桌面版左侧的「接入」页可以看到本地端点地址,按标准协议接进去即可。接好后,客户端里的每一次提问都由你电脑上的书生-S2 回答,资料不出本机。
常见问题
问题 1:书生-S2 免费吗?可以商用吗?
免费。它以 Apache-2.0 许可开源,个人和商业用途都可以使用,只需保留上游的版权与许可声明。
问题 2:在本地使用书生-S2,建议什么配置?
至少 128GB 内存,外加一块剩余空间 100GB 以上的外置盘(前沿模型不占用系统盘)。我们在 Apple M3 Max(128GB 内存)上测得每秒约 6 到 15 个 token;内存不足 128GB 的电脑放不下它。
问题 3:活水模型(42model)是免费的吗?
在你电脑上下载和运行模型不收费。云端微调等需要算力的服务另外计费,用之前会先告诉你要扣多少。
问题 4:简单上手的方法是什么?
把这篇文章直接交给你的 AI 助手。Claude Code、Codex 这类助手能在你的电脑上替你执行操作,业内叫它们 Agent。告诉助手「照着这篇帮我装好书生-S2,再用它帮我检查一段推导」,剩下的步骤助手会替你做。
活水互动
你的研究里,最想让一个本地大模型帮你推一遍的是哪一步?一段数学证明、一个实验设计,还是一篇看不太懂的论文?在评论区说说,我们挑几个问题,用书生-S2 现场推给你看。
活水 AI 实验室(42ailab) — 探索智能边界的 AI 创新实验室,以认知科学为基石,推动 AI 与人类智能的深度融合,真正理解并增强智能 —— 碳基的,也是硅基的。
活水模型(42model) — 由活水 AI 实验室出品的高性能本地 AI 大模型推理引擎,让翻译、转写、识别、对话、编程等 AI 能力在你的本机免费私密运行;并可借云端算力微调专属模型,回传本机运行。