上海AI实验室端砚每月送免费Token,10墨点按缓存算够5亿
上海人工智能实验室有个科学发现平台叫书生·端砚(英文名Intern InkStone),最近开放了模型接口,官方公告写明:测试期间,每位用户每月可获免费Token。

这个平台听着挺学术,其实用起来就是填个API Key就能调用大模型,跟市面上的白嫖额度一个路子,只是背后是上海AI实验室。
入口是书生·端砚墨点计划,接口地址 https://discovery-api.intern-ai.org.cn/v1。
墨点计费规则
账户里的余额单位叫墨点,每月送10墨点。调用时从账户额度里扣墨点,所以关键在于哪个模型、算哪一类Token。
目前开放10款模型,分两类:
- 3款限时免费:输入、输出单价都是0墨点,不扣额度
- 7款第三方模型:按各自价格扣墨点
3款限时免费的模型ID如下,配置时照填:
- 书生-S2
- Atria-Dawn-Preview
- Agents-A1
10墨点到底能跑多少
官方页面写着:1墨点最多抵扣5000万Token,并以DeepSeek-V4-Flash为例。
这句话读起来很吓人,但同一笔额度按不同类别算,差20倍。同样10墨点:
| 用量类别 | 单价 | 10墨点能跑 |
|---|---|---|
| 缓存命中输入 | 0.02墨点/百万Token | 5亿Token |
| 缓存未命中输入 | 1墨点/百万Token | 1000万Token |
| 输出 | 4墨点/百万Token | 250万Token |
所以「5亿」是理论上限,不是日常能用的量。它成立的前提是几乎全命中缓存、而且几乎不输出。真按对话的输出来算,10墨点是250万,差20倍。
这三个数字我都用官网单价自己算过,和官方口径一致。
几个限制得先看清
墨点是全账户共享的。 所有API Key共用一个墨点余额,调用量合并计算,不是每个Key各给一份。RPM(每分钟请求数)和TPM(每分钟Token数)也是所有Key共享。
免费额度只确认适用于测试期间。 官方公告只说「测试期间每月可获免费Token」,赠送量、重置日期、测试结束时间都没有公开。所以它不是承诺长期有效的额度。
3款限时免费模型的截止时间也没公布。 所以这3款随时可能恢复扣费。
不过即使恢复扣费,另外7款第三方模型还在,每月的10墨点也照送。
平台是干什么的
顺带说一下端砚本身。
它是上海AI实验室2026年7月发布的,9月13日在浦江创新论坛上升级了全栈服务。平台名字取自文房四宝里的砚台,定位是「连接科研全流程的智能工作台」。
目前接了两款自研模型:书生S2(科学多模态大模型,提供长程科研和智能体能力)和书生W0(物理世界模型)。宣称已在生命科学、关键材料、半导体、核聚变、量子、地球气象六个方向落地,在蛋白质进化和新材料研发上跑通了从计算设计到实验验证的闭环。
跟普通人的关系:科研那套用不上,但墨点计划这部分就是个普通的大模型免费额度,填Key就能调。
Tips
- 平台是上海AI实验室的书生·端砚,英文名Intern InkStone
- 测试期间每位用户每月送10墨点免费Token,官方公告写明
- 入口
discovery.intern-ai.org.cn/token-plan/home,接口discovery-api.intern-ai.org.cn/v1 - 3款限时免墨点模型(输入输出都是0墨点):书生-S2、Atria-Dawn-Preview、Agents-A1
- 另有7款第三方模型按各自价格扣墨点
- 官网口径1墨点最多抵5000万Token(以DeepSeek-V4-Flash为例)
- 10墨点的三种算法:缓存命中输入0.02墨点/百万 = 5亿;缓存未命中1墨点/百万 = 1000万;输出4墨点/百万 = 250万
- 5亿是理论上限,实际按输出算只有250万,差20倍,别被数字误导
- 所有API Key共享一个墨点余额,调用量合并计算,RPM和TPM也是共享的
- 接口同时支持OpenAI协议和Anthropic协议
- 免费额度只确认适用于测试期,赠送量、重置日期、测试结束时间均未公开
- 3款限时免费模型的截止时间也未公布,随时可能恢复扣费
- 平台2026年7月发布、9月13日升级全栈服务,自研模型有书生S2和书生W0
- 支持领域含生命科学、关键材料、半导体、核聚变、量子、地球气象,但墨点计划这部分跟科研无关,普通开发者直接填Key就能用