上海AI实验室端砚每月送免费Token,10墨点按缓存算够5亿

上海人工智能实验室有个科学发现平台叫书生·端砚(英文名Intern InkStone),最近开放了模型接口,官方公告写明:测试期间,每位用户每月可获免费Token。

端砚首页slogan

这个平台听着挺学术,其实用起来就是填个API Key就能调用大模型,跟市面上的白嫖额度一个路子,只是背后是上海AI实验室。

入口是书生·端砚墨点计划,接口地址 https://discovery-api.intern-ai.org.cn/v1。

墨点计费规则

账户里的余额单位叫墨点,每月送10墨点。调用时从账户额度里扣墨点,所以关键在于哪个模型、算哪一类Token。

目前开放10款模型,分两类:

  • 3款限时免费:输入、输出单价都是0墨点,不扣额度
  • 7款第三方模型:按各自价格扣墨点

3款限时免费的模型ID如下,配置时照填:

  • 书生-S2
  • Atria-Dawn-Preview
  • Agents-A1

10墨点到底能跑多少

官方页面写着:1墨点最多抵扣5000万Token,并以DeepSeek-V4-Flash为例。

这句话读起来很吓人,但同一笔额度按不同类别算,差20倍。同样10墨点:

用量类别 单价 10墨点能跑
缓存命中输入 0.02墨点/百万Token 5亿Token
缓存未命中输入 1墨点/百万Token 1000万Token
输出 4墨点/百万Token 250万Token

所以「5亿」是理论上限,不是日常能用的量。它成立的前提是几乎全命中缓存、而且几乎不输出。真按对话的输出来算,10墨点是250万,差20倍。

这三个数字我都用官网单价自己算过,和官方口径一致。

几个限制得先看清

墨点是全账户共享的。 所有API Key共用一个墨点余额,调用量合并计算,不是每个Key各给一份。RPM(每分钟请求数)和TPM(每分钟Token数)也是所有Key共享。

免费额度只确认适用于测试期间。 官方公告只说「测试期间每月可获免费Token」,赠送量、重置日期、测试结束时间都没有公开。所以它不是承诺长期有效的额度。

3款限时免费模型的截止时间也没公布。 所以这3款随时可能恢复扣费。

不过即使恢复扣费,另外7款第三方模型还在,每月的10墨点也照送。

平台是干什么的

顺带说一下端砚本身。

它是上海AI实验室2026年7月发布的,9月13日在浦江创新论坛上升级了全栈服务。平台名字取自文房四宝里的砚台,定位是「连接科研全流程的智能工作台」。

目前接了两款自研模型:书生S2(科学多模态大模型,提供长程科研和智能体能力)和书生W0(物理世界模型)。宣称已在生命科学、关键材料、半导体、核聚变、量子、地球气象六个方向落地,在蛋白质进化和新材料研发上跑通了从计算设计到实验验证的闭环。

跟普通人的关系:科研那套用不上,但墨点计划这部分就是个普通的大模型免费额度,填Key就能调。

Tips

  • 平台是上海AI实验室的书生·端砚,英文名Intern InkStone
  • 测试期间每位用户每月送10墨点免费Token,官方公告写明
  • 入口discovery.intern-ai.org.cn/token-plan/home,接口 discovery-api.intern-ai.org.cn/v1
  • 3款限时免墨点模型(输入输出都是0墨点):书生-S2、Atria-Dawn-Preview、Agents-A1
  • 另有7款第三方模型按各自价格扣墨点
  • 官网口径1墨点最多抵5000万Token(以DeepSeek-V4-Flash为例)
  • 10墨点的三种算法:缓存命中输入0.02墨点/百万 = 5亿;缓存未命中1墨点/百万 = 1000万;输出4墨点/百万 = 250万
  • 5亿是理论上限,实际按输出算只有250万,差20倍,别被数字误导
  • 所有API Key共享一个墨点余额,调用量合并计算,RPM和TPM也是共享的
  • 接口同时支持OpenAI协议和Anthropic协议
  • 免费额度只确认适用于测试期,赠送量、重置日期、测试结束时间均未公开
  • 3款限时免费模型的截止时间也未公布,随时可能恢复扣费
  • 平台2026年7月发布、9月13日升级全栈服务,自研模型有书生S2和书生W0
  • 支持领域含生命科学、关键材料、半导体、核聚变、量子、地球气象,但墨点计划这部分跟科研无关,普通开发者直接填Key就能用