Epoch AI
导航被拆成三段
Epoch AI 的首页左侧是一栏很长的导航,通篇看下来,它被拆成了三段。
头一段是工作入口:近期的、我们的工作、精选、趋势、数据、能力与基准、出版物、报告、洞察、通讯、播客。
第二段标题写着数据浏览器,下面列着六个对象:能力、模型、数据中心、芯片持有方、公司、关于使用情况的调查。
第三段标题写着自家的基准,下面列着四个名字。
三段之外还挂着一栏话题,长度超过前面任何一段。三段导航加一栏话题,构成了整页的骨架。
四把尺子,是自己造的
别人出题,它也出题
导航第三段那四个名字,是这个机构自己做的评测。这一段的位置排在数据浏览器之后,长度最短,但它把「自己出题」这件事摆进了主导航。
研究机构收别人的榜来整理,是常事。自己做一把尺子,是另一回事:要先决定考什么,再定怎么打分,最后为这个判断负责。
四个名字里,头一个叫能力指数,第二个叫镜像代码,第三个是前沿数学的开放问题集,第四个的名字读起来不像评测,更像一盒游戏的名字。
第四个名字没有做任何标注,也没有排在末位,就跟在第三个后面。四个名字并排,字号一致。
有一个是开放问题集
三个名字里有一个写明了是开放问题。也就是说,那套题里的一部分还没有标准答案。
一般的评测是把答案先定好,再让模型来答。开放问题集反了过来:题目先摆出来,答案还不知道。
一个研究机构敢把自己都没有答案的题编成一把尺子,是因为它要量的本来就不是「答对了几道」。
四把尺子
导航分三段
一段一个量级。
四把自造的尺子
摆在第二段里。
六个浏览器
按对象分开。
话题栏最长
比出版栏还长。
有一把像游戏名
读起来不像评测。
出版与数据并列
各占一段。
数据浏览器按对象分
第二段那六个入口,全部是同一类东西:可以自己点进去查的数据集。
六个对象分别是能力、模型、数据中心、芯片持有方、公司、使用情况调查。前两个管模型本身,中间三个管支撑模型的东西,最后一个管人。
把「芯片持有方」和「数据中心」单列出来,说明这个站对算力的兴趣不亚于对模型的兴趣。多数评测站只关心模型出多少分,不太关心这些分是在谁家的机房里跑出来的。
六个入口并列,各自成一个浏览器。名字都短,两到五个字,没有一句解释。
话题栏比出版栏还长
三段导航之后,另有一栏话题,纵向排开,条目数最多。
话题从进度、规模、软件、开源模型、能力与基准、数学,一路排到产业、头部公司、财务、地缘、基础设施、芯片、数据中心、能源、影响、采用情况、经济影响、未来。
话题的数量超过出版物一栏。也就是说,这个站用最长的一栏来交代它关心哪些方向,而不是交代它产出过什么。
它的顺序是:先给工具,再给数据,再给自己的尺子,最后给一张关心清单。
四层里,尺子排第三,关心清单排第四。它把判断排在工具之后。
一句话总结
Epoch AI 的首页左侧导航被拆成三段:头一段是工作与出版入口,第二段是六个按对象分的数据浏览器,分别对应能力、模型、数据中心、芯片持有方、公司和使用情况调查,第三段是它自己做的四把评测尺子,其中一把是还没有标准答案的开放问题集,还有一把的名字读起来像一盒游戏。三段之后另有一栏话题,条目数最多,用来交代它关心哪些方向。本站为条目陈列,不写金额,不提供任何资料文件。
要看那四把自造的尺子叫什么,从官网进去。







