这期有个测试结果挺反直觉:多语言版的大海捞针里,英文表现很好,中文排到倒数四五名,而波兰语表现相当不错。「高资源语言效果就好」这个解释,在这张表面前并不完全成立。
去年那次把 CEO 临时罢免的事,起因一直众说纷纭。最近一份法庭证词泄露了五十多页内容,看起来相当可信,一定程度还原了当时发生了什么。
其中一条是:发起者称自己已经密谋了一年,而且不是一个人——当时的 CTO 也参与其中。
这些材料之所以现在冒出来,是因为持续进行的诉讼——「你忘了初心,把 OpenAI 搞成了 ClosedAI」这条主线,逼出了一批必须公开的材料。
这台机器的反响普遍很差。虽然有 128GB 共享内存,能跑几十 B 的模型,但作为一台五千美元级的设备,算力还不如一块 3090——而 3090 只要几千块人民币。而且是 ARM 架构,跑很多东西还有额外障碍。
不过有人发现了它的一个亮点:FP64 性能很好。
大模型领域基本用不到 FP64,但科学计算大量依赖它——物理仿真那类。拿它去跑仿真,反而是说得通的。
把经典的大海捞针测试换成多语言版本之后,结果是:英文依然很好,中文排在倒数四五名的位置。
意外的是波兰语表现相当好。
常见的解释是「高资源语言效果就好」——语料多的语言表现自然更强。但这个解释放在这张表上并不完全成立:中文显然不缺语料,却排在后面。说明长上下文里的语言差异,另有来源。