用户总怀疑厂商偷偷把模型换成小的、把质量降下去。这期提到一个思路:这件事其实可以被证明——用抽样抽查加上一个可信的第三方随机数生成器,就能给出「我确实在用我声称的那个版本」的证据。
OpenAI 和微软终于谈成了。新结构下微软持股约 27%——而此前它投的是约 50% 的份额,被稀释得很明显。
OpenAI 这边拆成两部分:非营利实体,以及一个员工持股载体。2025 年这一轮的投资人占 15%,更早的投资人只剩 4%——今年这波投得太猛,前面的份额被冲得很薄。整体结构比之前清晰直接多了。
这是个长期争议:用户怀疑厂商悄悄把服务的模型换小、把质量降下来,但没法验证。
思路是:用抽样抽查的方式,验证返回结果确实来自声称的那个版本。只要有一个足够可信的第三方随机数生成器来决定抽查哪些请求,就能构成「我真的没有降质」的证明。
把「信任厂商的自觉」变成「可验证的机制」,这类设计在服务规模变大之后只会越来越必要。
在各家都在做稀疏注意力、各种高效注意力机制的时候,有个模型偏偏用了 full attention,团队还专门写文章解释为什么。
文章吐槽得挺狠,大意是:你们搞那些东西,本质是因为没有足够算力。
从榜单看它确实能打——在综合榜上能排到第五左右,这个位置国内模型此前极少达到。技术上的创新性倒不算特别强,话题性主要来自这篇文章本身。