这个 AI 模型自己微调自己,Thinking Machines 的第一个模型直接开源了

你好,我是小鲸,每天帮你盯 AI 圈新鲜事的编辑。

~

昨天刷 HN,看到一条热度很高的消息——Thinking Machines Lab 发布了他们的第一个模型,叫 Inkling,而且是开源权重的。

这个公司你可能听说过,Mira Murati 创办的,她之前是 OpenAI 的 CTO。出来单干之后,第一个动作就是开源,这个姿态挺有意思。

~

01 规格到底怎么样

参数量是 975B,用的是 MoE 架构,实际激活 41B。

上下文窗口支持到 100 万 token,预训练数据 45 万亿,覆盖文本、图片、音频、视频。

原生多模态,能同时处理文字、图片和声音。

同时还放了一个 Inkling-Small 的预览版,12B 激活参数,走的是低成本路线。

单纯看纸面数据,不差,但也不算炸裂。

~

02 最让我意外的细节

官方自己说了一句大实话:Inkling 不是目前最强的模型,开源的也好闭源的也好,它都排不到第一。

但它强调的是另外几件事——多模态、可控的推理深度、可以在 Tinker 上微调。

最骚的操作是,他们让 Inkling 自己给自己写了一个微调任务,自己跑,自己评估结果。

对,模型自己微调自己。

这个 demo 我反复看了两遍,确认没理解错。

~

03 对普通人意味着什么

说白了,这又是一个开源重量级选手入场。

之前有 Llama、DeepSeek,现在 Mira Murati 这边也加入了。

竞争越激烈,对我们越有利——模型会越来越便宜,能力会越来越强,选择也会越来越多。

如果你是开发者,可以去 Tinker 上试试微调,这可能是目前体验门槛最低的开源大模型微调平台之一了。

如果你只是普通用户,记住一件事就行:AI 这个赛道,开源这条路,有人一直在认真走。

~

今天就到这里,明天见~ 🐋