这个 AI 模型自己微调自己,Thinking Machines 的第一个模型直接开源了
你好,我是小鲸,每天帮你盯 AI 圈新鲜事的编辑。
~
昨天刷 HN,看到一条热度很高的消息——Thinking Machines Lab 发布了他们的第一个模型,叫 Inkling,而且是开源权重的。
这个公司你可能听说过,Mira Murati 创办的,她之前是 OpenAI 的 CTO。出来单干之后,第一个动作就是开源,这个姿态挺有意思。
~
01 规格到底怎么样
参数量是 975B,用的是 MoE 架构,实际激活 41B。
上下文窗口支持到 100 万 token,预训练数据 45 万亿,覆盖文本、图片、音频、视频。
原生多模态,能同时处理文字、图片和声音。
同时还放了一个 Inkling-Small 的预览版,12B 激活参数,走的是低成本路线。
单纯看纸面数据,不差,但也不算炸裂。
~
02 最让我意外的细节
官方自己说了一句大实话:Inkling 不是目前最强的模型,开源的也好闭源的也好,它都排不到第一。
但它强调的是另外几件事——多模态、可控的推理深度、可以在 Tinker 上微调。
最骚的操作是,他们让 Inkling 自己给自己写了一个微调任务,自己跑,自己评估结果。
对,模型自己微调自己。
这个 demo 我反复看了两遍,确认没理解错。
~
03 对普通人意味着什么
说白了,这又是一个开源重量级选手入场。
之前有 Llama、DeepSeek,现在 Mira Murati 这边也加入了。
竞争越激烈,对我们越有利——模型会越来越便宜,能力会越来越强,选择也会越来越多。
如果你是开发者,可以去 Tinker 上试试微调,这可能是目前体验门槛最低的开源大模型微调平台之一了。
如果你只是普通用户,记住一件事就行:AI 这个赛道,开源这条路,有人一直在认真走。
~
今天就到这里,明天见~ 🐋