不er?谁家大模型12B版本跑分比975B的高啊 - 搜狐网
Кратко: 不er?谁家大模型12B版本跑分比975B的高啊
梦晨 发自 凹非寺
量子位 | 公众号 QbitAI
Thinking Machines首款自研大模型,9750亿参数直接开源。
不追求综合跑分第一,要做开源社区里最适合定制的基础模型。
因为他家的收入来源就是靠微调,自研平台Tinker专门卖模型定制服务。
团队演示了一个操作:让Inkling在Tinker上给自己写微调任务、自己跑训练、自己评估结果。
甚至可以调成禁止说字母e。
梦晨 发自 凹非寺
量子位 | 公众号 QbitAI
Thinking Machines首款自研大模型,9750亿参数直接开源。
不追求综合跑分第一,要做开源社区里最适合定制的基础模型。
因为他家的收入来源就是靠微调,自研平台Tinker专门卖模型定制服务。
团队演示了一个操作:让Inkling在Tinker上给自己写微调任务、自己跑训练、自己评估结果。
甚至可以调成禁止说字母e。
🧭 Извлечение: ok
· confidence 90%
· диагностика
High confidence: full text extraction produced 410 characters.
High confidence: full text extraction produced 410 characters.
不er?谁家大模型12B版本跑分比975B的高啊
梦晨 发自 凹非寺
量子位 | 公众号 QbitAI
Thinking Machines首款自研大模型,9750亿参数直接开源。
不追求综合跑分第一,要做开源社区里最适合定制的基础模型。
因为他家的收入来源就是靠微调,自研平台Tinker专门卖模型定制服务。
团队演示了一个操作:让Inkling在Tinker上给自己写微调任务、自己跑训练、自己评估结果。
甚至可以调成禁止说字母e。
梦晨 发自 凹非寺
量子位 | 公众号 QbitAI
Thinking Machines首款自研大模型,9750亿参数直接开源。
不追求综合跑分第一,要做开源社区里最适合定制的基础模型。
因为他家的收入来源就是靠微调,自研平台Tinker专门卖模型定制服务。
团队演示了一个操作:让Inkling在Tinker上给自己写微调任务、自己跑训练、自己评估结果。
甚至可以调成禁止说字母e。