
Inkling
inkling.com
开源975B多模态模型,专为微调而生
昨天制作者:Zac Zuo
关于 Inkling
Inkling 是 Thinking Machines 推出的首个开源权重模型,以 975B 参数的 MoE(混合专家)架构,仅激活 41B 参数,兼顾性能与效率。它原生支持文本、图像和音频的多模态推理,拥有 100 万 token 的超长上下文窗口,并具备可控的思考深度调节能力,让模型在简单任务上快速响应,在复杂问题上深度推理。
核心功能
- 多模态原生推理:无需额外插件,直接处理文本、图像和音频输入,实现跨模态理解与生成。
- 超长上下文窗口:支持高达 1M token 的上下文,适合处理长篇文档、代码库或多轮对话。
- 可控思考深度:用户可根据任务复杂度调节模型的“思考”强度,平衡速度与准确性。
- 开源可微调:提供 Apache 2.0 许可的模型权重,支持在 Tinker 平台上进行微调,或下载到本地定制。
主要特性
- 高效 MoE 架构:975B 总参数中仅 41B 激活,推理速度快,资源消耗低。
- 开放权重许可:Apache 2.0 协议,允许商用、修改和再分发,社区友好。
- 灵活部署:支持云端微调(Tinker)和本地部署,适应不同开发场景。
- 多模态融合:统一处理文本、图像和音频,无需多个专用模型。
- 思考可控:通过调节推理深度,在简单任务上节省算力,在复杂任务上提升准确性。
适用场景
- 企业级 AI 应用:需要定制化多模态模型的企业,可基于 Inkling 微调出行业专属模型。
- 学术研究:研究者可利用其开放权重探索 MoE 架构、多模态推理或长上下文机制。
- 内容创作:支持图文音多模态生成,适用于广告、媒体和创意行业。
- 智能客服:长上下文和可控思考能力使其能处理复杂、多轮对话。