Thinking Machines: Inkling

0.65
Thinking Machines Lab 推出的开源权重大模型,支持文本、图像、音频理解,面向 AI Agent 与开发应用。
Advertisement 728 × 90
公司Thinkingmachines
上下文1M
发布日期2026-07
更新日期2026-07-22

Thinking Machines: Inkling 概述

Inkling 是由 Thinking Machines Lab 推出的通用多模态 AI 模型,是一款开放权重(Open-Weights)大语言模型。该模型采用 Mixture-of-Experts(MoE)架构,总参数规模约 975B,激活参数约 41B,并支持最高约 100 万 Token 的上下文处理能力。
Inkling 原生支持文本、图像和音频输入,并能够生成文本输出,专注于多模态推理、AI Agent、工具调用、代码开发和智能应用构建。开发者可以基于开放权重进行模型部署、微调和二次开发,适合构建个性化 AI 应用。
该模型适用于智能编程助手、聊天机器人、知识检索系统(RAG)、企业自动化、多模态应用开发等场景,为开发者提供更加灵活的 AI 基础模型选择。

Thinking Machines: Inkling 定价

套餐价格说明
Free Trial(免费体验版) 免费 提供 Inkling 基础模型体验,可用于测试 AI 对话、多模态理解、代码辅助和 Agent 功能。适合开发者了解模型能力、进行实验和原型开发。
Paid Plan(API / 云端调用方案) 按使用量计费 根据 API 调用量和计算资源消耗收费,支持在线调用、应用集成、模型服务部署等功能。适合开发团队构建 AI 应用、智能助手和自动化系统。
Enterprise Plan(企业方案) 定制报价 提供企业级 AI 解决方案,包括私有化部署、模型微调、安全管理、系统集成、团队协作和技术支持,适合企业级 AI 应用落地。

Thinking Machines: Inkling 主要功能

多模态理解:支持文本、图像、音频输入,实现跨模态信息理解。
AI Agent 能力:支持工具调用、任务规划和智能工作流执行。
代码开发支持:支持代码生成、代码分析、编程助手和软件开发任务。
超长上下文处理:支持百万 Token 级上下文,可处理大型文档和复杂数据。
开放权重生态:支持研究、模型微调、自定义部署和商业应用集成。
智能推理能力:适用于复杂分析、多步骤任务和自然语言交互。

总结

① AI 应用开发者
② 软件工程师
③ AI Agent 开发者
④ 企业技术团队
⑤ 研究人员与数据科学家
⑥ 需要自定义 AI 模型和多模态能力的专业用户

评论(0)

发表评论

Advertisement 728 × 90

Thinkingmachines 模型对比

模型 上下文 定价 API 发布 全球热度
Thinking Machines: Inkling
1M $1.000 / $4.050 per 1M YES 2026-07
19/100
524K $0.500 / $1.200 per 1M YES 2026-07
15/100

类似模型

Inkling Small
9
Thinking Machines 又出了一个小号模型:Inkling-Small。名字叫 Small,但其实也有 276B 总参数、12B 激活参数。 体量只有 Inkling 四分之一左右,推理和智能体编码成绩却反而更高。这次“小模型追大模型”,真有几项跑到了前面。
Thinkingmachines
Doubao Pro
100
字节跳动旗舰模型,支持日中英三语,提供企业级 API。
ByteDance
Qwen3-235B
99
阿里巴巴 MoE 模型,以 220 亿激活参数实现高质量低成本推理。
Alibaba
DeepSeek V4 Pro 0813
99
个人觉得DeepSeek V4 Pro 0813 更适合拿来干活。聊天、润色几句话当然也能做,但我会觉得有点浪费。真正让我觉得它有价值的,还是读项目、改代码、追 Bug,特别是碰到一堆互相牵连的任务时。
DeepSeek
Qwen3.7 Max
99
2026中国最强AI,深度推理+自主执行,从对话到实干。 日英
Alibaba
Qwen3.8 Flash
98
2026 年 8 月 26 日,阿里千问团队发布 Qwen3.8-Flash,并同步开源模型权重。这是一款主打性价比的多模态 MoE 模型。它不追求单项能力拉满,更像一款面向开发者和实际业务的工具型模型。
Alibaba
Qwen3.8 Max
98
8月3日,阿里发布新一代旗舰模型 Qwen3.8-Max。总参数量 2.4 万亿,每次推理激活约 950 亿参数,上下文窗口达到 100 万 Token。 官方给它的定位也很明确:不只负责写几段代码,而是可以从需求拆解开始,一路写代码、调试、迭代,最后把项目交出来。
Alibaba
Qwen3.6 Flash
97
阿里放出了 Qwen3.6 Flash 后,开发者圈里的讨论不少。我连续测了几天,感受比较明确:它不是冲着系列最强性能去的,优势主要在速度、价格和多模态能力之间的平衡。
Alibaba