Inkling-Small は、Thinking Machines Lab が開発した軽量版オープンウェイトAIモデルです。Inklingシリーズの小型モデルとして設計され、高い推論性能と低コスト・低レイテンシ運用の両立を目指しています。
本モデルは Mixture-of-Experts(MoE:混合エキスパート)アーキテクチャを採用し、総パラメータ数 276B(2760億)、アクティブパラメータ **12B(120億)**の構成となっています。大規模モデルの性能を維持しながら、より効率的な推論処理を実現しています。
Inkling-Smallは、テキストだけでなく画像・音声入力にも対応するマルチモーダルAIモデルで、AI Agent開発、コード生成、チャットボット、RAGシステム、データ処理など幅広い用途に利用できます。
最大 100万トークンのコンテキストウィンドウに対応し、大規模ドキュメント、コードベース、企業ナレッジ、長期プロジェクト情報などの処理に適しています。
また、制御可能な思考量(Controllable Thinking Effort)を備えており、処理速度と推論性能のバランスを用途に応じて調整できます。
Inkling-Smallは、最高性能モデルをそのまま利用するのではなく、コスト効率・柔軟性・カスタマイズ性を重視した開発者向けAIモデルとして位置付けられています。
コメント(0件)