Perceptron Mk1

0.70
面向图像、视频理解与具身智能任务的多模态 AI 模型,支持视觉推理和结构化输出。
Advertisement 728 × 90
公司Perceptron
上下文33K
发布日期2026-05
更新日期2026-07-21

Perceptron Mk1 概述

Perceptron Mk1 是 Perceptron 推出的闭源视觉语言模型(VLM),专注于图像理解、视频分析和具身智能推理任务。该模型支持图像和视频输入,可通过自然语言指令完成视觉问答、目标识别、OCR、图像描述以及复杂场景分析等任务。
Perceptron Mk1 具备约 32K Token 上下文窗口,并支持推理模式、结构化输出和工具调用能力,适用于智能机器人、视觉 Agent、视频理解系统以及企业级多模态 AI 应用。

Perceptron Mk1 定价

套餐价格说明
Free Trial(免费试用版) 免费 提供 Perceptron Mk1 基础模型体验,支持图像理解、视频分析、视觉问答和模型测试。适合开发者体验多模态 AI 能力、进行技术验证和应用原型开发。
Paid Plan(付费方案) 按 Token 使用量计费 根据 API 输入和输出 Token 数量收费。参考价格约为 Input $0.15 / 1M Tokens,Output $1.50 / 1M Tokens。适合需要稳定 API 服务、高频视觉 AI 调用和商业应用部署的团队。
Enterprise Plan(企业方案) 定制报价 提供企业级视觉 AI 解决方案,包括大规模 API 接入、私有化部署、系统集成、安全管理、定制优化和技术支持,适合企业构建视觉智能系统。

Perceptron Mk1 主要功能

视觉理解能力:支持图片和视频分析,理解复杂视觉信息。
视频推理能力:可进行视频内容理解、事件分析和场景推理。
OCR 文字识别:支持图片中的文字提取与信息分析。
目标检测与识别:能够识别图像中的对象、环境和关键元素。
多模态问答:结合视觉信息与自然语言完成智能问答。
结构化输出:支持 JSON 等格式输出,方便开发者集成 AI 应用。

总结

① AI 应用开发者
② 计算机视觉工程师
③ AI Agent 开发者
④ 机器人与自动化研发团队
⑤ 企业技术团队
⑥ 需要视觉理解能力的专业用户

评论(0)

发表评论

Advertisement 728 × 90

类似模型

Doubao Pro
100
字节跳动旗舰模型,支持日中英三语,提供企业级 API。
ByteDance
Qwen3-235B
99
阿里巴巴 MoE 模型,以 220 亿激活参数实现高质量低成本推理。
Alibaba
DeepSeek V4 Pro 0813
99
个人觉得DeepSeek V4 Pro 0813 更适合拿来干活。聊天、润色几句话当然也能做,但我会觉得有点浪费。真正让我觉得它有价值的,还是读项目、改代码、追 Bug,特别是碰到一堆互相牵连的任务时。
DeepSeek
Qwen3.7 Max
99
2026中国最强AI,深度推理+自主执行,从对话到实干。 日英
Alibaba
Qwen3.8 Flash
98
2026 年 8 月 26 日,阿里千问团队发布 Qwen3.8-Flash,并同步开源模型权重。这是一款主打性价比的多模态 MoE 模型。它不追求单项能力拉满,更像一款面向开发者和实际业务的工具型模型。
Alibaba
Qwen3.8 Max
98
8月3日,阿里发布新一代旗舰模型 Qwen3.8-Max。总参数量 2.4 万亿,每次推理激活约 950 亿参数,上下文窗口达到 100 万 Token。 官方给它的定位也很明确:不只负责写几段代码,而是可以从需求拆解开始,一路写代码、调试、迭代,最后把项目交出来。
Alibaba
Qwen3.6 Flash
97
阿里放出了 Qwen3.6 Flash 后,开发者圈里的讨论不少。我连续测了几天,感受比较明确:它不是冲着系列最强性能去的,优势主要在速度、价格和多模态能力之间的平衡。
Alibaba
Qwen3.7 Plus
96
图文输入+文本输出,视觉语言全面升级,同时保留编码和工具调用的完整智能体能力。
Alibaba