跳转到内容

内置模型矩阵 (Model Matrix)

内置模型矩阵

AMC WebUI 深度集成了 Google 官方最新的 Gemini 3.x、Robotics 具身智能及多模态生成专用端点。以下是应用内置支持的核心模型能力速览:

AMC-WebUI 原生内置模型能力矩阵

Gemini 3.8 Flash默认推荐
gemini-3.8-flash

全项目默认主力模型,响应迅捷,兼顾强劲的逻辑推理与日常高并发使用。

1M Tokens深度思考 (Low~High)搜索与地图增强代码执行Live Artifacts
Gemini 3.5 Flash-Lite
gemini-3.5-flash-lite

轻量高效模型,作为 AMC-WebUI 内部思维链多语言实时翻译的默认辅助模型。

1M Tokens极速思考 (Minimal起)思维链实时翻译极低延迟
Gemini 3.1 Pro Preview
gemini-3.1-pro-preview

针对深度复杂学术论文分析、大仓代码重构与前沿数理逻辑设计的高阶大模型。

2M Tokens高阶数理超大上下文32K Token 思考预算
Gemini Robotics-ER 2
gemini-robotics-er-2-preview

具身智能与三维空间几何理解专属模型,API Key 必须在 AI Studio 配置域名/IP 限制。

1M Tokens具身空间推理需绑定 API 限制建议思考 Medium
Gemini 3.1 Flash Live
gemini-3.1-flash-live-preview

实时音视频交互专属端点,通过 WebSocket 实现端到端极低延迟对话。

128K Tokens双向流式语音摄像头识别屏幕共享理解AudioWorklet
Gemini 3 Pro Image (Nano Banana)
gemini-3-pro-image-preview

Gemini 原生高质量绘图模型,支持自然语言指令精准控制构图、材质与光影。

32K Tokens原生生图比例定制 (1:1 / 16:9)四图并发
Gemini 3.1 Flash TTS
gemini-3.1-flash-tts-preview

高表现力语音合成模型,内置 Zephyr、Aoede 等 30 种角色音色。

32K Tokens30 种拟真音色语速动态微调多语种自然重音

核心模型选型建议

1. 主力通用模型:gemini-3.8-flash

  • 定位:日常代码编写、长文阅读分析、普通闲聊与工具调用的全能首选
  • 优势:响应延迟低,首字吐出极快;支持完整的深度思考能力(Thinking Level: Low / Medium / High);支持多模态文件解析与 Live Artifacts 生成。

2. 超轻量低延迟:gemini-3.5-flash-lite

  • 定位:高频简短查询、高吞吐批量处理,以及 AMC WebUI 内部的思维链实时翻译代理引擎
  • 优势:极低的调用成本与极致延迟,支持从 Minimal 开始的最轻量思维预算。

3. 学术与高难推理:gemini-3.1-pro-preview

  • 定位:涉及超长上下文(200 万 Token)、复杂数学证明、跨多源大型工程代码库重构分析。
  • 优势:配备高达 32,768 Tokens 的完整思维预算,逻辑严密,抗幻觉能力顶尖。

4. 具身与空间推理:gemini-robotics-er-2-preview

  • 定位:三维空间关系推演、机器人操作规划、视觉空间几何测量。
  • 关键使用前置条件
    • Google 官方强制要求:调用该模型的 API Key 必须已在 Google AI Studio 添加限制 (API Restriction)(例如限制使用项目或来源),未设置限制的 Key 请求会直接被服务端拦截并返回 403 Forbidden
    • 建议将 Thinking Level 设为 Medium 以平衡空间几何解算的耗时与精度。