IQuest‑Q1 是至知创新研究院 IQuest Research 发布的开源稀疏 MoE 基座模型。模型总参数规模 320B,单 token 推理仅激活 15B 参数,原生面向命令行终端智能体打造,支持 512K 超大上下文窗口,内置多 token 预测 speculative‑decoding 能力。模型兼顾通用推理、软件工程编码、CLI 工具调用能力,能够完成读取代码库、执行命令、校验输出、处理执行报错等长周期任务。权重完整对外开放,适配 vLLM、SGLang 推理引擎,可对接 Claude Code、Codex CLI 等主流代码智能体框架。

IQuest‑Q1特点
稀疏专家架构,全部 320B 参数不会同时参与运算,推理阶段仅启用部分专家,降低显存与算力开销。
512K 超长上下文,完整加载大型代码仓库、大量终端交互轨迹。
原生适配终端环境,对命令执行、报错修复、工具调用链路适配完善。
搭载多 token 预测推理层,提升生成吞吐速度。
可接入主流代码智能体运行框架,不用大规模修改上层业务逻辑。
项目迭代过程会在人类监督下参与自身训练流程,持续沉淀训练与评估资产。
IQuest‑Q1技术原理
采用 decoder‑only Transformer 主干搭配稀疏 MoE 专家架构,总计 256 个专家,每轮前向运算激活 8 个专家。
注意力采用滑动窗口与完整注意力混合模式,搭配部分 RoPE 位置编码,缓解超长上下文场景显存占用压力。
训练流程分为预训练、中间训练、后训练,引入 Docker 容器环境产出大量真实终端交互轨迹样本,使用多教师在线蒸馏 MOPD 算法完成强化学习调优。
多 token 预测模块并行预判后续 token,实现推测解码,拉高整体生成吞吐量。
IQuest‑Q1功能
大型代码库读取分析,理解完整项目结构,定位代码缺陷。终端命令行智能体任务,执行工具调用,捕获报错并实施修复。
复杂多步软件工程任务,完成项目重构、脚本编写、单元测试生成。
长文档与大量交互轨迹的解析处理。兼容 OpenAI 接口协议,对外输出推理服务。
对接外部 Agent 框架,承接智能体规划、工具选择、结果校验整套流程。
IQuest‑Q1应用场景
命令行自主代码智能体开发,完成仓库改造、漏洞修复。
竞赛级程序编写,算法题目求解与代码调试。
软件研发自动化管线,处理批量代码修改、版本迁移。
AI 智能体科研实验,研究终端环境长周期任务执行逻辑。
企业内部私有化代码助手,本地部署处理私有业务代码。开源社区模型二次迭代,基于权重继续做领域微调。
IQuest‑Q1如何使用
前往 Hugging Face 或者 GitHub 仓库下载 IQuest‑Q1 完整权重文件,准备多 GPU 硬件环境。
拉取官方预构建 Docker 镜像,选用 SGLang 或者 vLLM 推理引擎启动服务实例,开启 OpenAI 兼容接口。
确认推理参数,设置温度、top‑p 等配置,完成服务端口暴露。
调用 API 发送请求,传入代码、终端任务指令,获取模型返回内容。
对接 Claude Code、Codex CLI,填写模型服务地址,完成智能体运行环境接入。
观察终端任务执行轨迹,收集运行样本,针对业务领域开展继续微调。
© 版权声明
文章版权归作者所有,未经允许请勿转载。
相关文章
暂无评论...



