新Hy Image3.5 preview – 腾讯新款专业AI生图模型Hy Image3.5 preview 是腾讯混元推出的预览版图像生成模型,主打专业图像创作,兼顾创作质量与使用成本。这款模型经过大量设计师盲测验证,生成画面的细节、文字绘制、风格还原都有明显提升,普...AI最新项目8小时前040
新小米MiMo-V2.6 – 全模态大模型小米 MiMo-V2.6 是小米推出并对外开源的新一代原生全模态大模型系列,作为 RSI 递归自我改进技术路线的落地成果,整套版本划分为 Pro、Flash 以及 UltraSpeed 三个分支。模型...AI最新项目# 大模型12小时前030
新Grok 4.7 – 面向代码与复杂知识任务的新一代大模型Grok 4.7 是 xAI 推出的旗舰大语言模型,面向代码编写与各类专业知识工作打造。新版本沿用与前代一致的定价标准,推理吞吐速度得到明显提升,针对长时间连续执行的复杂任务完成专项调优。模型内置更强...AI最新项目12小时前030
新Laya – 面向反射型决策场景的开源非生成式模型Laya 是一款开源决策模型,遵循 Apache 2.0 协议对外开放权重与完整工程代码,面向工单分流、意图路由、内容风控这类反射型决策任务设计。模型不输出自然语言文本,直接输出布尔结果、单选分类、量...AI最新项目1天前070
新Jev Search – 基于决策模型的开源搜索流水线Jev Search 是一套开源搜索处理流水线,依托 Jev 决策模型与 Search1API 构建。项目不产出 AI 生成文本,把搜索链路中的源选择、查询改写、结果重排交给决策模型完成。接收自然语言...AI最新项目1天前070
新WebCraftBench – 面向AI网页生成的交互评测框架WebCraftBench 是由腾讯混元联合高校团队推出的 AI 网页生成评测框架,打破传统静态截图打分的评测思路,把软件测试流程引入网页生成质量校验。它依托真实用户需求构建测试用例,借助智能代理模拟...AI最新项目1天前090
新Qwen-Image-2.1 – 轻量开源图像生成模型Qwen-Image-2.1 是千问推出的新一代开源图像生成模型,把文生图和图像编辑整合到一套模型管线内,视觉生成模块参数规模 7B,原生支持 RGBA 透明通道图像输出。模型原生输出最高 2K 分辨...AI最新项目1天前0140
新Step 5 Preview – 阶跃新一代旗舰大模型Step 5 Preview 是阶跃星辰推出的旗舰基座大模型,面向复杂智能体任务打造。作为预览版本,它兼顾强推理能力与推理成本控制,上线后在第三方评测榜单拿到不错分数。百万级长上下文与图文多模态能力...AI最新项目# 大模型2天前0130
新Qwen3.8-LiveTranslate – 通义千问新一代实时同声传译模型Qwen3.8-LiveTranslate 是阿里通义千问推出的多模态实时同声传译模型,依托 Hybrid MoE 与 Thinker–Talker 双模块架构打造,面向音视频实时跨语言交互场景。模型...AI最新项目2天前0130
新Grok Voice Transcribe 2.0 – xAI新一代语音转文字模型Grok Voice Transcribe 2.0 是 xAI 推出的语音转文字模型,依托云端 API 对外提供批量音频转写与实时流式转写服务。新版本在保持原有计费标准的前提下,识别准确率相比上一代实...AI最新项目2天前090
新Xing4.0-29B-A4B – 全栈国产轻量级智能体大模型Xing4.0-29B-A4B 是中电信人工智能科技推出的新一代星辰大模型,面向智能体应用方向打造的轻量级代码智能体模型。模型总参数量 29B,激活参数控制在 4B,原生支持 256K 上下文,可扩展...AI最新项目# 大模型2天前0140
新DAMO RADAR – 摩院专家级通用腹部CT医学影像AI模型DAMO RADAR 是阿里巴巴达摩院联合医疗机构推出的通用医学影像视觉语言模型,成果发布于《Science》期刊,整套模型、代码与框架已对外开源。模型专注腹部增强 CT 影像解析,覆盖腹部 18 类...AI最新项目4天前0170
新MiniMax Code CLI – 命令行下的开源代码智能开发工具MiniMax Code CLI 是 MiniMax 推出的面向终端环境的代码工具,依托 MiniMax 代码大模型能力,直接在命令行终端运行,无需打开图形界面。工具接收终端内输入的自然语言指令,读取...AI最新项目4天前0140
新GLM-5.3-FlashX – 智谱高速原生多模态大模型GLM-5.3-FlashX 是智谱 AI 推出的 GLM-5.3-Flash 升级版本原生多模态大模型,依托国产算力底座完成推理层深度优化,峰值推理速度达到 200 tokens/s。模型延续 32...AI最新项目# 大模型4天前0180
新Astra for Law – 面向法律行业的GPT-6 Astra专业AI平台Astra for Law 是 OpenAI 推出的法律行业专用 AI 基础平台,底层依托 GPT-6 Astra 模型构建,配套专属法律检索索引、行业指令集与隐私管控机制,面向律所与法律科技服务商开...AI最新项目4天前0170
新Qwen3.8-Omni-Flash – 千问原生全模态智能体模型Qwen3.8-Omni-Flash 是阿里千问推出的新一代原生全模态模型,依托 Qwen3.8-Flash-Next 架构搭建,支持文本、图片、音频、视频四类输入,最大上下文窗口达到 1M toke...AI最新项目4天前0170
新Chatterfly – 腾讯AI原生语音表达助手,开口即可成文Chatterfly 又称元宝输入法,是腾讯推出的 AI 原生语音表达工具,当前处于内测阶段,已上线 Windows、macOS 桌面客户端,移动端版本还在筹备中。它跳出传统输入法仅做语音转文字的模式...AI最新项目4天前0200
新Spark-Audio-1.0-Preview – 多任务音频生成与理解模型科大讯飞正式发布语音基座大模型Spark-Audio-1.0-Preview。这是业界首个基于全国产化算力集群训练的语音基座大模型,采用0.65B稠密音频编码器搭配30B-A3B混合专家(MoE)语言...AI最新项目6天前0230
新ZDTaichu5.0‑9B – 紫东太初空间具身多模态模型ZDTaichu5.0‑9B 是紫东太初推出的 9B 参数开源多模态基座模型,依托 Qwen3.5‑9B 语言主干与 C‑RADIOv4‑H 视觉编码器构建,支持文本、单张或多张图片、长视频输入,兼容...AI最新项目6天前0140
新Hologres – 阿里云一体化实时湖仓平台Hologres 是阿里云自研的一体化实时湖仓平台,兼容 PostgreSQL 协议,整合 OLAP 查询、即席分析、在线服务、向量检索、AI 推理多项能力。平台依托 Dynamic Table 动态...AI最新项目6天前0180
新Iris – AllSpark推出的开源Search Agent模型Iris 是小红书 AllSpark 团队开源的搜索智能体(Search Agent),包含 Iris-mini(35B)与 Iris-pro(397B)两个版本,基于通义千问 MoE 基座开发,代码...AI最新项目6天前0200
新Open‑RAIL – 打通VLA模型与实体机器人的开源工程底座Open‑RAIL 是中国移动具身智能产业创新中心推出的开源即插即用中间件,面向 VLA/WAM 视觉语言动作模型与异构人形机器人。它解决大模型推理帧率与机器人电机控制帧率不匹配带来的动作抖动问题,搭...AI最新项目5天前0190
新中文互联网基础语料4.0 – 国内大模型训练基础数据集中文互联网基础语料 4.0 是中国网络空间安全协会牵头推出的中文互联网数据集,在 2026 国家网络安全宣传周人工智能安全治理分论坛对外发布,整体数据规模 120GB。该版本在 1.0 至 3.0 版...AI最新项目6天前0220
新Gemini 3.8 Live Extended Thinking – 面向复杂任务的语音实时模型Gemini 3.8 Live Extended Thinking 是 Google DeepMind 推出的实时语音模型增强版本,在 Gemini 3.8 Live 基础上叠加深度推理链路,保留原生...AI最新项目6天前0160
新Gemini 3.8 Live – 支持边思考边对话的多模态语音模型Gemini 3.8 Live 是 Google DeepMind 推出的原生音频到音频实时大模型,包含基础版与 Extended Thinking 增强版本,依托 WebSocket 流式接口交付服...AI最新项目6天前0180
HiDream-O1-Video-1.0 – 智象原生全模态视频生成模型HiDream-O1-Video-1.0(简称 HD-V1)是智象未来 HiDream.ai 推出的原生全模态视频生成模型。依托自研 UiT 架构,支持文本、图片、视频多类型输入,输出 5 至 20 ...AI最新项目1周前0210
StepAudio 3 – 阶跃星辰新一代音频基座StepAudio 3 是阶跃星辰推出的新一代全栈音频基础模型,整套系列拆分为 Realtime、ASR、TTS、Gen、Music 五个子模型,覆盖语音识别、语音合成、全双工实时对话、综合音频生成...AI最新项目1周前0230
UnifoLM-WLA-1.0 – 宇树科技推出的人形机器人通用基础模型UnifoLM-WLA-1.0 是宇树科技推出的 6B 参数人形机器人通用基础模型,属于世界 - 语言 - 动作 WLA 架构,依托约 2500 小时真机采集数据训练。模型打通视觉感知、语言理解、场景...AI最新项目# 大模型1周前0210
书生‑S2 – 记忆推理分离的科学智能大模型书生‑S2(Intern‑S2‑Preview‑397B)是上海人工智能实验室推出的 397B 参数多模态科学基座模型,面向科研场景打造,采用记忆与推理分离的双引擎架构。模型可直接读取原始科学文献页面...AI最新项目# 大模型1周前0210
Xiaomi-CocktailASR-1 – 多人混合音频目标人声转写模型Xiaomi-CocktailASR-1 是小米推出的工业级目标说话人语音识别开源模型,专门处理语音领域经典的鸡尾酒会问题。模型采用端到端 LLM 架构,输入一段目标人物参考音频提取声纹特征,在多人重...AI最新项目1周前0230