openPangu 2.0 – 华为发布的开源大模型系列最新版本openPangu 2.0是华为在HDC开发者大会上发布的开源大模型系列最新版本,为深度绑定昇腾算力与鸿蒙生态的产业级AI基础设施。通过稀疏MoE架构实现超高吞吐率与低时延,单卡推理性能达业界主流开源...AI最新项目# 大模型2个月前01130
HPC-Ops – 腾讯混元开源的工业级大模型推理核心算子库HPC-Ops是腾讯混元AI Infra团队开源的工业级高性能大语言模型(LLM)推理核心算子库,专为解决真实业务场景中的推理性能瓶颈而设计。通过微架构级优化与动态调度技术,显著提升大模型推理吞吐量...AI最新项目# 大模型2个月前01680
HiDream-O1-Image-1.5 – 智象未来推出的商用版图像生成模型HiDream-O1-Image-1.5智象未来推出的商用版图像生成模型,在Artificial Analysis全球文生图榜单中评分1265ELO,位列中国第一、全球第二(仅次于OpenAI),采用...AI最新项目# 大模型2个月前01400
MusaCoder – 摩尔线程推出的国产GPU全栈训练的代码大模型MusaCoder是摩尔线程推出的全球首个基于国产全功能GPU全栈训练的代码大模型,专为自动生成高性能GPU底层算子(CUDA/MUSA原生Kernel代码) 而设计,其完整训练与验证流程均在国产MT...AI最新项目# 大模型2个月前01090
North Mini Code – Cohere公司推出的开源智能体编程大模型North Mini Code是Cohere公司推出的开源智能体编程大模型,核心定位为高吞吐、低延迟的代码智能体底座,采用30B总参数量但仅激活3B参数的稀疏混合专家(MoE)架构,专为本地化部署与企...AI最新项目# 大模型2个月前0950
Khala – 中央音乐学院与清华大学联合研发的音乐生成大模型Khala是中央音乐学院与清华大学联合研发的统一声学Token空间音乐生成大模型,解决AI音乐生成中结构连贯性与音质保真度的矛盾,通过构建跨模态对齐的声学表征体系,实现从深层音乐语义到高质量音频的端到...AI最新项目# 大模型2个月前01180
新程Alpha – 明日新程公司推出的全球首个端侧认知模型新程Alpha是明日新程(Nextie)公司推出的全球首个端侧认知模型,参数量仅4B(40亿),通过将“知识记忆”与“思考能力”解耦,专注于泛化推理和抽象决策,在群体智能任务中表现等效于GPT-5.4...AI最新项目# 大模型2个月前01240
VitaBench 2.0 – LongCat推出的新一代大模型智能体评测基准VitaBench 2.0是美团LongCat团队联合多所高校推出的新一代大模型智能体评测基准,专注于评估智能体在长期、多轮次真实生活场景交互中的综合能力。 与早期版本相比,将评测维度从单次任务扩展至...AI最新项目# 大模型2个月前01540
ABot-Earth0.5 – 高德地图发布全球首个3D原生城市世界模型ABot-Earth0.5是高德地图发布的全球首个3D原生城市世界模型,仅需单张卫星图像或文字描述,即可在10分钟内通过消费级GPU生成公里级可编辑3D城市场景。该模型将3D制图成本降至传统方式的百分...AI最新项目# 大模型2个月前01350
deepseek v4 flash – 深度求索发布的轻量化高效版大模型DeepSeek-V4-Flash是深度求索发布的轻量化高效版大模型,作为V4系列的“快速模式”版本,专为高频日常任务设计,在保持接近Pro版推理能力的同时,将响应速度和调用成本压缩至极致。以1/10...AI最新项目# 大模型4周前01920
MAI-Code-1-Flash – 微软发布的首款自研轻量级代码生成模型MAI-Code-1-Flash是微软发布的首款自研轻量级代码生成模型,专为开发者日常编码场景设计,采用50亿参数的紧凑架构,通过自适应推理预算分配技术实现高效率与低成本的平衡。 其核心价值在于将Ag...AI最新项目# 大模型2个月前02280
PaddleOCR-VL-1.6 – 百度发布的轻量化多模态文档解析模型PaddleOCR-VL-1.6是百度发布的轻量化多模态文档解析模型,在权威评测集OmniDocBench v1.6中以96.33%的综合准确率刷新全球SOTA记录,超越Gemini-3-Pro、GP...AI最新项目# 大模型2个月前01500
MAI-Thinking-1 – 微软发布的首款完全自研的高级推理AI模型MAI-Thinking-1是微软于2026年6月3日发布的首款完全自研的高级推理AI模型,采用350亿活跃参数的稀疏混合专家(MoE)架构,完全基于企业级合规数据从零训练,未使用任何第三方模型蒸馏数...AI最新项目# 大模型2个月前01620
Qwen2.5-7B – 阿里云通义千问系列开源大语言模型Qwen2.5-7B是阿里云通义千问系列推出的76.1亿参数开源大语言模型,核心特点为支持131.072 tokens超长上下文、原生结构化输出能力及显著提升的数学与编程性能,适用于需平衡推理成本与专...AI最新项目# 大模型2个月前01390
Mellum2 – JetBrains推出的开源混合专家(MoE)模型Mellum2是JetBrains推出的120亿参数开源混合专家(MoE)模型,专为软件工程场景设计,核心目标是通过超低延迟推理与私有化部署能力,解决企业级AI工作流中的实时性与成本瓶颈。 Mellu...AI最新项目# 大模型2个月前01330
Qwen3.7-Plus – 阿里巴巴发布的多模态智能体模型Qwen3.7-Plus是阿里巴巴于2026年6月2日正式发布的多模态智能体模型,定位为视觉与语言统一的智能体基座。它在Qwen3.7文本能力基础上深度融合视觉理解与行动能力,不仅能看懂图像/视频,还...AI最新项目# 大模型2个月前02100
Cosmos 3 – 英伟达发布的开源全模态物理AI基础大模型Cosmos 3是英伟达(NVIDIA)于2026年6月1日正式发布的全球首款全开源、全模态(Omni-Model)物理AI基础大模型。它被定义为一个“世界模型”,旨在赋予人工智能系统理解物理世界规律...AI最新项目# 大模型2个月前02360
Qwen-VLA – 阿里通义团队最新发布的通用机器人基础模型Qwen-VLA是阿里通义团队最新发布的通用机器人基础模型。 简单来说,如果之前的视觉模型是让AI拥有一双“眼睛”去理解世界,那么Qwen-VLA就是给这双眼睛配上了“灵活的手脚”,让AI不仅能看、能...AI最新项目# 大模型2个月前01270
MiniMax M3 – MiniMax发布的新一代旗舰通用大模型MiniMax M3是国产大模型公司MiniMax正式发布的新一代旗舰通用大模型。MiniMax M3是国内首个同时集齐“前沿编程与智能体能力、百万级超长上下文、原生多模态”三大核心能力的模型,也是目...AI最新项目# 大模型2个月前01150
ControlFoley – 小米大模型开源可控视频音效生成模型ControlFoley是小米大模型应用团队与武汉大学联合开发的开源可控视频音效生成模型。其核心突破在于 首次实现"按意图配声音"的精准控制能力,解决了传统音效生成模型"只能根据画面自动猜声音"的局限...AI最新项目# 大模型2个月前01490
SenseNova-U1-8B-MoT-Infographic – 商汤科技开源的多模态大模型SenseNova-U1-8B-MoT-Infographic是商汤科技开源的专项增强版多模态大模型,基于原生统一架构 SenseNova-U1-8B-MoT针对信息图(infographic)生成场...AI最新项目# 大模型2个月前01440
ForgeTrain – 面壁智能联合清华等全球首个由AI自主编写ForgeTrain是由面壁智能联合清华大学及OpenBMB开源社区发布的全球首个完全由AI自主编写、零人类代码介入的生产级大模型预训练框架。 其核心突破在于AI首次独立完成大模型训练基础设施的端到端...AI最新项目# 大模型2个月前01070
LFM2.5-1.2B – Liquid AI推出的12亿参数轻量级AI模型家族LFM2.5-1.2B是Liquid AI推出的12亿参数轻量级AI模型家族,专为边缘设备与本地部署优化设计,最大特点是仅需约900MB内存即可在普通智能手机上流畅运行,同时通过创新的"思考链"机制实...AI最新项目# 大模型2个月前01640
Xiaomi Auto World Model – 小米发布的世界模型全新框架Xiaomi Auto World Model是小米汽车发布的世界模型全新框架,其核心突破在于首次将三维重建与视频生成深度耦合为一体化架构,以“重建锚定几何、生成填补想象”的新范式,推动辅助驾驶从“场...AI最新项目# 大模型2个月前02290
ZCube – 智谱联合清华大学开发的新型AI集群网络架构ZCube是由智谱联合清华大学、驭驯网络开发的新型AI集群网络架构,专为解决大模型推理场景中的结构性网络拥塞问题而设计。 其核心突破在于彻底重构网络拓扑,通过取消传统Clos架构的Spine层、采用扁...AI最新项目# 大模型2个月前01760
Lance – 字节跳动推出的原生统一的多模态模型Lance 是字节跳动推出的一个原生统一的多模态模型。它是一个参数量为 30亿(3B) 的研究性项目,旨在打破图像和视频在理解、生成、编辑任务上的壁垒。 与许多需要针对不同任务单独微调的模型不同,La...AI最新项目# 大模型2个月前03010
hronicles-OCR – 腾讯混元发布首个古文字“七体”评测基准hronicles-OCR是由腾讯混元大模型联合中国科学院信息工程研究所、安阳师范学院、南开大学及故宫博物院等权威机构,共同推出的业界首个中国古文字感知评测基准。 简单来说,它是一套专门用来给当前顶尖...AI最新项目# 大模型2个月前01550
General365 – 美团LongCat团队开源通用推理新评测基准General365是由美团LongCat团队在2026年4月底发布,并于5月中旬正式开源的一个专注于评估大模型通用逻辑推理能力的全新评测基准。 简单来说,它是一套专门为 AI 设计的“高难度逻辑考卷...AI最新项目# 大模型2个月前02130
GPT-Realtime-Whisper – OpenAI推出的低延迟语音转文字模型GPT-Realtime-Whisper是OpenAI推出的一款专注于低延迟流式语音转文字的模型。它的核心突破在于实现了真正的“边说边转”。与传统的“录音-上传-识别”模式不同,它能在你说话的同时实时...AI最新项目# 大模型2个月前01690
Hy-MT1.5-1.8B-1.25bit – 腾讯混元开源的轻量化的离线翻译模型Hy-MT1.5-1.8B-1.25bit是腾讯混元团队正式开源的一款极致轻量化的离线翻译模型。这款模型最大的亮点在于它通过先进的量化压缩技术,将原本需要数GB内存的翻译大模型压缩至440MB 左右...AI最新项目# 大模型2个月前01660