AI深识站
  • AI软件
  • AI资讯
  • AI世界漫游指南
    • AI知识探索库
    • AI学习教程
  • AI最新项目
  • 排行榜
      • 未登录
        登录后即可体验更多功能
    • AI软件
    • AI资讯
    • AI世界漫游指南
      • AI知识探索库
      • AI学习教程
    • AI最新项目
    • 排行榜
    未登录
    登录后即可体验更多功能

    大模型

    共 165 篇文章
    排序
    发布更新浏览点赞
    Kimi K2.7 Code – 月之暗面发布的编程专用大模型

    Kimi K2.7 Code – 月之暗面发布的编程专用大模型

    Kimi K2.7 Code是月之暗面(Moonshot AI)发布的编程专用大模型,解决长程编程任务中的过度思考问题,而非通用能力升级。长任务平均Token消耗直降30%,同时输出速度提升至普通版的...
    AI最新项目# 大模型
    文明旁观者的头像2个月前
    01470
    openPangu 2.0 – 华为发布的开源大模型系列最新版本

    openPangu 2.0 – 华为发布的开源大模型系列最新版本

    openPangu 2.0是华为在HDC开发者大会上发布的开源大模型系列最新版本,为深度绑定昇腾算力与鸿蒙生态的产业级AI基础设施。通过稀疏MoE架构实现超高吞吐率与低时延,单卡推理性能达业界主流开源...
    AI最新项目# 大模型
    文明旁观者的头像2个月前
    01130
    HPC-Ops – 腾讯混元开源的工业级大模型推理核心算子库

    HPC-Ops – 腾讯混元开源的工业级大模型推理核心算子库

    HPC-Ops是腾讯混元AI Infra团队开源的工业级高性能大语言模型(LLM)推理核心算子库,专为解决真实业务场景中的推理性能瓶颈而设计。通过微架构级优化与动态调度技术,显著提升大模型推理吞吐量...
    AI最新项目# 大模型
    文明旁观者的头像2个月前
    01680
    HiDream-O1-Image-1.5 – 智象未来推出的商用版图像生成模型

    HiDream-O1-Image-1.5 – 智象未来推出的商用版图像生成模型

    HiDream-O1-Image-1.5智象未来推出的商用版图像生成模型,在Artificial Analysis全球文生图榜单中评分1265ELO,位列中国第一、全球第二(仅次于OpenAI),采用...
    AI最新项目# 大模型
    文明旁观者的头像2个月前
    01400
    MusaCoder – 摩尔线程推出的国产GPU全栈训练的代码大模型

    MusaCoder – 摩尔线程推出的国产GPU全栈训练的代码大模型

    MusaCoder是摩尔线程推出的全球首个基于国产全功能GPU全栈训练的代码大模型,专为自动生成高性能GPU底层算子(CUDA/MUSA原生Kernel代码) 而设计,其完整训练与验证流程均在国产MT...
    AI最新项目# 大模型
    文明旁观者的头像2个月前
    01090
    North Mini Code – Cohere公司推出的开源智能体编程大模型

    North Mini Code – Cohere公司推出的开源智能体编程大模型

    North Mini Code是Cohere公司推出的开源智能体编程大模型,核心定位为高吞吐、低延迟的代码智能体底座,采用30B总参数量但仅激活3B参数的稀疏混合专家(MoE)架构,专为本地化部署与企...
    AI最新项目# 大模型
    文明旁观者的头像2个月前
    0950
    Khala – 中央音乐学院与清华大学联合研发的音乐生成大模型

    Khala – 中央音乐学院与清华大学联合研发的音乐生成大模型

    Khala是中央音乐学院与清华大学联合研发的统一声学Token空间音乐生成大模型,解决AI音乐生成中结构连贯性与音质保真度的矛盾,通过构建跨模态对齐的声学表征体系,实现从深层音乐语义到高质量音频的端到...
    AI最新项目# 大模型
    文明旁观者的头像2个月前
    01180
    新程Alpha – 明日新程公司推出的全球首个端侧认知模型

    新程Alpha – 明日新程公司推出的全球首个端侧认知模型

    新程Alpha是明日新程(Nextie)公司推出的全球首个端侧认知模型,参数量仅4B(40亿),通过将“知识记忆”与“思考能力”解耦,专注于泛化推理和抽象决策,在群体智能任务中表现等效于GPT-5.4...
    AI最新项目# 大模型
    文明旁观者的头像2个月前
    01240
    VitaBench 2.0 – LongCat推出的新一代大模型智能体评测基准

    VitaBench 2.0 – LongCat推出的新一代大模型智能体评测基准

    VitaBench 2.0是美团LongCat团队联合多所高校推出的新一代大模型智能体评测基准,专注于评估智能体在长期、多轮次真实生活场景交互中的综合能力。 与早期版本相比,将评测维度从单次任务扩展至...
    AI最新项目# 大模型
    文明旁观者的头像2个月前
    01540
    ABot-Earth0.5 – 高德地图发布全球首个3D原生城市世界模型

    ABot-Earth0.5 – 高德地图发布全球首个3D原生城市世界模型

    ABot-Earth0.5是高德地图发布的全球首个3D原生城市世界模型,仅需单张卫星图像或文字描述,即可在10分钟内通过消费级GPU生成公里级可编辑3D城市场景。该模型将3D制图成本降至传统方式的百分...
    AI最新项目# 大模型
    文明旁观者的头像2个月前
    01350
    deepseek v4 flash – 深度求索发布的轻量化高效版大模型

    deepseek v4 flash – 深度求索发布的轻量化高效版大模型

    DeepSeek-V4-Flash是深度求索发布的轻量化高效版大模型,作为V4系列的“快速模式”版本,专为高频日常任务设计,在保持接近Pro版推理能力的同时,将响应速度和调用成本压缩至极致。以1/10...
    AI最新项目# 大模型
    文明旁观者的头像4周前
    01920
    MAI-Code-1-Flash – 微软发布的首款自研轻量级代码生成模型

    MAI-Code-1-Flash – 微软发布的首款自研轻量级代码生成模型

    MAI-Code-1-Flash是微软发布的首款自研轻量级代码生成模型,专为开发者日常编码场景设计,采用50亿参数的紧凑架构,通过自适应推理预算分配技术实现高效率与低成本的平衡。 其核心价值在于将Ag...
    AI最新项目# 大模型
    文明旁观者的头像2个月前
    02280
    PaddleOCR-VL-1.6 – 百度发布的轻量化多模态文档解析模型

    PaddleOCR-VL-1.6 – 百度发布的轻量化多模态文档解析模型

    PaddleOCR-VL-1.6是百度发布的轻量化多模态文档解析模型,在权威评测集OmniDocBench v1.6中以96.33%的综合准确率刷新全球SOTA记录,超越Gemini-3-Pro、GP...
    AI最新项目# 大模型
    文明旁观者的头像2个月前
    01500
    MAI-Thinking-1 – 微软发布的首款完全自研的高级推理AI模型

    MAI-Thinking-1 – 微软发布的首款完全自研的高级推理AI模型

    MAI-Thinking-1是微软于2026年6月3日发布的首款完全自研的高级推理AI模型,采用350亿活跃参数的稀疏混合专家(MoE)架构,完全基于企业级合规数据从零训练,未使用任何第三方模型蒸馏数...
    AI最新项目# 大模型
    文明旁观者的头像2个月前
    01620
    Qwen2.5-7B – 阿里云通义千问系列开源大语言模型

    Qwen2.5-7B – 阿里云通义千问系列开源大语言模型

    Qwen2.5-7B是阿里云通义千问系列推出的76.1亿参数开源大语言模型,核心特点为支持131.072 tokens超长上下文、原生结构化输出能力及显著提升的数学与编程性能,适用于需平衡推理成本与专...
    AI最新项目# 大模型
    文明旁观者的头像2个月前
    01390
    Mellum2 – JetBrains推出的开源混合专家(MoE)模型

    Mellum2 – JetBrains推出的开源混合专家(MoE)模型

    Mellum2是JetBrains推出的120亿参数开源混合专家(MoE)模型,专为软件工程场景设计,核心目标是通过超低延迟推理与私有化部署能力,解决企业级AI工作流中的实时性与成本瓶颈。 Mellu...
    AI最新项目# 大模型
    文明旁观者的头像2个月前
    01330
    Qwen3.7-Plus – 阿里巴巴发布的多模态智能体模型

    Qwen3.7-Plus – 阿里巴巴发布的多模态智能体模型

    Qwen3.7-Plus是阿里巴巴于2026年6月2日正式发布的多模态智能体模型,定位为视觉与语言统一的智能体基座。它在Qwen3.7文本能力基础上深度融合视觉理解与行动能力,不仅能看懂图像/视频,还...
    AI最新项目# 大模型
    文明旁观者的头像2个月前
    02100
    Cosmos 3 – 英伟达发布的开源全模态物理AI基础大模型

    Cosmos 3 – 英伟达发布的开源全模态物理AI基础大模型

    Cosmos 3是英伟达(NVIDIA)于2026年6月1日正式发布的全球首款全开源、全模态(Omni-Model)物理AI基础大模型。它被定义为一个“世界模型”,旨在赋予人工智能系统理解物理世界规律...
    AI最新项目# 大模型
    文明旁观者的头像2个月前
    02360
    Qwen-VLA – 阿里通义团队最新发布的通用机器人基础模型

    Qwen-VLA – 阿里通义团队最新发布的通用机器人基础模型

    Qwen-VLA是阿里通义团队最新发布的通用机器人基础模型。 简单来说,如果之前的视觉模型是让AI拥有一双“眼睛”去理解世界,那么Qwen-VLA就是给这双眼睛配上了“灵活的手脚”,让AI不仅能看、能...
    AI最新项目# 大模型
    文明旁观者的头像2个月前
    01270
    MiniMax M3 – MiniMax发布的新一代旗舰通用大模型

    MiniMax M3 – MiniMax发布的新一代旗舰通用大模型

    MiniMax M3是国产大模型公司MiniMax正式发布的新一代旗舰通用大模型。MiniMax M3是国内首个同时集齐“前沿编程与智能体能力、百万级超长上下文、原生多模态”三大核心能力的模型,也是目...
    AI最新项目# 大模型
    文明旁观者的头像2个月前
    01150
    ControlFoley – 小米大模型开源可控视频音效生成模型

    ControlFoley – 小米大模型开源可控视频音效生成模型

    ControlFoley是小米大模型应用团队与武汉大学联合开发的开源可控视频音效生成模型。其核心突破在于 首次实现"按意图配声音"的精准控制能力,解决了传统音效生成模型"只能根据画面自动猜声音"的局限...
    AI最新项目# 大模型
    文明旁观者的头像2个月前
    01500
    SenseNova-U1-8B-MoT-Infographic – 商汤科技开源的多模态大模型

    SenseNova-U1-8B-MoT-Infographic – 商汤科技开源的多模态大模型

    SenseNova-U1-8B-MoT-Infographic是商汤科技开源的专项增强版多模态大模型,基于原生统一架构 SenseNova-U1-8B-MoT针对信息图(infographic)生成场...
    AI最新项目# 大模型
    文明旁观者的头像2个月前
    01440
    ForgeTrain – 面壁智能联合清华等全球首个由AI自主编写

    ForgeTrain – 面壁智能联合清华等全球首个由AI自主编写

    ForgeTrain是由面壁智能联合清华大学及OpenBMB开源社区发布的全球首个完全由AI自主编写、零人类代码介入的生产级大模型预训练框架。 其核心突破在于AI首次独立完成大模型训练基础设施的端到端...
    AI最新项目# 大模型
    文明旁观者的头像2个月前
    01080
    LFM2.5-1.2B – Liquid AI推出的12亿参数轻量级AI模型家族

    LFM2.5-1.2B – Liquid AI推出的12亿参数轻量级AI模型家族

    LFM2.5-1.2B是Liquid AI推出的12亿参数轻量级AI模型家族,专为边缘设备与本地部署优化设计,最大特点是仅需约900MB内存即可在普通智能手机上流畅运行,同时通过创新的"思考链"机制实...
    AI最新项目# 大模型
    文明旁观者的头像2个月前
    01640
    Xiaomi Auto World Model – 小米发布的世界模型全新框架

    Xiaomi Auto World Model – 小米发布的世界模型全新框架

    Xiaomi Auto World Model是小米汽车发布的世界模型全新框架,其核心突破在于首次将三维重建与视频生成深度耦合为一体化架构,以“重建锚定几何、生成填补想象”的新范式,推动辅助驾驶从“场...
    AI最新项目# 大模型
    文明旁观者的头像2个月前
    02290
    ZCube – 智谱联合清华大学开发的新型AI集群网络架构

    ZCube – 智谱联合清华大学开发的新型AI集群网络架构

    ZCube是由智谱联合清华大学、驭驯网络开发的新型AI集群网络架构,专为解决大模型推理场景中的结构性网络拥塞问题而设计。 其核心突破在于彻底重构网络拓扑,通过取消传统Clos架构的Spine层、采用扁...
    AI最新项目# 大模型
    文明旁观者的头像2个月前
    01760
    Lance – 字节跳动推出的原生统一的多模态模型

    Lance – 字节跳动推出的原生统一的多模态模型

    Lance 是字节跳动推出的一个原生统一的多模态模型。它是一个参数量为 30亿(3B) 的研究性项目,旨在打破图像和视频在理解、生成、编辑任务上的壁垒。 与许多需要针对不同任务单独微调的模型不同,La...
    AI最新项目# 大模型
    文明旁观者的头像2个月前
    03010
    hronicles-OCR – 腾讯混元发布首个古文字“七体”评测基准

    hronicles-OCR – 腾讯混元发布首个古文字“七体”评测基准

    hronicles-OCR是由腾讯混元大模型联合中国科学院信息工程研究所、安阳师范学院、南开大学及故宫博物院等权威机构,共同推出的业界首个中国古文字感知评测基准。 简单来说,它是一套专门用来给当前顶尖...
    AI最新项目# 大模型
    文明旁观者的头像2个月前
    01550
    General365 – 美团LongCat团队开源通用推理新评测基准

    General365 – 美团LongCat团队开源通用推理新评测基准

    General365是由美团LongCat团队在2026年4月底发布,并于5月中旬正式开源的一个专注于评估大模型通用逻辑推理能力的全新评测基准。 简单来说,它是一套专门为 AI 设计的“高难度逻辑考卷...
    AI最新项目# 大模型
    文明旁观者的头像2个月前
    02130
    GPT-Realtime-Whisper – OpenAI推出的低延迟语音转文字模型

    GPT-Realtime-Whisper – OpenAI推出的低延迟语音转文字模型

    GPT-Realtime-Whisper是OpenAI推出的一款专注于低延迟流式语音转文字的模型。它的核心突破在于实现了真正的“边说边转”。与传统的“录音-上传-识别”模式不同,它能在你说话的同时实时...
    AI最新项目# 大模型
    文明旁观者的头像2个月前
    01690
    加载更多
    AI深识站
    AI深识站——国内外优质AI工具导航平台,收录AI写作、绘画、办公、音视频等热门工具,配套AI资讯与教程,每日更新,助你高效工作、玩转AI生活!用AI,学AI,从这里开始。Ctrl + D 或 ⌘ + D 添加书签,随时探索AI新世界。

    关于我们广告合作免责声明

    Copyright © 2026 AI深识站 赣ICP备2026009722号-1 
    网址
    网址文章软件
    热门搜索
    元宝豆包DeepSeek千问翻译