AI深识站
  • AI软件
  • AI资讯
  • AI世界漫游指南
    • AI知识探索库
    • AI学习教程
  • AI最新项目
  • 排行榜
      • 未登录
        登录后即可体验更多功能
    • AI软件
    • AI资讯
    • AI世界漫游指南
      • AI知识探索库
      • AI学习教程
    • AI最新项目
    • 排行榜
    未登录
    登录后即可体验更多功能

    大模型

    共 164 篇文章
    排序
    发布更新浏览点赞
    ZCube – 智谱联合清华大学开发的新型AI集群网络架构

    ZCube – 智谱联合清华大学开发的新型AI集群网络架构

    ZCube是由智谱联合清华大学、驭驯网络开发的新型AI集群网络架构,专为解决大模型推理场景中的结构性网络拥塞问题而设计。 其核心突破在于彻底重构网络拓扑,通过取消传统Clos架构的Spine层、采用扁...
    AI最新项目# 大模型
    文明旁观者的头像2个月前
    01760
    GPT-Realtime-Whisper – OpenAI推出的低延迟语音转文字模型

    GPT-Realtime-Whisper – OpenAI推出的低延迟语音转文字模型

    GPT-Realtime-Whisper是OpenAI推出的一款专注于低延迟流式语音转文字的模型。它的核心突破在于实现了真正的“边说边转”。与传统的“录音-上传-识别”模式不同,它能在你说话的同时实时...
    AI最新项目# 大模型
    文明旁观者的头像2个月前
    01690
    HPC-Ops – 腾讯混元开源的工业级大模型推理核心算子库

    HPC-Ops – 腾讯混元开源的工业级大模型推理核心算子库

    HPC-Ops是腾讯混元AI Infra团队开源的工业级高性能大语言模型(LLM)推理核心算子库,专为解决真实业务场景中的推理性能瓶颈而设计。通过微架构级优化与动态调度技术,显著提升大模型推理吞吐量...
    AI最新项目# 大模型
    文明旁观者的头像2个月前
    01680
    Hy-MT1.5-1.8B-1.25bit – 腾讯混元开源的轻量化的离线翻译模型

    Hy-MT1.5-1.8B-1.25bit – 腾讯混元开源的轻量化的离线翻译模型

    Hy-MT1.5-1.8B-1.25bit是腾讯混元团队正式开源的一款极致轻量化的离线翻译模型。这款模型最大的亮点在于它通过先进的量化压缩技术,将原本需要数GB内存的翻译大模型压缩至440MB 左右...
    AI最新项目# 大模型
    文明旁观者的头像2个月前
    01660
    LFM2.5-1.2B – Liquid AI推出的12亿参数轻量级AI模型家族

    LFM2.5-1.2B – Liquid AI推出的12亿参数轻量级AI模型家族

    LFM2.5-1.2B是Liquid AI推出的12亿参数轻量级AI模型家族,专为边缘设备与本地部署优化设计,最大特点是仅需约900MB内存即可在普通智能手机上流畅运行,同时通过创新的"思考链"机制实...
    AI最新项目# 大模型
    文明旁观者的头像2个月前
    01630
    MAI-Thinking-1 – 微软发布的首款完全自研的高级推理AI模型

    MAI-Thinking-1 – 微软发布的首款完全自研的高级推理AI模型

    MAI-Thinking-1是微软于2026年6月3日发布的首款完全自研的高级推理AI模型,采用350亿活跃参数的稀疏混合专家(MoE)架构,完全基于企业级合规数据从零训练,未使用任何第三方模型蒸馏数...
    AI最新项目# 大模型
    文明旁观者的头像2个月前
    01620
    Unlimited-OCR – 百度开源的端到端长文档解析视觉语言模型

    Unlimited-OCR – 百度开源的端到端长文档解析视觉语言模型

    Unlimited-OCR是百度开源的端到端长文档解析视觉语言模型,通过创新的参考滑动窗口注意力机制(R-SWA),首次实现单次推理无损解析40+页PDF文档的能力,解决了传统OCR模型处理长文档时的...
    AI最新项目# 大模型
    文明旁观者的头像2个月前
    01600
    hronicles-OCR – 腾讯混元发布首个古文字“七体”评测基准

    hronicles-OCR – 腾讯混元发布首个古文字“七体”评测基准

    hronicles-OCR是由腾讯混元大模型联合中国科学院信息工程研究所、安阳师范学院、南开大学及故宫博物院等权威机构,共同推出的业界首个中国古文字感知评测基准。 简单来说,它是一套专门用来给当前顶尖...
    AI最新项目# 大模型
    文明旁观者的头像2个月前
    01550
    VitaBench 2.0 – LongCat推出的新一代大模型智能体评测基准

    VitaBench 2.0 – LongCat推出的新一代大模型智能体评测基准

    VitaBench 2.0是美团LongCat团队联合多所高校推出的新一代大模型智能体评测基准,专注于评估智能体在长期、多轮次真实生活场景交互中的综合能力。 与早期版本相比,将评测维度从单次任务扩展至...
    AI最新项目# 大模型
    文明旁观者的头像2个月前
    01540
    GLM-5 重磅开源:代码能力与工程化双优的顶级开源模型

    GLM-5 重磅开源:代码能力与工程化双优的顶级开源模型

    今天,我们上线并开源 GLM-5。 学界与业界正逐渐形成一种共识,大模型从写代码、写前端,进化到写工程、完成大任务,即从“Vibe Coding”变革为“Agentic Engineering”。 G...
    AI资讯# 大模型
    文明旁观者的头像2个月前
    01530
    Matrix -Game3.5 – Skywork团队发布的开源多模态世界模型

    Matrix -Game3.5 – Skywork团队发布的开源多模态世界模型

    Matrix-Game 3.5是昆仑万维旗下Skywork团队发布的开源多模态世界模型,实现Patch级空间记忆机制与单卡实时交互能力,使AI能生成具有物理因果一致性的可交互虚拟世界。它标志着世界模型...
    AI最新项目# 大模型
    文明旁观者的头像1个月前
    01520
    UnifoLM-VLA-0 – 宇树科技开源的视觉-语言-动作大模型

    UnifoLM-VLA-0 – 宇树科技开源的视觉-语言-动作大模型

    UnifoLM-VLA-0是宇树科技开源的视觉-语言-动作(VLA)大模型,专为通用人形机器人操作设计,通过将视觉感知、语言指令与物理动作统一建模,实现了从传统图文理解到具备物理常识的"具身智能"突破...
    AI最新项目# 大模型
    文明旁观者的头像2个月前
    01510
    PaddleOCR-VL-1.6 – 百度发布的轻量化多模态文档解析模型

    PaddleOCR-VL-1.6 – 百度发布的轻量化多模态文档解析模型

    PaddleOCR-VL-1.6是百度发布的轻量化多模态文档解析模型,在权威评测集OmniDocBench v1.6中以96.33%的综合准确率刷新全球SOTA记录,超越Gemini-3-Pro、GP...
    AI最新项目# 大模型
    文明旁观者的头像2个月前
    01500
    ControlFoley – 小米大模型开源可控视频音效生成模型

    ControlFoley – 小米大模型开源可控视频音效生成模型

    ControlFoley是小米大模型应用团队与武汉大学联合开发的开源可控视频音效生成模型。其核心突破在于 首次实现"按意图配声音"的精准控制能力,解决了传统音效生成模型"只能根据画面自动猜声音"的局限...
    AI最新项目# 大模型
    文明旁观者的头像2个月前
    01490
    Kimi K2.7 Code – 月之暗面发布的编程专用大模型

    Kimi K2.7 Code – 月之暗面发布的编程专用大模型

    Kimi K2.7 Code是月之暗面(Moonshot AI)发布的编程专用大模型,解决长程编程任务中的过度思考问题,而非通用能力升级。长任务平均Token消耗直降30%,同时输出速度提升至普通版的...
    AI最新项目# 大模型
    文明旁观者的头像2个月前
    01460
    Ling 3.0 Flash – 蚂蚁百灵团队最新发布的高效推理大模型

    Ling 3.0 Flash – 蚂蚁百灵团队最新发布的高效推理大模型

    Ling 3.0 Flash是蚂蚁集团百灵团队最新发布的高效推理大模型,总参数量124B,激活参数仅5.1B,在保持高智能水平的同时显著优化Token消耗与推理速度。以1/10的Token消耗实现Ag...
    AI最新项目# 大模型
    文明旁观者的头像1个月前
    01450
    LOGOS – 阿里开源的跨学科统一科学基座大模型

    LOGOS – 阿里开源的跨学科统一科学基座大模型

    阿里开源的LOGOS(Language Of Generative Objects in Science)是国内首个跨学科统一科学基座大模型,由阿里ATH-Token Foundry联合中国人民大学高...
    AI最新项目# 大模型
    文明旁观者的头像2个月前
    01450
    SenseNova-U1-8B-MoT-Infographic – 商汤科技开源的多模态大模型

    SenseNova-U1-8B-MoT-Infographic – 商汤科技开源的多模态大模型

    SenseNova-U1-8B-MoT-Infographic是商汤科技开源的专项增强版多模态大模型,基于原生统一架构 SenseNova-U1-8B-MoT针对信息图(infographic)生成场...
    AI最新项目# 大模型
    文明旁观者的头像2个月前
    01440
    地层学AI大模型 -中国科学家发布首个地层学AI大模型

    地层学AI大模型 -中国科学家发布首个地层学AI大模型

    地层学AI大模型是中国科学家于2026年7月3日在全球首次发布的、专门针对地层学领域的专业人工智能模型,通过统一时间标尺整合地球46亿年演化历史的地质记录,构建全球共享的地层数据库,从而为生命起源、资...
    AI最新项目# 大模型
    文明旁观者的头像2个月前
    01420
    HiDream-O1-Image-1.5 – 智象未来推出的商用版图像生成模型

    HiDream-O1-Image-1.5 – 智象未来推出的商用版图像生成模型

    HiDream-O1-Image-1.5智象未来推出的商用版图像生成模型,在Artificial Analysis全球文生图榜单中评分1265ELO,位列中国第一、全球第二(仅次于OpenAI),采用...
    AI最新项目# 大模型
    文明旁观者的头像2个月前
    01400
    MOSS-VL-Realtime – OpenMOSS团队开源视频理解模型

    MOSS-VL-Realtime – OpenMOSS团队开源视频理解模型

    MOSS-VL-Realtime是由复旦大学OpenMOSS团队开发的开源实时流式视频理解模型,专为处理动态视频流设计,突破传统模型需等待完整视频输入的限制,实现边接收画面边生成回答、信息不足时主动保...
    AI最新项目# 大模型
    文明旁观者的头像1个月前
    01390
    Qwen2.5-7B – 阿里云通义千问系列开源大语言模型

    Qwen2.5-7B – 阿里云通义千问系列开源大语言模型

    Qwen2.5-7B是阿里云通义千问系列推出的76.1亿参数开源大语言模型,核心特点为支持131.072 tokens超长上下文、原生结构化输出能力及显著提升的数学与编程性能,适用于需平衡推理成本与专...
    AI最新项目# 大模型
    文明旁观者的头像2个月前
    01390
    Agnes-2.5-Flash – Agnes AI推出的全新文本大模型

    Agnes-2.5-Flash – Agnes AI推出的全新文本大模型

    Agnes-2.5-Flash是Agnes AI推出的全新高性能文本大模型,作为Agnes-2.0-Flash的升级版本,专为开发者与AI Agent工作流设计,在代码理解、工程修复、多步骤任务执行及...
    AI最新项目# 大模型
    文明旁观者的头像2个月前
    01370
    ABot-Earth0.5 – 高德地图发布全球首个3D原生城市世界模型

    ABot-Earth0.5 – 高德地图发布全球首个3D原生城市世界模型

    ABot-Earth0.5是高德地图发布的全球首个3D原生城市世界模型,仅需单张卫星图像或文字描述,即可在10分钟内通过消费级GPU生成公里级可编辑3D城市场景。该模型将3D制图成本降至传统方式的百分...
    AI最新项目# 大模型
    文明旁观者的头像2个月前
    01350
    Baichuan-M4 – 百川智能与团队联合发布的医疗增强大模型

    Baichuan-M4 – 百川智能与团队联合发布的医疗增强大模型

    百川智能与清华大学研究团队联合发布的医疗增强大模型Baichuan-M4,是全球首个在HealthBench三大权威榜单(综合、Hard复杂决策、Professional专业场景)同时登顶的医疗专用大...
    AI最新项目# 大模型
    文明旁观者的头像2个月前
    01330
    Mellum2 – JetBrains推出的开源混合专家(MoE)模型

    Mellum2 – JetBrains推出的开源混合专家(MoE)模型

    Mellum2是JetBrains推出的120亿参数开源混合专家(MoE)模型,专为软件工程场景设计,核心目标是通过超低延迟推理与私有化部署能力,解决企业级AI工作流中的实时性与成本瓶颈。 Mellu...
    AI最新项目# 大模型
    文明旁观者的头像2个月前
    01320
    openPangu 2.0 Flash – 华为发布的开源盘古大模型轻量化版本

    openPangu 2.0 Flash – 华为发布的开源盘古大模型轻量化版本

    openPangu-2.0-Flash是在华为开发者大会(HDC 2026)发布的开源盘古大模型轻量化版本,采用稀疏专家混合(MoE)架构,总参数量920亿(92B),但推理时仅激活60亿(6B)参数...
    AI最新项目# 大模型
    文明旁观者的头像2个月前
    01310
    Qwen-Robot Suite – 阿里巴巴发布的千问大模型具身智能模型

    Qwen-Robot Suite – 阿里巴巴发布的千问大模型具身智能模型

    Qwen-Robot Suite是阿里巴巴于2026年6月16日发布的千问大模型家族首个完整具身智能模型系列,包含Qwen-RobotManip(操作模型)、Qwen-RobotNav(导航模型)和Q...
    AI最新项目# 大模型
    文明旁观者的头像2个月前
    01280
    FLUX 3 – Black Forest Labs发布的多模态基础模型

    FLUX 3 – Black Forest Labs发布的多模态基础模型

    FLUX 3是德国人工智能公司Black Forest Labs发布的全球首个在统一架构下联合训练图像、视频、音频及机器人动作预测的多模态基础模型。通过Self-Flow技术将物理世界的因果逻辑融入生...
    AI最新项目# 大模型
    文明旁观者的头像1个月前
    01260
    SenseNova U1 Pro – 商汤科技发布的原生多模态智能体基座模型

    SenseNova U1 Pro – 商汤科技发布的原生多模态智能体基座模型

    SenseNova U1 Pro是商汤科技在世界人工智能大会上发布的旗舰级原生多模态智能体基座模型,推动行业从“单点式内容生成”迈向“系统级内容交付”新时代。通过原生统一架构实现理解、生成与行动的深度...
    AI最新项目# 大模型
    文明旁观者的头像1个月前
    01260
    加载更多
    AI深识站
    AI深识站——国内外优质AI工具导航平台,收录AI写作、绘画、办公、音视频等热门工具,配套AI资讯与教程,每日更新,助你高效工作、玩转AI生活!用AI,学AI,从这里开始。Ctrl + D 或 ⌘ + D 添加书签,随时探索AI新世界。

    关于我们广告合作免责声明

    Copyright © 2026 AI深识站 赣ICP备2026009722号-1 
    网址
    网址文章软件
    热门搜索
    元宝豆包DeepSeek千问翻译