AI深识站
  • AI软件
  • AI资讯
  • AI世界漫游指南
    • AI知识探索库
    • AI学习教程
  • AI最新项目
  • 排行榜
      • 未登录
        登录后即可体验更多功能
    • AI软件
    • AI资讯
    • AI世界漫游指南
      • AI知识探索库
      • AI学习教程
    • AI最新项目
    • 排行榜
    未登录
    登录后即可体验更多功能

    大模型

    共 164 篇文章
    排序
    发布更新浏览点赞
    LingBot-Vision – 灵波科技研发的面向具身智能视觉基础模型

    LingBot-Vision – 灵波科技研发的面向具身智能视觉基础模型

    LingBot-Vision是蚂蚁集团旗下灵波科技研发的全球首个面向具身智能的“空间原生”视觉基础模型,将物体边界结构作为预训练核心目标,使机器人能精准感知物理世界的三维空间关系(如物体边界位置、距离...
    AI最新项目# 大模型
    文明旁观者的头像2个月前
    01080
    Fun-ASR-Realtime – 通义升级发布的流式实时语音识别大模型

    Fun-ASR-Realtime – 通义升级发布的流式实时语音识别大模型

    Fun-ASR-Realtime是阿里云通义实验室升级发布的流式实时语音识别大模型,首字延迟控制在百毫秒级别、识别准确率接近离线模型,同时支持16种方言与30种语言的无缝识别。该模型专为直播字幕、会议...
    AI最新项目# 大模型
    文明旁观者的头像2个月前
    01020
    Hy3 – 腾讯混元发布的新一代开源大语言模型

    Hy3 – 腾讯混元发布的新一代开源大语言模型

    腾讯混元Hy3是腾讯发布的新一代开源大语言模型,采用混合专家(MoE)架构,在保持较小激活参数量的同时实现与更大尺寸旗舰模型相当的性能。高性价比的实用型模型,重点强化了Agent能力、推理稳定性及办公...
    AI最新项目# 大模型
    文明旁观者的头像2个月前
    01140
    Leanstral 1.5 – Mistral AI推出的形式化验证与数学证明领域模型

    Leanstral 1.5 – Mistral AI推出的形式化验证与数学证明领域模型

    Leanstral 1.5是Mistral AI推出的专注于形式化验证与数学证明领域的专用AI模型,属于Leanstral系列的迭代版本。它并非通用编程助手,而是专为 Lean 4 证明语言设计的代码...
    AI最新项目# 大模型
    文明旁观者的头像2个月前
    01170
    Vidu S1 – 生数科技发布的实时交互的视频生成大模型

    Vidu S1 – 生数科技发布的实时交互的视频生成大模型

    Vidu S1是生数科技发布的全球首个支持实时交互的视频生成大模型,将视频生成从传统的“单向离线输出”升级为“双向实时对话”,用户可通过语音指令动态控制视频内容走向,实现540P分辨率、25FPS帧率...
    AI最新项目# 大模型
    文明旁观者的头像2个月前
    01120
    地层学AI大模型 -中国科学家发布首个地层学AI大模型

    地层学AI大模型 -中国科学家发布首个地层学AI大模型

    地层学AI大模型是中国科学家于2026年7月3日在全球首次发布的、专门针对地层学领域的专业人工智能模型,通过统一时间标尺整合地球46亿年演化历史的地质记录,构建全球共享的地层数据库,从而为生命起源、资...
    AI最新项目# 大模型
    文明旁观者的头像2个月前
    01420
    Nemotron-Labs-TwoTower – 英伟达开源的扩散语言模型

    Nemotron-Labs-TwoTower – 英伟达开源的扩散语言模型

    Nemotron-Labs-TwoTower是英伟达(NVIDIA)开源的扩散语言模型,通过双塔架构设计将文本生成吞吐量提升2.42倍,同时保留98.7%的原始生成质量,专为解决传统自回归模型在大规模...
    AI最新项目# 大模型
    文明旁观者的头像2个月前
    01080
    AMALIA – 葡萄牙主导开发的葡萄牙语开源大语言模型

    AMALIA – 葡萄牙主导开发的葡萄牙语开源大语言模型

    AMALIA是葡萄牙国家主导开发的首个专为欧洲葡萄牙语(pt-PT)优化的开源大语言模型目标是解决主流AI模型对欧洲葡萄牙语文化及语言细节支持不足的问题,通过深度本地化训练实现对葡萄牙语境、法律体系和...
    AI最新项目# 大模型
    文明旁观者的头像2个月前
    0890
    yuxinlu1 Gemma4-12B – 深度微调的本地化专业模型系列

    yuxinlu1 Gemma4-12B – 深度微调的本地化专业模型系列

    yuxinlu1 Gemma4-12B是开发者逯雨鑫基于谷歌官方Gemma4-12B模型深度微调的本地化专业模型系列,主要包括编程专用版(Coder版)和故事创作版(Agentic-Fable版)。通...
    AI最新项目# 大模型
    文明旁观者的头像2个月前
    01190
    RedKnot – 小红书研发并开源的长上下文大模型推理引擎

    RedKnot – 小红书研发并开源的长上下文大模型推理引擎

    RedKnot是小红书技术团队研发并开源的长上下文大模型推理引擎,通过按注意力头维度优化KV缓存管理,在显著提升推理速度的同时保持高精度,尤其适用于超长文本处理场景。将传统按token粒度的缓存机制重...
    AI最新项目# 大模型
    文明旁观者的头像2个月前
    0950
    LongCat-2.0 – 美团发布的万亿参数级基础大模型

    LongCat-2.0 – 美团发布的万亿参数级基础大模型

    LongCat-2.0是美团发布的万亿参数级基础大模型,作为业界首个全程依托国产算力完成训练与推理的万亿参数模型,其总参数规模达1.6万亿(1.6T),采用混合专家(MoE)架构,每个Token仅激活...
    AI最新项目# 大模型
    文明旁观者的头像2个月前
    01770
    openPangu 2.0 Flash – 华为发布的开源盘古大模型轻量化版本

    openPangu 2.0 Flash – 华为发布的开源盘古大模型轻量化版本

    openPangu-2.0-Flash是在华为开发者大会(HDC 2026)发布的开源盘古大模型轻量化版本,采用稀疏专家混合(MoE)架构,总参数量920亿(92B),但推理时仅激活60亿(6B)参数...
    AI最新项目# 大模型
    文明旁观者的头像2个月前
    01310
    DeepSeek V4正式版 – 深度求索上线的旗舰大语言模型

    DeepSeek V4正式版 – 深度求索上线的旗舰大语言模型

    DeepSeek V4正式版是深度求索(DeepSeek)将于2026年7月中旬正式上线的旗舰大语言模型,基于4月24日发布的预览版完成功能优化与性能调优,首次引入峰谷定价机制以优化算力资源分配。该版...
    AI最新项目# 大模型
    文明旁观者的头像2个月前
    05180
    子曰4.0 – 网易有道发布的全模态大模型4.0版本

    子曰4.0 – 网易有道发布的全模态大模型4.0版本

    子曰4.0是网易有道发布的全模态大模型4.0版本,同步开源多模态理解模型与TTS语音合成引擎,其中Confucius4-TTS作为业内首个支持14种语言跨语种无口音、且无需参考文本即可完成语音克隆的开...
    AI最新项目# 大模型
    文明旁观者的头像2个月前
    01120
    Unlimited-OCR – 百度开源的端到端长文档解析视觉语言模型

    Unlimited-OCR – 百度开源的端到端长文档解析视觉语言模型

    Unlimited-OCR是百度开源的端到端长文档解析视觉语言模型,通过创新的参考滑动窗口注意力机制(R-SWA),首次实现单次推理无损解析40+页PDF文档的能力,解决了传统OCR模型处理长文档时的...
    AI最新项目# 大模型
    文明旁观者的头像2个月前
    01600
    Qwen-AgentWorld – 阿里通义千问团队发布原生语言世界模型

    Qwen-AgentWorld – 阿里通义千问团队发布原生语言世界模型

    Qwen-AgentWorld是阿里巴巴通义千问团队于2026年6月24日发布的全球首个原生语言世界模型(Language World Model, LWM),从训练源头实现环境建模,而非依赖事后插件...
    AI最新项目# 大模型
    文明旁观者的头像2个月前
    02060
    Seedance 2.5 – 字节跳动发布的最新视频生成大模型

    Seedance 2.5 – 字节跳动发布的最新视频生成大模型

    Seedance 2.5是字节跳动火山引擎6月23日发布的最新视频生成大模型,作为Seedance 2.0的升级版本,实现单段30秒原生视频直出、支持50个全模态素材联合输入,并首次提供画面一致性保障...
    AI最新项目# 大模型
    文明旁观者的头像2个月前
    01780
    doubao-seed-2.1 Turbo – 豆包大模型系列轻量化生产级版本

    doubao-seed-2.1 Turbo – 豆包大模型系列轻量化生产级版本

    doubao-seed-2.1 Turbo是字节跳动于2026年6月23日发布的豆包大模型系列轻量化生产级版本,作为doubao-seed-2.1 Pro的低成本、高吞吐优化版本,以Pro版50%的成...
    AI最新项目# 大模型
    文明旁观者的头像2个月前
    01980
    Doubao-Seed-2.1 Pro – 字节发布的豆包大模型系列最新旗舰版本

    Doubao-Seed-2.1 Pro – 字节发布的豆包大模型系列最新旗舰版本

    Doubao-Seed-2.1 Pro是字节跳动于2026年6月23日发布的豆包大模型系列最新旗舰版本,作为面向企业级高复杂度任务的深度思考模型,通过代码生成、智能Agent协同与多模态理解三大能力的...
    AI最新项目# 大模型
    文明旁观者的头像2个月前
    01950
    Baichuan-M4 – 百川智能与团队联合发布的医疗增强大模型

    Baichuan-M4 – 百川智能与团队联合发布的医疗增强大模型

    百川智能与清华大学研究团队联合发布的医疗增强大模型Baichuan-M4,是全球首个在HealthBench三大权威榜单(综合、Hard复杂决策、Professional专业场景)同时登顶的医疗专用大...
    AI最新项目# 大模型
    文明旁观者的头像2个月前
    01330
    JoyAI-VL-Interaction – 京东开源的全栈开源视觉语言实时交互模型

    JoyAI-VL-Interaction – 京东开源的全栈开源视觉语言实时交互模型

    JoyAI-VL-Interaction是京东于2026年6月22日正式开源的全球首个全栈开源视觉语言实时交互模型,将多模态大模型从传统"一问一答"模式升级为"边看边说"的实时流式交互能力,使AI能像...
    AI最新项目# 大模型
    文明旁观者的头像2个月前
    01970
    HappyHorse 1.1 – 阿里巴巴发布的视频生成大模型升级版本

    HappyHorse 1.1 – 阿里巴巴发布的视频生成大模型升级版本

    HappyHorse 1.1是阿里巴巴于2026年6月22日正式发布的视频生成大模型升级版本,在动态表现力、主体一致性、指令遵循、视觉质感和音频能力五大核心维度实现系统性突破。解决专业内容生产场景中动...
    AI最新项目# 大模型
    文明旁观者的头像2个月前
    02190
    UnifoLM-VLA-0 – 宇树科技开源的视觉-语言-动作大模型

    UnifoLM-VLA-0 – 宇树科技开源的视觉-语言-动作大模型

    UnifoLM-VLA-0是宇树科技开源的视觉-语言-动作(VLA)大模型,专为通用人形机器人操作设计,通过将视觉感知、语言指令与物理动作统一建模,实现了从传统图文理解到具备物理常识的"具身智能"突破...
    AI最新项目# 大模型
    文明旁观者的头像2个月前
    01510
    LOGOS – 阿里开源的跨学科统一科学基座大模型

    LOGOS – 阿里开源的跨学科统一科学基座大模型

    阿里开源的LOGOS(Language Of Generative Objects in Science)是国内首个跨学科统一科学基座大模型,由阿里ATH-Token Foundry联合中国人民大学高...
    AI最新项目# 大模型
    文明旁观者的头像2个月前
    01450
    Qwen-Robot Suite – 阿里巴巴发布的千问大模型具身智能模型

    Qwen-Robot Suite – 阿里巴巴发布的千问大模型具身智能模型

    Qwen-Robot Suite是阿里巴巴于2026年6月16日发布的千问大模型家族首个完整具身智能模型系列,包含Qwen-RobotManip(操作模型)、Qwen-RobotNav(导航模型)和Q...
    AI最新项目# 大模型
    文明旁观者的头像2个月前
    01280
    DeepSeek V4 Pro – 深度求索发布的旗舰级开源大语言模型

    DeepSeek V4 Pro – 深度求索发布的旗舰级开源大语言模型

    DeepSeek V4 Pro是深度求索(DeepSeek)发布的旗舰级开源大语言模型,采用1.6万亿参数混合专家(MoE)架构,原生支持100万token超长上下文,在推理能力、Agent任务执行效...
    AI最新项目# 大模型
    文明旁观者的头像2个月前
    01060
    PP-OCRv6 – 百度飞桨发布的超轻量级OCR模型系列最新版本

    PP-OCRv6 – 百度飞桨发布的超轻量级OCR模型系列最新版本

    PP-OCRv6是百度飞桨发布的超轻量级OCR(光学字符识别)模型系列最新版本,50种语言统一模型架构与工业级复杂场景适应能力。它通过三阶段流水线(检测-分类-识别)实现高精度、低延迟、小体积的文本识...
    AI最新项目# 大模型
    文明旁观者的头像2个月前
    01090
    DeepSeek Coder – 深度求索开发的完全开源、免费商用的大模型系列

    DeepSeek Coder – 深度求索开发的完全开源、免费商用的大模型系列

    DeepSeek Coder是由杭州深度求索人工智能基础技术研究有限公司开发的完全开源、免费商用的代码大模型系列,专注于代码生成、理解与调试。以高效推理和多语言支持能力打破闭源模型的技术壁垒,在多项代...
    AI最新项目# 大模型
    文明旁观者的头像2个月前
    01150
    Decitron – 中科闻歌发布的全球首个通用决策大模型

    Decitron – 中科闻歌发布的全球首个通用决策大模型

    Decitron是中科闻歌发布的全球首个通用决策大模型,将复杂决策问题转化为可计算、可推演、可验证的系统,而非传统问答式AI。能对复杂事件进行多路径推演并动态追踪,在国际权威数据集PolyBench测...
    AI最新项目# 大模型
    文明旁观者的头像2个月前
    01250
    Kimi K2.7 Code – 月之暗面发布的编程专用大模型

    Kimi K2.7 Code – 月之暗面发布的编程专用大模型

    Kimi K2.7 Code是月之暗面(Moonshot AI)发布的编程专用大模型,解决长程编程任务中的过度思考问题,而非通用能力升级。长任务平均Token消耗直降30%,同时输出速度提升至普通版的...
    AI最新项目# 大模型
    文明旁观者的头像2个月前
    01460
    加载更多
    AI深识站
    AI深识站——国内外优质AI工具导航平台,收录AI写作、绘画、办公、音视频等热门工具,配套AI资讯与教程,每日更新,助你高效工作、玩转AI生活!用AI,学AI,从这里开始。Ctrl + D 或 ⌘ + D 添加书签,随时探索AI新世界。

    关于我们广告合作免责声明

    Copyright © 2026 AI深识站 赣ICP备2026009722号-1 
    网址
    网址文章软件
    热门搜索
    元宝豆包DeepSeek千问翻译