AI深识站
  • AI软件
  • AI资讯
  • AI世界漫游指南
    • AI知识探索库
    • AI学习教程
  • AI最新项目
  • 排行榜
      • 未登录
        登录后即可体验更多功能
    • AI软件
    • AI资讯
    • AI世界漫游指南
      • AI知识探索库
      • AI学习教程
    • AI最新项目
    • 排行榜
    未登录
    登录后即可体验更多功能

    大模型

    共 164 篇文章
    排序
    发布更新浏览点赞
    SenseNova U1 Pro – 商汤科技发布的原生多模态智能体基座模型

    SenseNova U1 Pro – 商汤科技发布的原生多模态智能体基座模型

    SenseNova U1 Pro是商汤科技在世界人工智能大会上发布的旗舰级原生多模态智能体基座模型,推动行业从“单点式内容生成”迈向“系统级内容交付”新时代。通过原生统一架构实现理解、生成与行动的深度...
    AI最新项目# 大模型
    文明旁观者的头像1个月前
    01260
    Xmax X2.0 – Xmax AI发布的支持实时交互的端侧视频生成模型

    Xmax X2.0 – Xmax AI发布的支持实时交互的端侧视频生成模型

    Xmax X2.0是Xmax AI发布的全球首个支持实时交互的端侧视频生成模型,彻底突破传统AI视频“输入-等待-输出”的固定流程,实现“边生成边交互”的即时操作体验。将视频从“观看内容”转化为“可实...
    AI最新项目# 大模型
    文明旁观者的头像1个月前
    01260
    Decitron – 中科闻歌发布的全球首个通用决策大模型

    Decitron – 中科闻歌发布的全球首个通用决策大模型

    Decitron是中科闻歌发布的全球首个通用决策大模型,将复杂决策问题转化为可计算、可推演、可验证的系统,而非传统问答式AI。能对复杂事件进行多路径推演并动态追踪,在国际权威数据集PolyBench测...
    AI最新项目# 大模型
    文明旁观者的头像2个月前
    01250
    新程Alpha – 明日新程公司推出的全球首个端侧认知模型

    新程Alpha – 明日新程公司推出的全球首个端侧认知模型

    新程Alpha是明日新程(Nextie)公司推出的全球首个端侧认知模型,参数量仅4B(40亿),通过将“知识记忆”与“思考能力”解耦,专注于泛化推理和抽象决策,在群体智能任务中表现等效于GPT-5.4...
    AI最新项目# 大模型
    文明旁观者的头像2个月前
    01240
    Nemotron-Labs-Diffusion – 英伟达推出的统一架构的三模式大语言模型

    Nemotron-Labs-Diffusion – 英伟达推出的统一架构的三模式大语言模型

    Nemotron-Labs-Diffusion是英伟达推出的统一架构的三模式大语言模型,通过创新性地将自回归、扩散和自猜测三种解码模式集成于单一模型,在保持生成质量的同时显著提升推理吞吐量。无需额外小...
    AI最新项目# 大模型
    文明旁观者的头像1个月前
    01220
    Xiaomi-Robotics-U0 – 小米发布的多模态自回归具身生成基础模型

    Xiaomi-Robotics-U0 – 小米发布的多模态自回归具身生成基础模型

    Xiaomi-Robotics-U0是小米发布的380亿参数多模态自回归具身生成基础模型,专为解决机器人训练中的数据稀缺问题而设计。它首次将具身场景生成、轨迹迁移、交互视频生成与通用文生图能力统一到单...
    AI最新项目# 大模型
    文明旁观者的头像1个月前
    01200
    干细胞AI模型“归元” – 面向干细胞重编程的AI预测模型

    干细胞AI模型“归元” – 面向干细胞重编程的AI预测模型

    干细胞AI模型“归元”是由西湖大学与阿里巴巴达摩院联合开发的面向干细胞重编程的可解释性AI预测模型,通过算法从近400万种小分子药物与生长因子组合中精准筛选最优方案,实现对细胞命运的定向调控,解决了传...
    AI最新项目# 大模型
    文明旁观者的头像1个月前
    01200
    LingBot-Video – 蚂蚁开源的面向具身智能视频生成基础模型

    LingBot-Video – 蚂蚁开源的面向具身智能视频生成基础模型

    LingBot-Video是蚂蚁灵波科技开源的面向具身智能(Embodied AI)的视频生成基础模型,采用Mixture-of-Experts(MoE)架构设计,目标是解决传统视频生成模型在物理规律...
    AI最新项目# 大模型
    文明旁观者的头像2个月前
    01200
    Audio-Visual Flamingo – NVIDIA等推出的全开源音视频大语言模型

    Audio-Visual Flamingo – NVIDIA等推出的全开源音视频大语言模型

    Audio-Visual Flamingo(简称 AVF)是 NVIDIA Nemotron Labs 联合马里兰大学推出的全开源音视频大语言模型(AV-LLM),专门实现音频、图像、长视频的联合感知...
    AI最新项目# 大模型
    文明旁观者的头像1个月前
    01190
    yuxinlu1 Gemma4-12B – 深度微调的本地化专业模型系列

    yuxinlu1 Gemma4-12B – 深度微调的本地化专业模型系列

    yuxinlu1 Gemma4-12B是开发者逯雨鑫基于谷歌官方Gemma4-12B模型深度微调的本地化专业模型系列,主要包括编程专用版(Coder版)和故事创作版(Agentic-Fable版)。通...
    AI最新项目# 大模型
    文明旁观者的头像2个月前
    01190
    Khala – 中央音乐学院与清华大学联合研发的音乐生成大模型

    Khala – 中央音乐学院与清华大学联合研发的音乐生成大模型

    Khala是中央音乐学院与清华大学联合研发的统一声学Token空间音乐生成大模型,解决AI音乐生成中结构连贯性与音质保真度的矛盾,通过构建跨模态对齐的声学表征体系,实现从深层音乐语义到高质量音频的端到...
    AI最新项目# 大模型
    文明旁观者的头像2个月前
    01180
    Leanstral 1.5 – Mistral AI推出的形式化验证与数学证明领域模型

    Leanstral 1.5 – Mistral AI推出的形式化验证与数学证明领域模型

    Leanstral 1.5是Mistral AI推出的专注于形式化验证与数学证明领域的专用AI模型,属于Leanstral系列的迭代版本。它并非通用编程助手,而是专为 Lean 4 证明语言设计的代码...
    AI最新项目# 大模型
    文明旁观者的头像2个月前
    01170
    KAT-Coder-Pro V2.5 – 快手发布的旗舰级Agentic Coding模型

    KAT-Coder-Pro V2.5 – 快手发布的旗舰级Agentic Coding模型

    KAT-Coder-Pro V2.5是快手KwaiKAT团队发布的旗舰级Agentic Coding模型,首次实现国产AI从单点代码补全到端到端跑通完整软件工程任务的突破。该模型通过大规模智能体强化学...
    AI最新项目# 大模型
    文明旁观者的头像2个月前
    01160
    Wan-Streamer v0.2 – 阿里通义发布的端到端全模态实时交互模型

    Wan-Streamer v0.2 – 阿里通义发布的端到端全模态实时交互模型

    Wan-Streamer v0.2是阿里通义实验室发布的端到端全模态实时交互模型,将音视频感知、语言理解与内容生成统一至单个Transformer架构,实现550毫秒级端到端响应延迟(含网络传输)。其...
    AI最新项目# 大模型
    文明旁观者的头像1个月前
    01150
    DeepSeek Coder – 深度求索开发的完全开源、免费商用的大模型系列

    DeepSeek Coder – 深度求索开发的完全开源、免费商用的大模型系列

    DeepSeek Coder是由杭州深度求索人工智能基础技术研究有限公司开发的完全开源、免费商用的代码大模型系列,专注于代码生成、理解与调试。以高效推理和多语言支持能力打破闭源模型的技术壁垒,在多项代...
    AI最新项目# 大模型
    文明旁观者的头像2个月前
    01150
    MiniMax M3 – MiniMax发布的新一代旗舰通用大模型

    MiniMax M3 – MiniMax发布的新一代旗舰通用大模型

    MiniMax M3是国产大模型公司MiniMax正式发布的新一代旗舰通用大模型。MiniMax M3是国内首个同时集齐“前沿编程与智能体能力、百万级超长上下文、原生多模态”三大核心能力的模型,也是目...
    AI最新项目# 大模型
    文明旁观者的头像2个月前
    01150
    Qwen-Audio-3.0-TTS – 阿里通义发布的新一代实时语音合成大模型

    Qwen-Audio-3.0-TTS – 阿里通义发布的新一代实时语音合成大模型

    Qwen-Audio-3.0-TTS是阿里巴巴通义实验室发布的新一代实时语音合成大模型,包含面向实时交互的Flash版本(首包延迟约300毫秒)和面向高质量生成的Plus版本。该模型在全球第三方权威榜...
    AI最新项目# 大模型
    文明旁观者的头像1个月前
    01140
    Hy3 – 腾讯混元发布的新一代开源大语言模型

    Hy3 – 腾讯混元发布的新一代开源大语言模型

    腾讯混元Hy3是腾讯发布的新一代开源大语言模型,采用混合专家(MoE)架构,在保持较小激活参数量的同时实现与更大尺寸旗舰模型相当的性能。高性价比的实用型模型,重点强化了Agent能力、推理稳定性及办公...
    AI最新项目# 大模型
    文明旁观者的头像2个月前
    01140
    openPangu 2.0 – 华为发布的开源大模型系列最新版本

    openPangu 2.0 – 华为发布的开源大模型系列最新版本

    openPangu 2.0是华为在HDC开发者大会上发布的开源大模型系列最新版本,为深度绑定昇腾算力与鸿蒙生态的产业级AI基础设施。通过稀疏MoE架构实现超高吞吐率与低时延,单卡推理性能达业界主流开源...
    AI最新项目# 大模型
    文明旁观者的头像2个月前
    01130
    Nemotron 3 Embed – NVIDIA推出的开源嵌入向量模型系列

    Nemotron 3 Embed – NVIDIA推出的开源嵌入向量模型系列

    Nemotron 3 Embed是NVIDIA推出的开源嵌入向量模型系列,专为检索增强生成(RAG)、智能体记忆及多语言检索场景设计。其8B参数版本在RTEB检索基准测试中以78.46分登顶榜首,成为...
    AI最新项目# 大模型
    文明旁观者的头像1个月前
    01120
    motion-anything – Open Design推出的对话原生的AI动效引擎

    motion-anything – Open Design推出的对话原生的AI动效引擎

    motion-anything是nexu.io旗下Open Design家族推出的本地优先、对话原生的AI动效引擎,定位为智能体时代的动效生产层。用户仅需用一句话描述动效需求,AI即可生成带动效的网页...
    AI最新项目# 大模型
    文明旁观者的头像2个月前
    01120
    Vidu S1 – 生数科技发布的实时交互的视频生成大模型

    Vidu S1 – 生数科技发布的实时交互的视频生成大模型

    Vidu S1是生数科技发布的全球首个支持实时交互的视频生成大模型,将视频生成从传统的“单向离线输出”升级为“双向实时对话”,用户可通过语音指令动态控制视频内容走向,实现540P分辨率、25FPS帧率...
    AI最新项目# 大模型
    文明旁观者的头像2个月前
    01120
    子曰4.0 – 网易有道发布的全模态大模型4.0版本

    子曰4.0 – 网易有道发布的全模态大模型4.0版本

    子曰4.0是网易有道发布的全模态大模型4.0版本,同步开源多模态理解模型与TTS语音合成引擎,其中Confucius4-TTS作为业内首个支持14种语言跨语种无口音、且无需参考文本即可完成语音克隆的开...
    AI最新项目# 大模型
    文明旁观者的头像2个月前
    01120
    HyOCR-1.5 – 腾讯混元团队开源的端到端多模态OCR大模型

    HyOCR-1.5 – 腾讯混元团队开源的端到端多模态OCR大模型

    HyOCR-1.5是腾讯混元团队开源的端到端多模态OCR大模型,通过一体化架构实现文字检测与识别的联合优化,仅需10亿参数即可覆盖8类以上文档理解任务,在OmniDocBench v1.6基准测试中以...
    AI最新项目# 大模型
    文明旁观者的头像2个月前
    01090
    PP-OCRv6 – 百度飞桨发布的超轻量级OCR模型系列最新版本

    PP-OCRv6 – 百度飞桨发布的超轻量级OCR模型系列最新版本

    PP-OCRv6是百度飞桨发布的超轻量级OCR(光学字符识别)模型系列最新版本,50种语言统一模型架构与工业级复杂场景适应能力。它通过三阶段流水线(检测-分类-识别)实现高精度、低延迟、小体积的文本识...
    AI最新项目# 大模型
    文明旁观者的头像2个月前
    01090
    MusaCoder – 摩尔线程推出的国产GPU全栈训练的代码大模型

    MusaCoder – 摩尔线程推出的国产GPU全栈训练的代码大模型

    MusaCoder是摩尔线程推出的全球首个基于国产全功能GPU全栈训练的代码大模型,专为自动生成高性能GPU底层算子(CUDA/MUSA原生Kernel代码) 而设计,其完整训练与验证流程均在国产MT...
    AI最新项目# 大模型
    文明旁观者的头像2个月前
    01090
    LingBot-Vision – 灵波科技研发的面向具身智能视觉基础模型

    LingBot-Vision – 灵波科技研发的面向具身智能视觉基础模型

    LingBot-Vision是蚂蚁集团旗下灵波科技研发的全球首个面向具身智能的“空间原生”视觉基础模型,将物体边界结构作为预训练核心目标,使机器人能精准感知物理世界的三维空间关系(如物体边界位置、距离...
    AI最新项目# 大模型
    文明旁观者的头像2个月前
    01080
    Nemotron-Labs-TwoTower – 英伟达开源的扩散语言模型

    Nemotron-Labs-TwoTower – 英伟达开源的扩散语言模型

    Nemotron-Labs-TwoTower是英伟达(NVIDIA)开源的扩散语言模型,通过双塔架构设计将文本生成吞吐量提升2.42倍,同时保留98.7%的原始生成质量,专为解决传统自回归模型在大规模...
    AI最新项目# 大模型
    文明旁观者的头像2个月前
    01080
    ForgeTrain – 面壁智能联合清华等全球首个由AI自主编写

    ForgeTrain – 面壁智能联合清华等全球首个由AI自主编写

    ForgeTrain是由面壁智能联合清华大学及OpenBMB开源社区发布的全球首个完全由AI自主编写、零人类代码介入的生产级大模型预训练框架。 其核心突破在于AI首次独立完成大模型训练基础设施的端到端...
    AI最新项目# 大模型
    文明旁观者的头像2个月前
    01070
    DeepSeek V4 Pro – 深度求索发布的旗舰级开源大语言模型

    DeepSeek V4 Pro – 深度求索发布的旗舰级开源大语言模型

    DeepSeek V4 Pro是深度求索(DeepSeek)发布的旗舰级开源大语言模型,采用1.6万亿参数混合专家(MoE)架构,原生支持100万token超长上下文,在推理能力、Agent任务执行效...
    AI最新项目# 大模型
    文明旁观者的头像2个月前
    01060
    加载更多
    AI深识站
    AI深识站——国内外优质AI工具导航平台,收录AI写作、绘画、办公、音视频等热门工具,配套AI资讯与教程,每日更新,助你高效工作、玩转AI生活!用AI,学AI,从这里开始。Ctrl + D 或 ⌘ + D 添加书签,随时探索AI新世界。

    关于我们广告合作免责声明

    Copyright © 2026 AI深识站 赣ICP备2026009722号-1 
    网址
    网址文章软件
    热门搜索
    元宝豆包DeepSeek千问翻译