AI深识站
  • AI软件
  • AI资讯
  • AI世界漫游指南
    • AI知识探索库
    • AI学习教程
  • AI最新项目
  • 排行榜
      • 未登录
        登录后即可体验更多功能
    • AI软件
    • AI资讯
    • AI世界漫游指南
      • AI知识探索库
      • AI学习教程
    • AI最新项目
    • 排行榜
    未登录
    登录后即可体验更多功能

    大模型

    共 164 篇文章
    排序
    发布更新浏览点赞
    Qwen3.8-Flash – 通义千问发布并开源的新一代多模态大语言模型

    新Qwen3.8-Flash – 通义千问发布并开源的新一代多模态大语言模型

    Qwen3.8-Flash是阿里通义千问团队正式发布并开源的新一代多模态大语言模型,同时也是全新一代千问大模型 Qwen4 架构的技术预览版。该模型采用全新下一代(Next)架构,主模型 Transf...
    AI最新项目# 大模型
    文明旁观者的头像1天前
    0160
    GLM-5.3-Flash – 智谱AI开源的GLM-5系列首个原生多模态模型

    新GLM-5.3-Flash – 智谱AI开源的GLM-5系列首个原生多模态模型

    GLM-5.3-Flash(320B-A18B)是智谱AI正式发布并开源的GLM-5系列首个原生多模态模型。该模型总参数量为3200亿,但每次推理仅激活180亿参数,在Artificial Analy...
    AI最新项目# 大模型
    文明旁观者的头像1天前
    0140
    Ox Alpha – 匿名神秘Ox Alpha AI模型限免上架

    新Ox Alpha – 匿名神秘Ox Alpha AI模型限免上架

    Ox Alpha(模型标识:stealth/ox-alpha)是 2026 年 8 月 20 日悄然现身 OpenRouter 平台的一款匿名前沿大模型。它由一家选择保持匿名的第三方供应商开发运营,O...
    AI最新项目# 大模型
    文明旁观者的头像5天前
    0260
    V4-Flash-Vision-Exp – 上线DeepSeek API平台的多模态视觉理解模型

    新V4-Flash-Vision-Exp – 上线DeepSeek API平台的多模态视觉理解模型

    DeepSeek-V4-Flash-Vision-Exp是深度求索(DeepSeek)于2026年8月21日上线DeepSeek API平台的多模态视觉理解模型,是V4-Flash正式版的视觉能力扩展...
    AI最新项目# 大模型
    文明旁观者的头像7天前
    0370
    SenseNova U1.5 Lite – 商汤开源的轻量级、原生统一多模态大模型

    SenseNova U1.5 Lite – 商汤开源的轻量级、原生统一多模态大模型

    SenseNova U1.5 Lite是商汤科技正式开源的轻量级、原生统一多模态大模型,基于商汤自研的NEO-Unify架构,仅有8B-MoT参数规模。该模型在同一架构中贯通了视觉理解、推理、图像生成...
    AI最新项目# 大模型
    文明旁观者的头像1周前
    0350
    Ornith-1.5 – DeepReinforce发布的开源大模型系列

    Ornith-1.5 – DeepReinforce发布的开源大模型系列

    Ornith-1.5是由知名NLP学者李纪为创立的AI团队DeepReinforce发布的开源大模型系列,是此前Ornith-1.0的全面迭代升级版,专为Agentic编程(智能体编程)任务设计。该系...
    AI最新项目# 大模型
    文明旁观者的头像1周前
    0360
    dots3-note preview – 小红书开源发布的多模态大语言模型

    dots3-note preview – 小红书开源发布的多模态大语言模型

    dots3-note preview 是 小红书(RedNote)dots 模型实验室(Dots Studio)开源发布的多模态大语言模型,采用 Apache 2.0 协议。它是 dots3 系列的首...
    AI最新项目# 大模型
    文明旁观者的头像1周前
    0370
    Qwen3.8-27B – 阿里云通义发布的开源多模态大语言模型

    Qwen3.8-27B – 阿里云通义发布的开源多模态大语言模型

    Qwen3.8-27B 是阿里云通义千问团队发布的开源多模态大语言模型,采用 Apache 2.0 许可证。它是 Qwen3.8 系列中面向本地部署的稠密(Dense)版本,与同期发布的 2.4 万亿...
    AI最新项目# 大模型
    文明旁观者的头像2周前
    0430
    GLM-5.3 – 智谱发布的新一代开源多模态大语言模型

    GLM-5.3 – 智谱发布的新一代开源多模态大语言模型

    GLM-5.3 是智谱AI(Zhipu AI)正式发布的新一代开源多模态大语言模型,作为GLM系列从“通用对话”迈向“原生智能体”的里程碑版本,它首次将工具调用、长程规划与多模态感知深度融入预训练阶段...
    AI最新项目# 大模型
    文明旁观者的头像2周前
    0610
    Grok 4.6 – SpaceXAI发布的最新一代旗舰大语言模型

    Grok 4.6 – SpaceXAI发布的最新一代旗舰大语言模型

    Grok 4.6 是SpaceXAI发布的最新一代旗舰大语言模型。该模型沿用Grok 4.5的1.5万亿参数V9基础架构,基础模型结构不做改动,全部能力提升来自监督微调(SFT)与强化学习(RL)的后...
    AI最新项目# 大模型
    文明旁观者的头像2周前
    0460
    LTX-2.5 – LTX发布的新一代开源视频生成与世界模型

    LTX-2.5 – LTX发布的新一代开源视频生成与世界模型

    LTX-2.5开放世界模型公司LTX发布的新一代开源视频生成与世界模型。该模型以22B参数的扩散Transformer(DiT)作为主生成器,以LTX-2.3为基础进行近乎全面的管道重构,在生成速度...
    AI最新项目# 大模型
    文明旁观者的头像2周前
    0730
    DeepSeek V4 Pro 正式版 – 深度求索V4系列旗舰模型正式版本

    DeepSeek V4 Pro 正式版 – 深度求索V4系列旗舰模型正式版本

    DeepSeek V4 Pro 正式版(版本号 DeepSeek-V4-Pro-0813)是深度求索(DeepSeek)于2026年8月12日深夜无预告上线的V4系列旗舰模型首个正式版本,承接2026...
    AI最新项目# 大模型
    文明旁观者的头像2周前
    0410
    Nemotron-4 – NVIDIA 推出的开源大语言模型家族

    Nemotron-4 – NVIDIA 推出的开源大语言模型家族

    Nemotron-4 是 NVIDIA 推出的开源大语言模型家族,专为合成数据生成、后训练优化及企业级 AI 应用而设计。该系列包含 Mini(4B)、Super(49B)和 Ultra 等多个规格...
    AI最新项目# 大模型
    文明旁观者的头像2周前
    0420
    Ling-3.0-tiny – 蚂蚁百灵开源的轻量级混合推理MoE大语言模型

    Ling-3.0-tiny – 蚂蚁百灵开源的轻量级混合推理MoE大语言模型

    Ling-3.0-tiny 是蚂蚁百灵正式开源的一款轻量级混合推理MoE大语言模型。该模型总参数量为7.9B,但在推理时每个Token仅激活1.3B参数,以极低的计算成本实现了接近主流4B至12B级模...
    AI最新项目# 大模型
    文明旁观者的头像2周前
    0600
    Wan3.0 – 阿里巴巴通义万相团队研发的新一代视频生成大模型

    Wan3.0 – 阿里巴巴通义万相团队研发的新一代视频生成大模型

    Wan3.0(万相3.0)是阿里巴巴通义万相团队研发的新一代视频生成大模型,于2026年8月6日正式开启公测。作为Wan系列的第三代核心版本,它在生成时长、多模态输入、画面真实感和跨帧一致性四大维度实...
    AI最新项目# 大模型
    文明旁观者的头像3周前
    02310
    Alpamayo 2 Super – 英伟达开源视觉-语言-动作推理模型

    Alpamayo 2 Super – 英伟达开源视觉-语言-动作推理模型

    Alpamayo 2 Super 是英伟达(NVIDIA)发布的一款320亿参数开放视觉-语言-动作推理模型(Reasoning VLA)。它由英伟达创始人兼CEO黄仁勋亲自揭幕,是Alpamayo系...
    AI最新项目# 大模型
    文明旁观者的头像3周前
    0490
    LFM2.5-2.6B – Liquid AI发布的一款开源端侧智能体模型

    LFM2.5-2.6B – Liquid AI发布的一款开源端侧智能体模型

    LFM2.5-2.6B是由人工智能初创企业Liquid AI于2026年8月5日正式发布的一款开源端侧智能体模型。该模型隶属于 Liquid AI 的 Liquid Foundation Models...
    AI最新项目# 大模型
    文明旁观者的头像3周前
    0580
    SeedRealtime – 字节Seed团队发布的原生音视频全双工大模型

    SeedRealtime – 字节Seed团队发布的原生音视频全双工大模型

    SeedRealtime是字节跳动Seed团队于2026年8月5日正式发布的原生音视频全双工大模型。该模型采用统一端到端架构,将音频、视频与文本原生融合,能够在连续多模态信息流上进行实时交互,官方将其...
    AI最新项目# 大模型
    文明旁观者的头像3周前
    01000
    JoyAI-Video-Edit – 京东开源自研的实时流式视频编辑模型

    JoyAI-Video-Edit – 京东开源自研的实时流式视频编辑模型

    JoyAI-Video-Edit是京东探索研究院于2026年8月5日正式开源自研的实时流式视频编辑模型。该模型于2026年7月18日在世界人工智能大会(WAIC)上首次亮相,8月5日在 Hugging...
    AI最新项目# 大模型
    文明旁观者的头像3周前
    0960
    MAGI-2 Preview – Sand.ai发布并开源的统一音视频生成模型

    MAGI-2 Preview – Sand.ai发布并开源的统一音视频生成模型

    MAGI-2 Preview是北京AI视频生成创企Sand.ai(清华系团队)正式发布并开源的统一音视频生成模型。该模型总参数约114B(千亿级),采用MoE(混合专家)架构,单次前向计算仅激活约6B...
    AI最新项目# 大模型
    文明旁观者的头像3周前
    0970
    Shieldstral – Mistral AI发布的开源多模态内容安全审核模型

    Shieldstral – Mistral AI发布的开源多模态内容安全审核模型

    Shieldstral是Mistral AI发布的开源多模态内容安全审核模型(Shieldstral 1.0-3B)。这是一款仅30亿参数的多模态内容安全分类器,已在 Hugging Face 以Ap...
    AI最新项目# 大模型
    文明旁观者的头像3周前
    0460
    Hy ASR 3.0 Preview – 腾讯混元发布的新一代语音识别模型

    Hy ASR 3.0 Preview – 腾讯混元发布的新一代语音识别模型

    Hy ASR 3.0 Preview是腾讯混元发布的新一代语音识别(ASR)模型。它基于腾讯最新一代大语言模型 Hy3的语言理解能力,将高精度语音识别与深度语义理解深度融合,标志着语音识别从传统的"逐...
    AI最新项目# 大模型
    文明旁观者的头像3周前
    0470
    MAI Realtime – 微软正在测试的首款原生实时语音交互模型

    MAI Realtime – 微软正在测试的首款原生实时语音交互模型

    MAI Realtime是微软(Microsoft AI)正在测试的首款原生实时语音交互模型,于2026年8月初被媒体曝光。它属于微软自研MAI(Microsoft AI)系列模型家族中的语音交互产品...
    AI最新项目# 大模型
    文明旁观者的头像3周前
    0520
    SenseNova U1.5-Lite-Preview – 轻量级统一多模态模型预览版本

    SenseNova U1.5-Lite-Preview – 轻量级统一多模态模型预览版本

    SenseNova U1.5-Lite-Preview是商汤科技正式面向社区开源发布的轻量级统一多模态模型预览版本。它并非简单的模型规模升级,而是基于今年4月发布的SenseNova U1进行的一次系...
    AI最新项目# 大模型
    文明旁观者的头像4周前
    0510
    deepseek v4 flash – 深度求索发布的轻量化高效版大模型

    deepseek v4 flash – 深度求索发布的轻量化高效版大模型

    DeepSeek-V4-Flash是深度求索发布的轻量化高效版大模型,作为V4系列的“快速模式”版本,专为高频日常任务设计,在保持接近Pro版推理能力的同时,将响应速度和调用成本压缩至极致。以1/10...
    AI最新项目# 大模型
    文明旁观者的头像4周前
    01920
    Qwen3.8-Max – 阿里正式发布的2.4万亿参数旗舰级大语言模型

    Qwen3.8-Max – 阿里正式发布的2.4万亿参数旗舰级大语言模型

    Qwen3.8-Max是阿里巴巴于2026年8月3日正式发布的2.4万亿参数旗舰级大语言模型,能独立完成需数天周期的完整工程和跨应用全流程办公任务,实现从“工具辅助”到“自主交付成果”的能力跃迁。该模...
    AI最新项目# 大模型
    文明旁观者的头像4周前
    0780
    DeepSeek-V4-Flash正式版 – DeepSeek推出的API公测模型

    DeepSeek-V4-Flash正式版 – DeepSeek推出的API公测模型

    DeepSeek-V4-Flash正式版是DeepSeek推出的API公测模型,作为V4系列的经济高效版本,在保持原有架构(2840亿总参数/130亿激活参数)不变的前提下,仅通过后训练优化,显著提升...
    AI最新项目# 大模型
    文明旁观者的头像4周前
    01840
    FeyNoBg – Feyn团队发布的开源背景移除模型

    FeyNoBg – Feyn团队发布的开源背景移除模型

    FeyNoBg是Feyn团队发布的开源背景移除(抠图)模型,基于BiRefNet架构深度优化,参数量263M,在八大主流基准测试中四项登顶SOTA(State-of-the-Art),并配套开源NoB...
    AI最新项目# 大模型
    文明旁观者的头像4周前
    0690
    Qwen-Audio-3.0-ASR-Flash – 阿里巴巴发布的专业级语音识别大模型

    Qwen-Audio-3.0-ASR-Flash – 阿里巴巴发布的专业级语音识别大模型

    Qwen-Audio-3.0-ASR-Flash是阿里巴巴发布的专业级语音识别大模型,显著提升行业术语识别准确率(医疗场景达95.36%),并具备上下文一致性优化与语音润色能力,可直接输出结构化文本...
    AI最新项目# 大模型
    文明旁观者的头像4周前
    0470
    Qwen-Audio-3.0-ASR-Filetrans – 阿里巴巴推出的非实时语音识别模型

    Qwen-Audio-3.0-ASR-Filetrans – 阿里巴巴推出的非实时语音识别模型

    Qwen-Audio-3.0-ASR-Filetrans是阿里巴巴推出的非实时语音识别模型,专为长音频文件离线转写设计,高精度处理12小时以内大体积音频(单文件≤2GB),支持字级时间戳与上下文增强...
    AI最新项目# 大模型
    文明旁观者的头像4周前
    0610
    加载更多
    AI深识站
    AI深识站——国内外优质AI工具导航平台,收录AI写作、绘画、办公、音视频等热门工具,配套AI资讯与教程,每日更新,助你高效工作、玩转AI生活!用AI,学AI,从这里开始。Ctrl + D 或 ⌘ + D 添加书签,随时探索AI新世界。

    关于我们广告合作免责声明

    Copyright © 2026 AI深识站 赣ICP备2026009722号-1 
    网址
    网址文章软件
    热门搜索
    元宝豆包DeepSeek千问翻译