AI深识站
  • AI软件
  • AI资讯
  • AI世界漫游指南
    • AI知识探索库
    • AI学习教程
  • AI最新项目
  • 排行榜
      • 未登录
        登录后即可体验更多功能
    • AI软件
    • AI资讯
    • AI世界漫游指南
      • AI知识探索库
      • AI学习教程
    • AI最新项目
    • 排行榜
    未登录
    登录后即可体验更多功能

    大模型

    共 164 篇文章
    排序
    发布更新浏览点赞
    HappyOyster 1.0 – 阿里发布的可实时交互的开放式世界模型

    HappyOyster 1.0 – 阿里发布的可实时交互的开放式世界模型

    HappyOyster 1.0(快乐生蚝1.0)是阿里巴巴ATH创新事业部发布的可实时交互的开放式世界模型产品,将AI从“生成静态内容”升级为“模拟可操控的动态数字世界”。用户仅需一句话或一张图即可生...
    AI最新项目# 大模型
    文明旁观者的头像1个月前
    01050
    Qwen3.8-Max-Preview – 千问推出的2.4万亿参数旗舰大模型预览版

    Qwen3.8-Max-Preview – 千问推出的2.4万亿参数旗舰大模型预览版

    Qwen3.8-Max-Preview是阿里通义千问系列推出的2.4万亿参数旗舰大模型预览版,定位为当前综合能力仅次于Fable 5的顶级开源模型之一。通过超大规模参数与创新架构设计,显著提升复杂任务...
    AI最新项目# 大模型
    文明旁观者的头像1个月前
    0730
    MuScriptor – Kyutai与Mirelo联合开发多乐器自动音乐转录模型

    MuScriptor – Kyutai与Mirelo联合开发多乐器自动音乐转录模型

    MuScriptor 是由 Kyutai 与 Mirelo 联合开发、开源开放权重的多乐器自动音乐转录(AMT)模型,核心能力是将完整混音音频自动拆解、转译为带乐器区分的标准 MIDI 符号乐谱,是首...
    AI最新项目# 大模型
    文明旁观者的头像1个月前
    0640
    Nemotron-Labs-Diffusion – 英伟达推出的统一架构的三模式大语言模型

    Nemotron-Labs-Diffusion – 英伟达推出的统一架构的三模式大语言模型

    Nemotron-Labs-Diffusion是英伟达推出的统一架构的三模式大语言模型,通过创新性地将自回归、扩散和自猜测三种解码模式集成于单一模型,在保持生成质量的同时显著提升推理吞吐量。无需额外小...
    AI最新项目# 大模型
    文明旁观者的头像1个月前
    01220
    SenseNova U1 Pro – 商汤科技发布的原生多模态智能体基座模型

    SenseNova U1 Pro – 商汤科技发布的原生多模态智能体基座模型

    SenseNova U1 Pro是商汤科技在世界人工智能大会上发布的旗舰级原生多模态智能体基座模型,推动行业从“单点式内容生成”迈向“系统级内容交付”新时代。通过原生统一架构实现理解、生成与行动的深度...
    AI最新项目# 大模型
    文明旁观者的头像1个月前
    01260
    Nemotron 3 Embed – NVIDIA推出的开源嵌入向量模型系列

    Nemotron 3 Embed – NVIDIA推出的开源嵌入向量模型系列

    Nemotron 3 Embed是NVIDIA推出的开源嵌入向量模型系列,专为检索增强生成(RAG)、智能体记忆及多语言检索场景设计。其8B参数版本在RTEB检索基准测试中以78.46分登顶榜首,成为...
    AI最新项目# 大模型
    文明旁观者的头像1个月前
    01120
    Wan-Streamer v0.2 – 阿里通义发布的端到端全模态实时交互模型

    Wan-Streamer v0.2 – 阿里通义发布的端到端全模态实时交互模型

    Wan-Streamer v0.2是阿里通义实验室发布的端到端全模态实时交互模型,将音视频感知、语言理解与内容生成统一至单个Transformer架构,实现550毫秒级端到端响应延迟(含网络传输)。其...
    AI最新项目# 大模型
    文明旁观者的头像1个月前
    01150
    WITT – 文远知行发布的聚焦物理世界认知的AI基础大模型

    WITT – 文远知行发布的聚焦物理世界认知的AI基础大模型

    文远知行发布的 WITT(WeRide World Intelligence Toward Truth) 是全球首个聚焦物理世界认知的AI基础大模型,目标是将真实道路数据转化为可验证、可追溯的物理事实...
    AI最新项目# 大模型
    文明旁观者的头像1个月前
    01020
    Hy-Embodied-VLM-1.0 – 腾讯发布的第二代具身视觉语言模型

    Hy-Embodied-VLM-1.0 – 腾讯发布的第二代具身视觉语言模型

    Hy-Embodied-VLM-1.0是腾讯Robotics X实验室、福田实验室与腾讯混元团队发布的第二代具身视觉语言模型(VLM)基座模型,专为解决通用大模型在物理世界交互中的感知短板而设计。目标...
    AI最新项目# 大模型
    文明旁观者的头像1个月前
    0690
    Xiaomi-Robotics-1 – 小米公司推出的具身智能基座模型

    Xiaomi-Robotics-1 – 小米公司推出的具身智能基座模型

    Xiaomi-Robotics-1是小米公司推出的具身智能基座模型,专为真实环境中的移动操作机器人设计,基于10万小时真实操作数据预训练、支持自然语言指令直接控制、具备跨场景泛化能力,可显著降低机器人...
    AI最新项目# 大模型
    文明旁观者的头像1个月前
    0740
    水风光一体化智慧运营大模型 – 中国首套千万千瓦级全链路智能决策系统

    水风光一体化智慧运营大模型 – 中国首套千万千瓦级全链路智能决策系统

    水风光一体化智慧运营大模型是我国首个面向千万千瓦级水风光一体化清洁能源基地的全链路智能化决策系统,由国投集团雅砻江流域水电开发有限公司牵头研发,打通气象、水文、风光资源预测与电力运行决策的全流程闭环...
    AI最新项目# 大模型
    文明旁观者的头像1个月前
    0760
    Inkling – 前OpenAI首席技术官发布的首款开放权重基础大模型

    Inkling – 前OpenAI首席技术官发布的首款开放权重基础大模型

    Inkling是由前OpenAI首席技术官米拉·穆拉蒂(Mira Murati)创立的思维机器实验室(Thinking Machines Lab, TML发布的首款开放权重基础大模型。不追求极限性能...
    AI最新项目# 大模型
    文明旁观者的头像1个月前
    0590
    Xmax X2.0 – Xmax AI发布的支持实时交互的端侧视频生成模型

    Xmax X2.0 – Xmax AI发布的支持实时交互的端侧视频生成模型

    Xmax X2.0是Xmax AI发布的全球首个支持实时交互的端侧视频生成模型,彻底突破传统AI视频“输入-等待-输出”的固定流程,实现“边生成边交互”的即时操作体验。将视频从“观看内容”转化为“可实...
    AI最新项目# 大模型
    文明旁观者的头像1个月前
    01260
    MOSS-VL-Realtime – OpenMOSS团队开源视频理解模型

    MOSS-VL-Realtime – OpenMOSS团队开源视频理解模型

    MOSS-VL-Realtime是由复旦大学OpenMOSS团队开发的开源实时流式视频理解模型,专为处理动态视频流设计,突破传统模型需等待完整视频输入的限制,实现边接收画面边生成回答、信息不足时主动保...
    AI最新项目# 大模型
    文明旁观者的头像1个月前
    01390
    Xiaomi-Robotics-U0 – 小米发布的多模态自回归具身生成基础模型

    Xiaomi-Robotics-U0 – 小米发布的多模态自回归具身生成基础模型

    Xiaomi-Robotics-U0是小米发布的380亿参数多模态自回归具身生成基础模型,专为解决机器人训练中的数据稀缺问题而设计。它首次将具身场景生成、轨迹迁移、交互视频生成与通用文生图能力统一到单...
    AI最新项目# 大模型
    文明旁观者的头像1个月前
    01200
    Qwen-Audio-3.0-Realtime – 阿里巴巴发布的实时语音交互对话模型

    Qwen-Audio-3.0-Realtime – 阿里巴巴发布的实时语音交互对话模型

    Qwen-Audio-3.0-Realtime是阿里巴巴于2026年7月15日发布的实时语音交互对话模型,通过同步提升推理能力、工具调用、情感表达与双工交互四项核心能力,在毫秒级响应速度下仍保持高精度...
    AI最新项目# 大模型
    文明旁观者的头像1个月前
    0920
    4bit量化版Hy3模型 – 企业级AI降本指南,双卡替代集群

    4bit量化版Hy3模型 – 企业级AI降本指南,双卡替代集群

    腾讯混元4bit量化版Hy3模型是针对295B参数规模的混合专家(MoE)大模型进行4比特深度压缩的技术方案,将原始598GB的BF16权重量化至169.9GiB,仅需双张96GB显存显卡即可部署,在...
    AI最新项目# 大模型
    文明旁观者的头像1个月前
    0700
    混元1bit – 腾讯混元Hy3旗舰大模型的1比特极致量化版本

    混元1bit – 腾讯混元Hy3旗舰大模型的1比特极致量化版本

    1bit是腾讯混元Hy3旗舰大模型的1比特极致量化版本(IQ1_M格式),通过梯度量化技术将2950亿参数模型的权重体积从598GB压缩至85.5GiB(缩小6.7倍),实现单张96GB显存显卡即可本...
    AI最新项目# 大模型
    文明旁观者的头像1个月前
    0910
    Wan-Dancer – 阿里通义开源的音乐驱动人像舞蹈视频生成模型

    Wan-Dancer – 阿里通义开源的音乐驱动人像舞蹈视频生成模型

    Wan-Dancer是阿里巴巴通义实验室开源的音乐驱动人像舞蹈视频生成模型,能够生成分钟级、高清晰度且节奏同步的舞蹈视频。它采用分层框架,将生成过程解耦为全局关键帧规划与局部时序优化两个阶段,有效解决...
    AI最新项目# 大模型
    文明旁观者的头像1个月前
    0990
    干细胞AI模型“归元” – 面向干细胞重编程的AI预测模型

    干细胞AI模型“归元” – 面向干细胞重编程的AI预测模型

    干细胞AI模型“归元”是由西湖大学与阿里巴巴达摩院联合开发的面向干细胞重编程的可解释性AI预测模型,通过算法从近400万种小分子药物与生长因子组合中精准筛选最优方案,实现对细胞命运的定向调控,解决了传...
    AI最新项目# 大模型
    文明旁观者的头像1个月前
    01200
    HyOCR-1.5 – 腾讯混元团队开源的端到端多模态OCR大模型

    HyOCR-1.5 – 腾讯混元团队开源的端到端多模态OCR大模型

    HyOCR-1.5是腾讯混元团队开源的端到端多模态OCR大模型,通过一体化架构实现文字检测与识别的联合优化,仅需10亿参数即可覆盖8类以上文档理解任务,在OmniDocBench v1.6基准测试中以...
    AI最新项目# 大模型
    文明旁观者的头像2个月前
    01080
    Muse Spark 1.1 – Meta发布的多模态推理模型

    Muse Spark 1.1 – Meta发布的多模态推理模型

    Muse Spark 1.1是Meta发布的多模态推理模型,专为AI智能体任务设计,通过主-子智能体协作架构实现复杂任务的自动化规划与执行,支持最高100万token上下文长度,在工具调用、跨应用操作...
    AI最新项目# 大模型
    文明旁观者的头像2个月前
    0660
    Step Edge – 阶跃星辰发布的端侧模型全家桶

    Step Edge – 阶跃星辰发布的端侧模型全家桶

    Step Edge是阶跃星辰发布的端侧模型全家桶,包含基础模型、Audio模型、GUI模型和Gen模型四款垂直领域专用模型,目标是让AI智能体(Agent)在手机、汽车等终端设备上实现本地化实时响应与...
    AI最新项目# 大模型
    文明旁观者的头像2个月前
    0640
    Agnes-2.5-Flash – Agnes AI推出的全新文本大模型

    Agnes-2.5-Flash – Agnes AI推出的全新文本大模型

    Agnes-2.5-Flash是Agnes AI推出的全新高性能文本大模型,作为Agnes-2.0-Flash的升级版本,专为开发者与AI Agent工作流设计,在代码理解、工程修复、多步骤任务执行及...
    AI最新项目# 大模型
    文明旁观者的头像2个月前
    01370
    SenseNova-Vision – 商汤科技发布并全面开源的统一视觉大模型

    SenseNova-Vision – 商汤科技发布并全面开源的统一视觉大模型

    SenseNova-Vision是商汤科技发布并全面开源的统一视觉大模型,将视觉能力原生融入大模型体系,首次实现目标检测、图像分割、深度预测、3D重建等经典视觉任务的单模型统一处理,彻底摒弃传统多模型...
    AI最新项目# 大模型
    文明旁观者的头像2个月前
    0830
    Robostral Navigate – Mistral AI发布的具身导航大模型

    Robostral Navigate – Mistral AI发布的具身导航大模型

    Robostral Navigate是法国AI公司Mistral AI发布的具身导航大模型,参数量仅80亿(8B)。仅依赖单个普通RGB摄像头,即可在复杂环境中实现高精度自主导航,无需深度传感器或激光...
    AI最新项目# 大模型
    文明旁观者的头像2个月前
    0850
    Fun-ASR-Realtime – 通义升级发布的流式实时语音识别大模型

    Fun-ASR-Realtime – 通义升级发布的流式实时语音识别大模型

    Fun-ASR-Realtime是阿里云通义实验室升级发布的流式实时语音识别大模型,首字延迟控制在百毫秒级别、识别准确率接近离线模型,同时支持16种方言与30种语言的无缝识别。该模型专为直播字幕、会议...
    AI最新项目# 大模型
    文明旁观者的头像2个月前
    01020
    Vidu S1 – 生数科技发布的实时交互的视频生成大模型

    Vidu S1 – 生数科技发布的实时交互的视频生成大模型

    Vidu S1是生数科技发布的全球首个支持实时交互的视频生成大模型,将视频生成从传统的“单向离线输出”升级为“双向实时对话”,用户可通过语音指令动态控制视频内容走向,实现540P分辨率、25FPS帧率...
    AI最新项目# 大模型
    文明旁观者的头像2个月前
    01120
    地层学AI大模型 -中国科学家发布首个地层学AI大模型

    地层学AI大模型 -中国科学家发布首个地层学AI大模型

    地层学AI大模型是中国科学家于2026年7月3日在全球首次发布的、专门针对地层学领域的专业人工智能模型,通过统一时间标尺整合地球46亿年演化历史的地质记录,构建全球共享的地层数据库,从而为生命起源、资...
    AI最新项目# 大模型
    文明旁观者的头像2个月前
    01420
    RedKnot – 小红书研发并开源的长上下文大模型推理引擎

    RedKnot – 小红书研发并开源的长上下文大模型推理引擎

    RedKnot是小红书技术团队研发并开源的长上下文大模型推理引擎,通过按注意力头维度优化KV缓存管理,在显著提升推理速度的同时保持高精度,尤其适用于超长文本处理场景。将传统按token粒度的缓存机制重...
    AI最新项目# 大模型
    文明旁观者的头像2个月前
    0950
    加载更多
    AI深识站
    AI深识站——国内外优质AI工具导航平台,收录AI写作、绘画、办公、音视频等热门工具,配套AI资讯与教程,每日更新,助你高效工作、玩转AI生活!用AI,学AI,从这里开始。Ctrl + D 或 ⌘ + D 添加书签,随时探索AI新世界。

    关于我们广告合作免责声明

    Copyright © 2026 AI深识站 赣ICP备2026009722号-1 
    网址
    网址文章软件
    热门搜索
    元宝豆包DeepSeek千问翻译