AI深识站
  • AI软件
  • AI资讯
  • AI世界漫游指南
    • AI知识探索库
    • AI学习教程
  • AI最新项目
  • 排行榜
      • 未登录
        登录后即可体验更多功能
    • AI软件
    • AI资讯
    • AI世界漫游指南
      • AI知识探索库
      • AI学习教程
    • AI最新项目
    • 排行榜
    未登录
    登录后即可体验更多功能

    大模型

    共 164 篇文章
    排序
    发布更新浏览点赞
    Qwen3.8-Max-Preview – 千问推出的2.4万亿参数旗舰大模型预览版

    Qwen3.8-Max-Preview – 千问推出的2.4万亿参数旗舰大模型预览版

    Qwen3.8-Max-Preview是阿里通义千问系列推出的2.4万亿参数旗舰大模型预览版,定位为当前综合能力仅次于Fable 5的顶级开源模型之一。通过超大规模参数与创新架构设计,显著提升复杂任务...
    AI最新项目# 大模型
    文明旁观者的头像1个月前
    0730
    MuScriptor – Kyutai与Mirelo联合开发多乐器自动音乐转录模型

    MuScriptor – Kyutai与Mirelo联合开发多乐器自动音乐转录模型

    MuScriptor 是由 Kyutai 与 Mirelo 联合开发、开源开放权重的多乐器自动音乐转录(AMT)模型,核心能力是将完整混音音频自动拆解、转译为带乐器区分的标准 MIDI 符号乐谱,是首...
    AI最新项目# 大模型
    文明旁观者的头像1个月前
    0640
    SenseNova U1 Pro – 商汤科技发布的原生多模态智能体基座模型

    SenseNova U1 Pro – 商汤科技发布的原生多模态智能体基座模型

    SenseNova U1 Pro是商汤科技在世界人工智能大会上发布的旗舰级原生多模态智能体基座模型,推动行业从“单点式内容生成”迈向“系统级内容交付”新时代。通过原生统一架构实现理解、生成与行动的深度...
    AI最新项目# 大模型
    文明旁观者的头像1个月前
    01260
    Nemotron 3 Embed – NVIDIA推出的开源嵌入向量模型系列

    Nemotron 3 Embed – NVIDIA推出的开源嵌入向量模型系列

    Nemotron 3 Embed是NVIDIA推出的开源嵌入向量模型系列,专为检索增强生成(RAG)、智能体记忆及多语言检索场景设计。其8B参数版本在RTEB检索基准测试中以78.46分登顶榜首,成为...
    AI最新项目# 大模型
    文明旁观者的头像1个月前
    01120
    Wan-Streamer v0.2 – 阿里通义发布的端到端全模态实时交互模型

    Wan-Streamer v0.2 – 阿里通义发布的端到端全模态实时交互模型

    Wan-Streamer v0.2是阿里通义实验室发布的端到端全模态实时交互模型,将音视频感知、语言理解与内容生成统一至单个Transformer架构,实现550毫秒级端到端响应延迟(含网络传输)。其...
    AI最新项目# 大模型
    文明旁观者的头像1个月前
    01150
    WITT – 文远知行发布的聚焦物理世界认知的AI基础大模型

    WITT – 文远知行发布的聚焦物理世界认知的AI基础大模型

    文远知行发布的 WITT(WeRide World Intelligence Toward Truth) 是全球首个聚焦物理世界认知的AI基础大模型,目标是将真实道路数据转化为可验证、可追溯的物理事实...
    AI最新项目# 大模型
    文明旁观者的头像1个月前
    01020
    Hy-Embodied-VLM-1.0 – 腾讯发布的第二代具身视觉语言模型

    Hy-Embodied-VLM-1.0 – 腾讯发布的第二代具身视觉语言模型

    Hy-Embodied-VLM-1.0是腾讯Robotics X实验室、福田实验室与腾讯混元团队发布的第二代具身视觉语言模型(VLM)基座模型,专为解决通用大模型在物理世界交互中的感知短板而设计。目标...
    AI最新项目# 大模型
    文明旁观者的头像1个月前
    0690
    Xiaomi-Robotics-1 – 小米公司推出的具身智能基座模型

    Xiaomi-Robotics-1 – 小米公司推出的具身智能基座模型

    Xiaomi-Robotics-1是小米公司推出的具身智能基座模型,专为真实环境中的移动操作机器人设计,基于10万小时真实操作数据预训练、支持自然语言指令直接控制、具备跨场景泛化能力,可显著降低机器人...
    AI最新项目# 大模型
    文明旁观者的头像1个月前
    0740
    Inkling – 前OpenAI首席技术官发布的首款开放权重基础大模型

    Inkling – 前OpenAI首席技术官发布的首款开放权重基础大模型

    Inkling是由前OpenAI首席技术官米拉·穆拉蒂(Mira Murati)创立的思维机器实验室(Thinking Machines Lab, TML发布的首款开放权重基础大模型。不追求极限性能...
    AI最新项目# 大模型
    文明旁观者的头像1个月前
    0590
    水风光一体化智慧运营大模型 – 中国首套千万千瓦级全链路智能决策系统

    水风光一体化智慧运营大模型 – 中国首套千万千瓦级全链路智能决策系统

    水风光一体化智慧运营大模型是我国首个面向千万千瓦级水风光一体化清洁能源基地的全链路智能化决策系统,由国投集团雅砻江流域水电开发有限公司牵头研发,打通气象、水文、风光资源预测与电力运行决策的全流程闭环...
    AI最新项目# 大模型
    文明旁观者的头像1个月前
    0760
    Xmax X2.0 – Xmax AI发布的支持实时交互的端侧视频生成模型

    Xmax X2.0 – Xmax AI发布的支持实时交互的端侧视频生成模型

    Xmax X2.0是Xmax AI发布的全球首个支持实时交互的端侧视频生成模型,彻底突破传统AI视频“输入-等待-输出”的固定流程,实现“边生成边交互”的即时操作体验。将视频从“观看内容”转化为“可实...
    AI最新项目# 大模型
    文明旁观者的头像1个月前
    01260
    MOSS-VL-Realtime – OpenMOSS团队开源视频理解模型

    MOSS-VL-Realtime – OpenMOSS团队开源视频理解模型

    MOSS-VL-Realtime是由复旦大学OpenMOSS团队开发的开源实时流式视频理解模型,专为处理动态视频流设计,突破传统模型需等待完整视频输入的限制,实现边接收画面边生成回答、信息不足时主动保...
    AI最新项目# 大模型
    文明旁观者的头像1个月前
    01390
    Xiaomi-Robotics-U0 – 小米发布的多模态自回归具身生成基础模型

    Xiaomi-Robotics-U0 – 小米发布的多模态自回归具身生成基础模型

    Xiaomi-Robotics-U0是小米发布的380亿参数多模态自回归具身生成基础模型,专为解决机器人训练中的数据稀缺问题而设计。它首次将具身场景生成、轨迹迁移、交互视频生成与通用文生图能力统一到单...
    AI最新项目# 大模型
    文明旁观者的头像1个月前
    01200
    Qwen-Audio-3.0-Realtime – 阿里巴巴发布的实时语音交互对话模型

    Qwen-Audio-3.0-Realtime – 阿里巴巴发布的实时语音交互对话模型

    Qwen-Audio-3.0-Realtime是阿里巴巴于2026年7月15日发布的实时语音交互对话模型,通过同步提升推理能力、工具调用、情感表达与双工交互四项核心能力,在毫秒级响应速度下仍保持高精度...
    AI最新项目# 大模型
    文明旁观者的头像1个月前
    0920
    4bit量化版Hy3模型 – 企业级AI降本指南,双卡替代集群

    4bit量化版Hy3模型 – 企业级AI降本指南,双卡替代集群

    腾讯混元4bit量化版Hy3模型是针对295B参数规模的混合专家(MoE)大模型进行4比特深度压缩的技术方案,将原始598GB的BF16权重量化至169.9GiB,仅需双张96GB显存显卡即可部署,在...
    AI最新项目# 大模型
    文明旁观者的头像1个月前
    0700
    混元1bit – 腾讯混元Hy3旗舰大模型的1比特极致量化版本

    混元1bit – 腾讯混元Hy3旗舰大模型的1比特极致量化版本

    1bit是腾讯混元Hy3旗舰大模型的1比特极致量化版本(IQ1_M格式),通过梯度量化技术将2950亿参数模型的权重体积从598GB压缩至85.5GiB(缩小6.7倍),实现单张96GB显存显卡即可本...
    AI最新项目# 大模型
    文明旁观者的头像1个月前
    0910
    Wan-Dancer – 阿里通义开源的音乐驱动人像舞蹈视频生成模型

    Wan-Dancer – 阿里通义开源的音乐驱动人像舞蹈视频生成模型

    Wan-Dancer是阿里巴巴通义实验室开源的音乐驱动人像舞蹈视频生成模型,能够生成分钟级、高清晰度且节奏同步的舞蹈视频。它采用分层框架,将生成过程解耦为全局关键帧规划与局部时序优化两个阶段,有效解决...
    AI最新项目# 大模型
    文明旁观者的头像1个月前
    0990
    干细胞AI模型“归元” – 面向干细胞重编程的AI预测模型

    干细胞AI模型“归元” – 面向干细胞重编程的AI预测模型

    干细胞AI模型“归元”是由西湖大学与阿里巴巴达摩院联合开发的面向干细胞重编程的可解释性AI预测模型,通过算法从近400万种小分子药物与生长因子组合中精准筛选最优方案,实现对细胞命运的定向调控,解决了传...
    AI最新项目# 大模型
    文明旁观者的头像1个月前
    01200
    HyOCR-1.5 – 腾讯混元团队开源的端到端多模态OCR大模型

    HyOCR-1.5 – 腾讯混元团队开源的端到端多模态OCR大模型

    HyOCR-1.5是腾讯混元团队开源的端到端多模态OCR大模型,通过一体化架构实现文字检测与识别的联合优化,仅需10亿参数即可覆盖8类以上文档理解任务,在OmniDocBench v1.6基准测试中以...
    AI最新项目# 大模型
    文明旁观者的头像2个月前
    01090
    Agnes-2.5-Flash – Agnes AI推出的全新文本大模型

    Agnes-2.5-Flash – Agnes AI推出的全新文本大模型

    Agnes-2.5-Flash是Agnes AI推出的全新高性能文本大模型,作为Agnes-2.0-Flash的升级版本,专为开发者与AI Agent工作流设计,在代码理解、工程修复、多步骤任务执行及...
    AI最新项目# 大模型
    文明旁观者的头像2个月前
    01380
    SenseNova-Vision – 商汤科技发布并全面开源的统一视觉大模型

    SenseNova-Vision – 商汤科技发布并全面开源的统一视觉大模型

    SenseNova-Vision是商汤科技发布并全面开源的统一视觉大模型,将视觉能力原生融入大模型体系,首次实现目标检测、图像分割、深度预测、3D重建等经典视觉任务的单模型统一处理,彻底摒弃传统多模型...
    AI最新项目# 大模型
    文明旁观者的头像2个月前
    0840
    Step Edge – 阶跃星辰发布的端侧模型全家桶

    Step Edge – 阶跃星辰发布的端侧模型全家桶

    Step Edge是阶跃星辰发布的端侧模型全家桶,包含基础模型、Audio模型、GUI模型和Gen模型四款垂直领域专用模型,目标是让AI智能体(Agent)在手机、汽车等终端设备上实现本地化实时响应与...
    AI最新项目# 大模型
    文明旁观者的头像2个月前
    0650
    Muse Spark 1.1 – Meta发布的多模态推理模型

    Muse Spark 1.1 – Meta发布的多模态推理模型

    Muse Spark 1.1是Meta发布的多模态推理模型,专为AI智能体任务设计,通过主-子智能体协作架构实现复杂任务的自动化规划与执行,支持最高100万token上下文长度,在工具调用、跨应用操作...
    AI最新项目# 大模型
    文明旁观者的头像2个月前
    0670
    Kimi K2.7 Code高速版 – 月之暗面在基础上推出的加速推理版本

    Kimi K2.7 Code高速版 – 月之暗面在基础上推出的加速推理版本

    Kimi K2.7 Code高速版是月之暗面在标准版K2.7 Code编程模型基础上推出的加速推理版本,与标准版使用完全相同的模型架构,但通过工程优化将输出速度提升至标准版的5-6倍,专为需要实时响应...
    AI最新项目# 大模型
    文明旁观者的头像2个月前
    0630
    KAT-Coder-Pro V2.5 – 快手发布的旗舰级Agentic Coding模型

    KAT-Coder-Pro V2.5 – 快手发布的旗舰级Agentic Coding模型

    KAT-Coder-Pro V2.5是快手KwaiKAT团队发布的旗舰级Agentic Coding模型,首次实现国产AI从单点代码补全到端到端跑通完整软件工程任务的突破。该模型通过大规模智能体强化学...
    AI最新项目# 大模型
    文明旁观者的头像2个月前
    01160
    LingBot-Video – 蚂蚁开源的面向具身智能视频生成基础模型

    LingBot-Video – 蚂蚁开源的面向具身智能视频生成基础模型

    LingBot-Video是蚂蚁灵波科技开源的面向具身智能(Embodied AI)的视频生成基础模型,采用Mixture-of-Experts(MoE)架构设计,目标是解决传统视频生成模型在物理规律...
    AI最新项目# 大模型
    文明旁观者的头像2个月前
    01200
    Robostral Navigate – Mistral AI发布的具身导航大模型

    Robostral Navigate – Mistral AI发布的具身导航大模型

    Robostral Navigate是法国AI公司Mistral AI发布的具身导航大模型,参数量仅80亿(8B)。仅依赖单个普通RGB摄像头,即可在复杂环境中实现高精度自主导航,无需深度传感器或激光...
    AI最新项目# 大模型
    文明旁观者的头像2个月前
    0850
    LingBot-VLA 2.0 – 蚂蚁灵波科技开源的新一代具身智能基座模型

    LingBot-VLA 2.0 – 蚂蚁灵波科技开源的新一代具身智能基座模型

    LingBot-VLA 2.0是蚂蚁灵波科技开源的新一代具身智能基座模型,作为机器人领域的“通用大脑”,通过6万小时高质量真实物理数据训练,首次实现对20多种不同构型机器人的统一控制能力,显著提升了双...
    AI最新项目# 大模型
    文明旁观者的头像2个月前
    0780
    Nemotron-Labs-Diffusion – 英伟达推出的统一架构的三模式大语言模型

    Nemotron-Labs-Diffusion – 英伟达推出的统一架构的三模式大语言模型

    Nemotron-Labs-Diffusion是英伟达推出的统一架构的三模式大语言模型,通过创新性地将自回归、扩散和自猜测三种解码模式集成于单一模型,在保持生成质量的同时显著提升推理吞吐量。无需额外小...
    AI最新项目# 大模型
    文明旁观者的头像1个月前
    01220
    motion-anything – Open Design推出的对话原生的AI动效引擎

    motion-anything – Open Design推出的对话原生的AI动效引擎

    motion-anything是nexu.io旗下Open Design家族推出的本地优先、对话原生的AI动效引擎,定位为智能体时代的动效生产层。用户仅需用一句话描述动效需求,AI即可生成带动效的网页...
    AI最新项目# 大模型
    文明旁观者的头像2个月前
    01120
    加载更多
    AI深识站
    AI深识站——国内外优质AI工具导航平台,收录AI写作、绘画、办公、音视频等热门工具,配套AI资讯与教程,每日更新,助你高效工作、玩转AI生活!用AI,学AI,从这里开始。Ctrl + D 或 ⌘ + D 添加书签,随时探索AI新世界。

    关于我们广告合作免责声明

    Copyright © 2026 AI深识站 赣ICP备2026009722号-1 
    网址
    网址文章软件
    热门搜索
    元宝豆包DeepSeek千问翻译