AI深识站
  • AI软件
  • AI资讯
  • AI世界漫游指南
    • AI知识探索库
    • AI学习教程
  • AI最新项目
  • 排行榜
      • 未登录
        登录后即可体验更多功能
    • AI软件
    • AI资讯
    • AI世界漫游指南
      • AI知识探索库
      • AI学习教程
    • AI最新项目
    • 排行榜
    未登录
    登录后即可体验更多功能

    大模型

    共 165 篇文章
    排序
    发布更新浏览点赞
    LingBot-Video – 蚂蚁开源的面向具身智能视频生成基础模型

    LingBot-Video – 蚂蚁开源的面向具身智能视频生成基础模型

    LingBot-Video是蚂蚁灵波科技开源的面向具身智能(Embodied AI)的视频生成基础模型,采用Mixture-of-Experts(MoE)架构设计,目标是解决传统视频生成模型在物理规律...
    AI最新项目# 大模型
    文明旁观者的头像2个月前
    01200
    LingBot-VLA 2.0 – 蚂蚁灵波科技开源的新一代具身智能基座模型

    LingBot-VLA 2.0 – 蚂蚁灵波科技开源的新一代具身智能基座模型

    LingBot-VLA 2.0是蚂蚁灵波科技开源的新一代具身智能基座模型,作为机器人领域的“通用大脑”,通过6万小时高质量真实物理数据训练,首次实现对20多种不同构型机器人的统一控制能力,显著提升了双...
    AI最新项目# 大模型
    文明旁观者的头像2个月前
    0780
    motion-anything – Open Design推出的对话原生的AI动效引擎

    motion-anything – Open Design推出的对话原生的AI动效引擎

    motion-anything是nexu.io旗下Open Design家族推出的本地优先、对话原生的AI动效引擎,定位为智能体时代的动效生产层。用户仅需用一句话描述动效需求,AI即可生成带动效的网页...
    AI最新项目# 大模型
    文明旁观者的头像2个月前
    01130
    LingBot-Vision – 灵波科技研发的面向具身智能视觉基础模型

    LingBot-Vision – 灵波科技研发的面向具身智能视觉基础模型

    LingBot-Vision是蚂蚁集团旗下灵波科技研发的全球首个面向具身智能的“空间原生”视觉基础模型,将物体边界结构作为预训练核心目标,使机器人能精准感知物理世界的三维空间关系(如物体边界位置、距离...
    AI最新项目# 大模型
    文明旁观者的头像2个月前
    01080
    Hy3 – 腾讯混元发布的新一代开源大语言模型

    Hy3 – 腾讯混元发布的新一代开源大语言模型

    腾讯混元Hy3是腾讯发布的新一代开源大语言模型,采用混合专家(MoE)架构,在保持较小激活参数量的同时实现与更大尺寸旗舰模型相当的性能。高性价比的实用型模型,重点强化了Agent能力、推理稳定性及办公...
    AI最新项目# 大模型
    文明旁观者的头像2个月前
    01140
    Leanstral 1.5 – Mistral AI推出的形式化验证与数学证明领域模型

    Leanstral 1.5 – Mistral AI推出的形式化验证与数学证明领域模型

    Leanstral 1.5是Mistral AI推出的专注于形式化验证与数学证明领域的专用AI模型,属于Leanstral系列的迭代版本。它并非通用编程助手,而是专为 Lean 4 证明语言设计的代码...
    AI最新项目# 大模型
    文明旁观者的头像2个月前
    01170
    Nemotron-Labs-TwoTower – 英伟达开源的扩散语言模型

    Nemotron-Labs-TwoTower – 英伟达开源的扩散语言模型

    Nemotron-Labs-TwoTower是英伟达(NVIDIA)开源的扩散语言模型,通过双塔架构设计将文本生成吞吐量提升2.42倍,同时保留98.7%的原始生成质量,专为解决传统自回归模型在大规模...
    AI最新项目# 大模型
    文明旁观者的头像2个月前
    01080
    AMALIA – 葡萄牙主导开发的葡萄牙语开源大语言模型

    AMALIA – 葡萄牙主导开发的葡萄牙语开源大语言模型

    AMALIA是葡萄牙国家主导开发的首个专为欧洲葡萄牙语(pt-PT)优化的开源大语言模型目标是解决主流AI模型对欧洲葡萄牙语文化及语言细节支持不足的问题,通过深度本地化训练实现对葡萄牙语境、法律体系和...
    AI最新项目# 大模型
    文明旁观者的头像2个月前
    0900
    yuxinlu1 Gemma4-12B – 深度微调的本地化专业模型系列

    yuxinlu1 Gemma4-12B – 深度微调的本地化专业模型系列

    yuxinlu1 Gemma4-12B是开发者逯雨鑫基于谷歌官方Gemma4-12B模型深度微调的本地化专业模型系列,主要包括编程专用版(Coder版)和故事创作版(Agentic-Fable版)。通...
    AI最新项目# 大模型
    文明旁观者的头像2个月前
    01190
    DeepSeek V4正式版 – 深度求索上线的旗舰大语言模型

    DeepSeek V4正式版 – 深度求索上线的旗舰大语言模型

    DeepSeek V4正式版是深度求索(DeepSeek)将于2026年7月中旬正式上线的旗舰大语言模型,基于4月24日发布的预览版完成功能优化与性能调优,首次引入峰谷定价机制以优化算力资源分配。该版...
    AI最新项目# 大模型
    文明旁观者的头像2个月前
    05200
    Unlimited-OCR – 百度开源的端到端长文档解析视觉语言模型

    Unlimited-OCR – 百度开源的端到端长文档解析视觉语言模型

    Unlimited-OCR是百度开源的端到端长文档解析视觉语言模型,通过创新的参考滑动窗口注意力机制(R-SWA),首次实现单次推理无损解析40+页PDF文档的能力,解决了传统OCR模型处理长文档时的...
    AI最新项目# 大模型
    文明旁观者的头像2个月前
    01600
    Qwen-AgentWorld – 阿里通义千问团队发布原生语言世界模型

    Qwen-AgentWorld – 阿里通义千问团队发布原生语言世界模型

    Qwen-AgentWorld是阿里巴巴通义千问团队于2026年6月24日发布的全球首个原生语言世界模型(Language World Model, LWM),从训练源头实现环境建模,而非依赖事后插件...
    AI最新项目# 大模型
    文明旁观者的头像2个月前
    02060
    JoyAI-VL-Interaction – 京东开源的全栈开源视觉语言实时交互模型

    JoyAI-VL-Interaction – 京东开源的全栈开源视觉语言实时交互模型

    JoyAI-VL-Interaction是京东于2026年6月22日正式开源的全球首个全栈开源视觉语言实时交互模型,将多模态大模型从传统"一问一答"模式升级为"边看边说"的实时流式交互能力,使AI能像...
    AI最新项目# 大模型
    文明旁观者的头像2个月前
    01970
    DeepSeek V4 Pro – 深度求索发布的旗舰级开源大语言模型

    DeepSeek V4 Pro – 深度求索发布的旗舰级开源大语言模型

    DeepSeek V4 Pro是深度求索(DeepSeek)发布的旗舰级开源大语言模型,采用1.6万亿参数混合专家(MoE)架构,原生支持100万token超长上下文,在推理能力、Agent任务执行效...
    AI最新项目# 大模型
    文明旁观者的头像2个月前
    01060
    PP-OCRv6 – 百度飞桨发布的超轻量级OCR模型系列最新版本

    PP-OCRv6 – 百度飞桨发布的超轻量级OCR模型系列最新版本

    PP-OCRv6是百度飞桨发布的超轻量级OCR(光学字符识别)模型系列最新版本,50种语言统一模型架构与工业级复杂场景适应能力。它通过三阶段流水线(检测-分类-识别)实现高精度、低延迟、小体积的文本识...
    AI最新项目# 大模型
    文明旁观者的头像2个月前
    01090
    HiDream-O1-Image-1.5 – 智象未来推出的商用版图像生成模型

    HiDream-O1-Image-1.5 – 智象未来推出的商用版图像生成模型

    HiDream-O1-Image-1.5智象未来推出的商用版图像生成模型,在Artificial Analysis全球文生图榜单中评分1265ELO,位列中国第一、全球第二(仅次于OpenAI),采用...
    AI最新项目# 大模型
    文明旁观者的头像2个月前
    01400
    新程Alpha – 明日新程公司推出的全球首个端侧认知模型

    新程Alpha – 明日新程公司推出的全球首个端侧认知模型

    新程Alpha是明日新程(Nextie)公司推出的全球首个端侧认知模型,参数量仅4B(40亿),通过将“知识记忆”与“思考能力”解耦,专注于泛化推理和抽象决策,在群体智能任务中表现等效于GPT-5.4...
    AI最新项目# 大模型
    文明旁观者的头像2个月前
    01240
    ABot-Earth0.5 – 高德地图发布全球首个3D原生城市世界模型

    ABot-Earth0.5 – 高德地图发布全球首个3D原生城市世界模型

    ABot-Earth0.5是高德地图发布的全球首个3D原生城市世界模型,仅需单张卫星图像或文字描述,即可在10分钟内通过消费级GPU生成公里级可编辑3D城市场景。该模型将3D制图成本降至传统方式的百分...
    AI最新项目# 大模型
    文明旁观者的头像2个月前
    01350
    MAI-Code-1-Flash – 微软发布的首款自研轻量级代码生成模型

    MAI-Code-1-Flash – 微软发布的首款自研轻量级代码生成模型

    MAI-Code-1-Flash是微软发布的首款自研轻量级代码生成模型,专为开发者日常编码场景设计,采用50亿参数的紧凑架构,通过自适应推理预算分配技术实现高效率与低成本的平衡。 其核心价值在于将Ag...
    AI最新项目# 大模型
    文明旁观者的头像2个月前
    02280
    PaddleOCR-VL-1.6 – 百度发布的轻量化多模态文档解析模型

    PaddleOCR-VL-1.6 – 百度发布的轻量化多模态文档解析模型

    PaddleOCR-VL-1.6是百度发布的轻量化多模态文档解析模型,在权威评测集OmniDocBench v1.6中以96.33%的综合准确率刷新全球SOTA记录,超越Gemini-3-Pro、GP...
    AI最新项目# 大模型
    文明旁观者的头像2个月前
    01500
    MAI-Thinking-1 – 微软发布的首款完全自研的高级推理AI模型

    MAI-Thinking-1 – 微软发布的首款完全自研的高级推理AI模型

    MAI-Thinking-1是微软于2026年6月3日发布的首款完全自研的高级推理AI模型,采用350亿活跃参数的稀疏混合专家(MoE)架构,完全基于企业级合规数据从零训练,未使用任何第三方模型蒸馏数...
    AI最新项目# 大模型
    文明旁观者的头像2个月前
    01620
    Qwen2.5-7B – 阿里云通义千问系列开源大语言模型

    Qwen2.5-7B – 阿里云通义千问系列开源大语言模型

    Qwen2.5-7B是阿里云通义千问系列推出的76.1亿参数开源大语言模型,核心特点为支持131.072 tokens超长上下文、原生结构化输出能力及显著提升的数学与编程性能,适用于需平衡推理成本与专...
    AI最新项目# 大模型
    文明旁观者的头像2个月前
    01390
    Mellum2 – JetBrains推出的开源混合专家(MoE)模型

    Mellum2 – JetBrains推出的开源混合专家(MoE)模型

    Mellum2是JetBrains推出的120亿参数开源混合专家(MoE)模型,专为软件工程场景设计,核心目标是通过超低延迟推理与私有化部署能力,解决企业级AI工作流中的实时性与成本瓶颈。 Mellu...
    AI最新项目# 大模型
    文明旁观者的头像2个月前
    01330
    Qwen3.7-Plus – 阿里巴巴发布的多模态智能体模型

    Qwen3.7-Plus – 阿里巴巴发布的多模态智能体模型

    Qwen3.7-Plus是阿里巴巴于2026年6月2日正式发布的多模态智能体模型,定位为视觉与语言统一的智能体基座。它在Qwen3.7文本能力基础上深度融合视觉理解与行动能力,不仅能看懂图像/视频,还...
    AI最新项目# 大模型
    文明旁观者的头像2个月前
    02100
    Qwen-VLA – 阿里通义团队最新发布的通用机器人基础模型

    Qwen-VLA – 阿里通义团队最新发布的通用机器人基础模型

    Qwen-VLA是阿里通义团队最新发布的通用机器人基础模型。 简单来说,如果之前的视觉模型是让AI拥有一双“眼睛”去理解世界,那么Qwen-VLA就是给这双眼睛配上了“灵活的手脚”,让AI不仅能看、能...
    AI最新项目# 大模型
    文明旁观者的头像2个月前
    01270
    ForgeTrain – 面壁智能联合清华等全球首个由AI自主编写

    ForgeTrain – 面壁智能联合清华等全球首个由AI自主编写

    ForgeTrain是由面壁智能联合清华大学及OpenBMB开源社区发布的全球首个完全由AI自主编写、零人类代码介入的生产级大模型预训练框架。 其核心突破在于AI首次独立完成大模型训练基础设施的端到端...
    AI最新项目# 大模型
    文明旁观者的头像2个月前
    01080
    LFM2.5-1.2B – Liquid AI推出的12亿参数轻量级AI模型家族

    LFM2.5-1.2B – Liquid AI推出的12亿参数轻量级AI模型家族

    LFM2.5-1.2B是Liquid AI推出的12亿参数轻量级AI模型家族,专为边缘设备与本地部署优化设计,最大特点是仅需约900MB内存即可在普通智能手机上流畅运行,同时通过创新的"思考链"机制实...
    AI最新项目# 大模型
    文明旁观者的头像2个月前
    01640
    Xiaomi Auto World Model – 小米发布的世界模型全新框架

    Xiaomi Auto World Model – 小米发布的世界模型全新框架

    Xiaomi Auto World Model是小米汽车发布的世界模型全新框架,其核心突破在于首次将三维重建与视频生成深度耦合为一体化架构,以“重建锚定几何、生成填补想象”的新范式,推动辅助驾驶从“场...
    AI最新项目# 大模型
    文明旁观者的头像2个月前
    02290
    ZCube – 智谱联合清华大学开发的新型AI集群网络架构

    ZCube – 智谱联合清华大学开发的新型AI集群网络架构

    ZCube是由智谱联合清华大学、驭驯网络开发的新型AI集群网络架构,专为解决大模型推理场景中的结构性网络拥塞问题而设计。 其核心突破在于彻底重构网络拓扑,通过取消传统Clos架构的Spine层、采用扁...
    AI最新项目# 大模型
    文明旁观者的头像2个月前
    01760
    Lance – 字节跳动推出的原生统一的多模态模型

    Lance – 字节跳动推出的原生统一的多模态模型

    Lance 是字节跳动推出的一个原生统一的多模态模型。它是一个参数量为 30亿(3B) 的研究性项目,旨在打破图像和视频在理解、生成、编辑任务上的壁垒。 与许多需要针对不同任务单独微调的模型不同,La...
    AI最新项目# 大模型
    文明旁观者的头像2个月前
    03010
    加载更多
    AI深识站
    AI深识站——国内外优质AI工具导航平台,收录AI写作、绘画、办公、音视频等热门工具,配套AI资讯与教程,每日更新,助你高效工作、玩转AI生活!用AI,学AI,从这里开始。Ctrl + D 或 ⌘ + D 添加书签,随时探索AI新世界。

    关于我们广告合作免责声明

    Copyright © 2026 AI深识站 赣ICP备2026009722号-1 
    网址
    网址文章软件
    热门搜索
    元宝豆包DeepSeek千问翻译