MOSS-VL-Realtime – OpenMOSS团队开源视频理解模型MOSS-VL-Realtime是由复旦大学OpenMOSS团队开发的开源实时流式视频理解模型,专为处理动态视频流设计,突破传统模型需等待完整视频输入的限制,实现边接收画面边生成回答、信息不足时主动保...AI最新项目# 大模型3周前0680
Xiaomi-Robotics-U0 – 小米发布的多模态自回归具身生成基础模型Xiaomi-Robotics-U0是小米发布的380亿参数多模态自回归具身生成基础模型,专为解决机器人训练中的数据稀缺问题而设计。它首次将具身场景生成、轨迹迁移、交互视频生成与通用文生图能力统一到单...AI最新项目# 大模型3周前0600
Qwen-Audio-3.0-Realtime – 阿里巴巴发布的实时语音交互对话模型Qwen-Audio-3.0-Realtime是阿里巴巴于2026年7月15日发布的实时语音交互对话模型,通过同步提升推理能力、工具调用、情感表达与双工交互四项核心能力,在毫秒级响应速度下仍保持高精度...AI最新项目# 大模型3周前0670
4bit量化版Hy3模型 – 企业级AI降本指南,双卡替代集群腾讯混元4bit量化版Hy3模型是针对295B参数规模的混合专家(MoE)大模型进行4比特深度压缩的技术方案,将原始598GB的BF16权重量化至169.9GiB,仅需双张96GB显存显卡即可部署,在...AI最新项目# 大模型3周前0490
混元1bit – 腾讯混元Hy3旗舰大模型的1比特极致量化版本1bit是腾讯混元Hy3旗舰大模型的1比特极致量化版本(IQ1_M格式),通过梯度量化技术将2950亿参数模型的权重体积从598GB压缩至85.5GiB(缩小6.7倍),实现单张96GB显存显卡即可本...AI最新项目# 大模型3周前0610
Wan-Dancer – 阿里通义开源的音乐驱动人像舞蹈视频生成模型Wan-Dancer是阿里巴巴通义实验室开源的音乐驱动人像舞蹈视频生成模型,能够生成分钟级、高清晰度且节奏同步的舞蹈视频。它采用分层框架,将生成过程解耦为全局关键帧规划与局部时序优化两个阶段,有效解决...AI最新项目# 大模型3周前0500
StepAmoo – 阶跃星辰研发的新一代个人智能体StepAmoo是阶跃星辰(StepFun)研发的新一代个人智能体,作为STEPX Neo智能体手机的主智能体,定位是操作系统级的原生AI伙伴,而非传统手机中附加的语音助手。它通过深度整合硬件、系统与...AI最新项目3周前0490
干细胞AI模型“归元” – 面向干细胞重编程的AI预测模型干细胞AI模型“归元”是由西湖大学与阿里巴巴达摩院联合开发的面向干细胞重编程的可解释性AI预测模型,通过算法从近400万种小分子药物与生长因子组合中精准筛选最优方案,实现对细胞命运的定向调控,解决了传...AI最新项目# 大模型4周前0840
AnySearch – 专为AI智能体设计的搜索基础设施AnySearch是专为AI智能体(Agent)设计的搜索基础设施,不是返回网页链接,而是直接向Agent提供结构化、可直接用于推理的高质量信息,解决传统搜索引擎无法满足Agent对专业数据、实时性和...AI最新项目4周前0890
PixVerse Game Engine – 一款前沿AI实时生成游戏引擎PixVerse Game Engine是一款前沿AI实时生成游戏引擎,首创机制与表现解耦(MED)架构,依托PixVerseR1实时世界模型,以连续实时视频流替代传统预渲染管线构建完整互动游戏。引擎...AI最新项目4周前0760
DuoMem – 三星研究院联合高校团队提出的轻量化AI模型增强框架DuoMem是由三星研究院联合高校团队提出的轻量化AI模型增强框架,专为解决边缘设备(如家用机器人、IoT设备)上小参数模型(4B-14B)处理复杂任务能力不足的问题。通过双路径知识迁移机制,将大模型...AI最新项目4周前0630
HyOCR-1.5 – 腾讯混元团队开源的端到端多模态OCR大模型HyOCR-1.5是腾讯混元团队开源的端到端多模态OCR大模型,通过一体化架构实现文字检测与识别的联合优化,仅需10亿参数即可覆盖8类以上文档理解任务,在OmniDocBench v1.6基准测试中以...AI最新项目# 大模型4周前0630
Muse Spark 1.1 – Meta发布的多模态推理模型Muse Spark 1.1是Meta发布的多模态推理模型,专为AI智能体任务设计,通过主-子智能体协作架构实现复杂任务的自动化规划与执行,支持最高100万token上下文长度,在工具调用、跨应用操作...AI最新项目# 大模型4周前0460
Step Edge – 阶跃星辰发布的端侧模型全家桶Step Edge是阶跃星辰发布的端侧模型全家桶,包含基础模型、Audio模型、GUI模型和Gen模型四款垂直领域专用模型,目标是让AI智能体(Agent)在手机、汽车等终端设备上实现本地化实时响应与...AI最新项目# 大模型4周前0460
Agnes-2.5-Flash – Agnes AI推出的全新文本大模型Agnes-2.5-Flash是Agnes AI推出的全新高性能文本大模型,作为Agnes-2.0-Flash的升级版本,专为开发者与AI Agent工作流设计,在代码理解、工程修复、多步骤任务执行及...AI最新项目# 大模型4周前0990
SenseNova-Vision – 商汤科技发布并全面开源的统一视觉大模型SenseNova-Vision是商汤科技发布并全面开源的统一视觉大模型,将视觉能力原生融入大模型体系,首次实现目标检测、图像分割、深度预测、3D重建等经典视觉任务的单模型统一处理,彻底摒弃传统多模型...AI最新项目# 大模型4周前0620
Robostral Navigate – Mistral AI发布的具身导航大模型Robostral Navigate是法国AI公司Mistral AI发布的具身导航大模型,参数量仅80亿(8B)。仅依赖单个普通RGB摄像头,即可在复杂环境中实现高精度自主导航,无需深度传感器或激光...AI最新项目# 大模型4周前0620
Fun-ASR-Realtime – 通义升级发布的流式实时语音识别大模型Fun-ASR-Realtime是阿里云通义实验室升级发布的流式实时语音识别大模型,首字延迟控制在百毫秒级别、识别准确率接近离线模型,同时支持16种方言与30种语言的无缝识别。该模型专为直播字幕、会议...AI最新项目# 大模型4周前0720
Vidu S1 – 生数科技发布的实时交互的视频生成大模型Vidu S1是生数科技发布的全球首个支持实时交互的视频生成大模型,将视频生成从传统的“单向离线输出”升级为“双向实时对话”,用户可通过语音指令动态控制视频内容走向,实现540P分辨率、25FPS帧率...AI最新项目# 大模型4周前0590
地层学AI大模型 -中国科学家发布首个地层学AI大模型地层学AI大模型是中国科学家于2026年7月3日在全球首次发布的、专门针对地层学领域的专业人工智能模型,通过统一时间标尺整合地球46亿年演化历史的地质记录,构建全球共享的地层数据库,从而为生命起源、资...AI最新项目# 大模型4周前01040
RedKnot – 小红书研发并开源的长上下文大模型推理引擎RedKnot是小红书技术团队研发并开源的长上下文大模型推理引擎,通过按注意力头维度优化KV缓存管理,在显著提升推理速度的同时保持高精度,尤其适用于超长文本处理场景。将传统按token粒度的缓存机制重...AI最新项目# 大模型4周前0790
LongCat-2.0 – 美团发布的万亿参数级基础大模型LongCat-2.0是美团发布的万亿参数级基础大模型,作为业界首个全程依托国产算力完成训练与推理的万亿参数模型,其总参数规模达1.6万亿(1.6T),采用混合专家(MoE)架构,每个Token仅激活...AI最新项目# 大模型4周前0940
openPangu 2.0 Flash – 华为发布的开源盘古大模型轻量化版本openPangu-2.0-Flash是在华为开发者大会(HDC 2026)发布的开源盘古大模型轻量化版本,采用稀疏专家混合(MoE)架构,总参数量920亿(92B),但推理时仅激活60亿(6B)参数...AI最新项目# 大模型4周前01030
子曰4.0 – 网易有道发布的全模态大模型4.0版本子曰4.0是网易有道发布的全模态大模型4.0版本,同步开源多模态理解模型与TTS语音合成引擎,其中Confucius4-TTS作为业内首个支持14种语言跨语种无口音、且无需参考文本即可完成语音克隆的开...AI最新项目# 大模型4周前0790
Seedance 2.5 – 字节跳动发布的最新视频生成大模型Seedance 2.5是字节跳动火山引擎6月23日发布的最新视频生成大模型,作为Seedance 2.0的升级版本,实现单段30秒原生视频直出、支持50个全模态素材联合输入,并首次提供画面一致性保障...AI最新项目# 大模型4周前0980
doubao-seed-2.1 Turbo – 豆包大模型系列轻量化生产级版本doubao-seed-2.1 Turbo是字节跳动于2026年6月23日发布的豆包大模型系列轻量化生产级版本,作为doubao-seed-2.1 Pro的低成本、高吞吐优化版本,以Pro版50%的成...AI最新项目# 大模型4周前01310
Doubao-Seed-2.1 Pro – 字节发布的豆包大模型系列最新旗舰版本Doubao-Seed-2.1 Pro是字节跳动于2026年6月23日发布的豆包大模型系列最新旗舰版本,作为面向企业级高复杂度任务的深度思考模型,通过代码生成、智能Agent协同与多模态理解三大能力的...AI最新项目# 大模型4周前01380
Baichuan-M4 – 百川智能与团队联合发布的医疗增强大模型百川智能与清华大学研究团队联合发布的医疗增强大模型Baichuan-M4,是全球首个在HealthBench三大权威榜单(综合、Hard复杂决策、Professional专业场景)同时登顶的医疗专用大...AI最新项目# 大模型4周前0920
HappyHorse 1.1 – 阿里巴巴发布的视频生成大模型升级版本HappyHorse 1.1是阿里巴巴于2026年6月22日正式发布的视频生成大模型升级版本,在动态表现力、主体一致性、指令遵循、视觉质感和音频能力五大核心维度实现系统性突破。解决专业内容生产场景中动...AI最新项目# 大模型4周前01440
UnifoLM-VLA-0 – 宇树科技开源的视觉-语言-动作大模型UnifoLM-VLA-0是宇树科技开源的视觉-语言-动作(VLA)大模型,专为通用人形机器人操作设计,通过将视觉感知、语言指令与物理动作统一建模,实现了从传统图文理解到具备物理常识的"具身智能"突破...AI最新项目# 大模型4周前01160