OpenMontage – 全球首个开源由AI智能体驱动的视频制作系统OpenMontage是全球首个开源的、由AI智能体(Agentic AI)驱动的视频制作系统。简单来说,它就像一个不知疲倦的“AI 视频副导演”。它不是一个简单的“一键生成视频”的玩具,而是一个结构...AI最新项目4个月前02930
SeedMusic 1.0 Preview – 即梦AI平台上线的音乐生成功能SeedMusic 1.0 Preview是字节跳动在即梦AI平台上线的音乐生成功能,让无音乐基础的用户通过自然语言描述即可生成旋律自然、情感贴合的原创歌曲,并支持从歌词调整到人声克隆的全流程编辑。该...AI最新项目3个月前02910
HiDream-O1-Image-Pro – 智象未来发布的图像生成大模型HiDream-O1-Image-Pro是智象未来发布的超2000亿参数原生全模态图像生成大模型,采用全球首创的像素级统一Transformer(UiT)架构,彻底摒弃传统VAE压缩与独立文本编码器...AI最新项目4个月前02910
GenflowAI – 多模态AI创意工作空间GenflowAI是面向创作者、电商与营销团队的多模态AI创意工作空间,主打无代码自动化工作流。聚合 GPT、Gemini、Seedance 2.0等顶尖模型,单一画布内完成文本、图像、视频、音频的生...AI最新项目4个月前02850
Qwen3.5-0.8B – 千问团队开源的最小尺寸端侧大模型Qwen3.5-0.8B是阿里巴巴通义千问团队开源的最小尺寸端侧大模型,具备原生多模态能力,专为资源受限设备设计。 其核心价值在于以极低计算资源实现高智能密度,在移动端和边缘设备上可提供本地化、低延迟...AI最新项目4个月前02830
BitCPM-CANN – 国产算力平台训练并开源三值权重大模型系列BitCPM-CANN是中国首个完全基于国产算力平台(华为昇腾)原生训练并开源的1.58-bit三值权重大模型系列,通过将模型权重压缩至-1、0、1三个值,在推理阶段释放约6倍显存空间,同时保留90...AI最新项目4个月前02810
HiDream-O1-Image – 智象未来发布的新一代原生全模态图像大模型HiDream-O1-Image是由智象未来在 2026年4月正式发布的新一代原生全模态图像大模型。HiDream-O1-Image的核心定位是“基于原生全模态架构(UiT)的电影级画质生成器”。该模...AI最新项目4个月前02800
美团GEO营销门户 – 美团推出的生成式引擎优化(GEO)平台美团GEO营销门户是美团推出的生成式引擎优化(GEO)平台,助力本地商家在豆包、DeepSeek等主流AI大模型对话中获得更多推荐与曝光。提供策略建议、AI内容生成、多平台监测、效果追踪四大核心能力...AI最新项目4个月前02790
Xiaomi Auto World Model – 小米发布的世界模型全新框架Xiaomi Auto World Model是小米汽车发布的世界模型全新框架,其核心突破在于首次将三维重建与视频生成深度耦合为一体化架构,以“重建锚定几何、生成填补想象”的新范式,推动辅助驾驶从“场...AI最新项目# 大模型2个月前02790
广发证券Skill – 广发证券推出的AI智能体技能服务矩阵广发证券Skill是广发证券推出的AI智能体技能服务矩阵,已入驻腾讯ima Skill广场,将金融业务能力(如投研分析、数据查询、风险监测等)封装为标准化、可调用的功能模块,用户通过自然语言指令即可触...AI最新项目3个月前02780
混元3D世界模型 2.0 – 腾讯混元3D世界模型2.0发布腾讯混元团队正式发布并开源了混元3D世界模型 2.0 (HY-World 2.0)。这是一个多模态大模型,能够根据文字、图片、视频等输入,自动生成、重建和模拟可交互的3D世界。 它的核心突破在于,不再...AI最新项目# 大模型2个月前02770
Qwen3.6-35B-A3B – 阿里通义千问开源混合专家(MoE)模型Qwen3.6-35B-A3B是阿里巴巴通义千问团队于2026年4月16日正式开源的一款高性能混合专家(MoE)模型。 作为Qwen3.6系列的首个开源权重版本,它凭借“350 亿总参数、仅30亿激活...AI最新项目# 大模型2个月前02760
Lyria 3 Pro – 谷歌推出的旗舰AI音乐生成模型Lyria 3 Pro是谷歌DeepMind于2026年3月25日推出的旗舰AI音乐生成模型,为Lyria 3进阶版。它将生成时长从30秒提升至3分钟,可完整输出带前奏、主歌、副歌的专业曲目,保持24...AI最新项目6个月前02760
MAI-Code-1-Flash – 微软发布的首款自研轻量级代码生成模型MAI-Code-1-Flash是微软发布的首款自研轻量级代码生成模型,专为开发者日常编码场景设计,采用50亿参数的紧凑架构,通过自适应推理预算分配技术实现高效率与低成本的平衡。 其核心价值在于将Ag...AI最新项目# 大模型2个月前02750
Cosmos 3 – 英伟达发布的开源全模态物理AI基础大模型Cosmos 3是英伟达(NVIDIA)于2026年6月1日正式发布的全球首款全开源、全模态(Omni-Model)物理AI基础大模型。它被定义为一个“世界模型”,旨在赋予人工智能系统理解物理世界规律...AI最新项目# 大模型2个月前02740
HeiMaClaw – 黑马程序员推出的一款生产级企业AI Agent平台HeiMaClaw是由黑马程序员推出的一款生产级企业AI Agent平台。与面向个人用户的助手不同,HeiMaClaw的定位非常明确:它是一个企业级基础设施,旨在通过工程化手段(Harness Eng...AI最新项目4个月前02680
MiMo-V2.5 – 小米于正式开源的原生全模态大模型MiMo-V2.5是小米于正式开源的原生全模态大模型。与专注于复杂推理的Pro版本不同,MiMo-V2.5主打全能感知与高性价比,能够像人类一样同时“看、听、读”,并迅速做出反应。它被视为覆盖绝大多数...AI最新项目5个月前02660
Seeduplex – 字节跳动发布的原生全双工语音大模型Seeduplex是字节跳动Seed团队2026年4月9日发布的原生全双工语音大模型,已全量上线豆包、抖音App。它突破传统半双工“回合制问答”限制,实现“边听边说”的实时自然交互。通过语音语义联合建...AI最新项目6个月前02650
PrismAudio – 阿里通义实验室推出的AI视频环境音生成框架PrismAudio是阿里通义实验室推出的AI视频环境音生成框架,可根据画面自动生成逼真环境音效与动作音。它采用分解式思维链分析画面内容与发声时机,结合四维强化学习实现声画精准同步,兼顾语义匹配、时序...AI最新项目6个月前02630
Xiaomi OneVL – 小米发布并全面开源的自动驾驶大模型Xiaomi OneVL是小米正式对外发布并全面开源的自动驾驶大模型。Xiaomi OneVL的核心定位是“一步式潜空间语言视觉推理框架”。OneVL并非简单的视觉模型,而是小米XLA(认知大模型架构...AI最新项目4个月前02620
StepAudio 2.5 Realtime – 阶跃星辰推出的新一代实时语音大模型StepAudio 2.5 Realtime是阶跃星辰推出的新一代实时语音大模型。StepAudio 2.5 Realtime的核心定位是打造极具“活人感”的实时语音交互。该模型不仅具备行业顶级的“副...AI最新项目5个月前02600
HappyHorse 1.1 – 阿里巴巴发布的视频生成大模型升级版本HappyHorse 1.1是阿里巴巴于2026年6月22日正式发布的视频生成大模型升级版本,在动态表现力、主体一致性、指令遵循、视觉质感和音频能力五大核心维度实现系统性突破。解决专业内容生产场景中动...AI最新项目# 大模型2个月前02590
Qwen3-ASR-1.7B – 千问团队开源的多语言语音识别模型Qwen3-ASR-1.7B是阿里云通义千问团队开源的17亿参数多语言语音识别模型,在中文、英文等52种语言及方言的识别任务中达到开源模型SOTA水平(中文词错率低至5.2%,显著优于Whisper...AI最新项目4个月前02590
doubao-seed-2.1 Turbo – 豆包大模型系列轻量化生产级版本doubao-seed-2.1 Turbo是字节跳动于2026年6月23日发布的豆包大模型系列轻量化生产级版本,作为doubao-seed-2.1 Pro的低成本、高吞吐优化版本,以Pro版50%的成...AI最新项目# 大模型2个月前02580
Qwen-AgentWorld – 阿里通义千问团队发布原生语言世界模型Qwen-AgentWorld是阿里巴巴通义千问团队于2026年6月24日发布的全球首个原生语言世界模型(Language World Model, LWM),从训练源头实现环境建模,而非依赖事后插件...AI最新项目# 大模型2个月前02570
Qwen3.5-Omni – 千问发布的端到端原生全模态大模型Qwen3.5-Omni是阿里巴巴通义千问正式发布的新一代端到端原生全模态大模型。 它打破了传统模型只能处理单一或特定组合模态的限制,实现了文本、图像、音频、视频四种模态的原生统一理解与生成,被誉为...AI最新项目5个月前02570
GLM-5-Turbo – 智谱为OpenClaw打造的智能体专用基座模型GLM-5-Turbo 是智谱AI(Zhipu AI)于2026年3月16日最新发布的一款专为复杂智能体(Agent)场景深度优化的基座大模型。 它是基于此前发布的旗舰模型GLM-5进行的特定场景加速...AI最新项目# 大模型2个月前02560
SkyClaw-v1.0 – 天工AI发布的Agent专用模型SkyClaw-v1.0是昆仑万维旗下天工AI发布的高性能Agent专用模型,其核心突破在于以远低于行业均价的成本,实现了接近Claude Opus 4.6等顶级闭源模型的任务执行能力,尤其擅长在百万...AI最新项目4个月前02540
Hogee – 百度智能云推出的一站式AI短剧创作平台Hogee是百度智能云推出的一站式 AI 短剧创作平台,依托OpenClaw数字员工体系,覆盖剧本、分镜、角色、配音到成片全流程。上传小说或剧本,AI自动拆解剧情、生成角色与场景图、合成视频,成本降 ...AI最新项目5个月前02530
Ideogram 4 – Ideogram公司发布的开源文生图模型Ideogram 4.0是Ideogram公司于2026年6月3日发布的93亿参数开源文生图模型,最大突破在于通过单流架构实现像素级排版控制能力,使AI生图从随机“抽卡”转向可精准指定文字位置、对象布...AI最新项目4个月前02510