html-video – Open Design团队开源的HyperFramesOpen Design团队开源的HyperFrames(常被称作 "HTML 版剪映")是 一个基于 HTML/CSS/JavaScript 的动态视频生成框架,核心目标是让开发者用前端技术栈直接生成...AI最新项目4个月前02300
Qwen3.6-Max-Preview – 阿里通义千问系列当前最强旗舰预览版Qwen3.6-Max-Preview(2026年4月20日发布)是阿里通义千问系列当前最强旗舰预览版,定位企业级与开发者高要求场景,在智能体编程、世界知识、指令遵循三大核心能力上全面超越Qwen3...AI最新项目5个月前02290
LongCat-Video-Avatar 1.5 – 美团开源的虚拟人视频生成模型LongCat-Video-Avatar 1.5是美团龙猫团队开源的商用级虚拟人视频生成模型升级版本,在动作拟真度、长视频稳定性与身份一致性三大核心维度实现突破性升级,首次在多项关键指标上全面超越主流...AI最新项目4个月前02280
StepAudio 2.5 ASR – 阶跃星辰发布的新一代自动语音识别模型StepAudio 2.5 ASR是阶跃星辰正式发布的新一代自动语音识别模型。该模型的核心突破在于率先将大语言模型的推理加速技术引入语音识别领域,通过架构创新,在大幅提升转写精度的同时,实现了推理速度...AI最新项目5个月前02270
Seedance 2.5 – 字节跳动发布的最新视频生成大模型Seedance 2.5是字节跳动火山引擎6月23日发布的最新视频生成大模型,作为Seedance 2.0的升级版本,实现单段30秒原生视频直出、支持50个全模态素材联合输入,并首次提供画面一致性保障...AI最新项目# 大模型2个月前02230
PPT Master – 开源的AI生成PPT工作流PPT Master是一个开源的AI工作流(Skill),它的核心目标是解决传统AI生成PPT工具的最大痛点:生成的幻灯片是“一张图片”,无法二次编辑。 PPT Master通过一套标准化的本地工作流...AI最新项目4个月前02230
Qwen-Image-Bench – 通义千问团队推出的文生图专用评测基准Qwen-Image-Bench是阿里云通义千问团队推出的文生图专用评测基准,主打创作者视角与专业标准。含1000 个中英双语 prompt,从画质、美学、图文对齐、真实保真、创作生成 5 大维度,设...AI最新项目4个月前02220
MiniMax Music 2.6 – MiniMax发布了新一代AI音乐生成模型MiniMax发布了其新一代AI音乐生成模型——Music 2.6. 这次更新被官方称为“全维度进化”,核心解决的是以往 AI 音乐“机械感强”、“不可控”和“生成慢”的三大痛点。简单来说,现在的Mu...AI最新项目# 大模型2个月前02220
Dubbing v2 – ElevenLabs推出的最新AI配音模型Dubbing v2是ElevenLabs推出的AI配音模型,首次实现 跨语言情感迁移,能够将原始语音中的语调、节奏、停顿、情绪起伏等表演细节完整保留并自然映射到目标语言中。 其核心突破在于 摒弃传统...AI最新项目4个月前02210
Wan2.7-Video – 阿里巴巴发布的一款视频生成系列模型Wan2.7-Video 是阿里巴巴发布的一款视频生成系列模型。它的核心特点是拥有全面的创作控制力,将 AI 的能力从单一的素材生成扩展至“生成、编辑、复刻、重塑”等创作全链路,实现了从被动“演绎”到...AI最新项目6个月前02210
Page Agent – 阿里巴巴开源的纯前端GUI智能体框架Page Agent是阿里巴巴开源的纯前端GUI智能体框架,无需截图或外部浏览器控制,直接通过解析网页DOM结构实现自然语言驱动的页面操作。将AI操作能力内嵌至网页本身,使开发者能以极低成本为自有产品...AI最新项目3个月前02200
GPT-5.5 Instant – ChatGPT的全新一代默认模型OpenAI正式发布了GPT-5.5 Instant,并将其设为ChatGPT的默认模型,全面取代了此前的GPT-5.3Instant。这次更新被官方定义为“更准确、更简洁、更懂你”的进化。它不再仅仅...AI最新项目3个月前02200
Qwen-Scope – 阿里千问开源的一款大模型可解释性分析模块Qwen-Scope是阿里千问正式开源的一款大模型可解释性分析模块。简单来说,它就像是给黑盒般的大模型装上了一个“透视镜”或“仪表盘”,让我们能够看穿模型内部的运作机制,理解它为什么会产生某种回答,甚...AI最新项目5个月前02200
小米XLA大模型 – 小米智能驾驶领域研发的一款端到端认知大模型小米XLA大模型是小米集团专为智能驾驶领域研发的一款端到端认知大模型,是其HAD(Hyper Autonomous Driving,小米超级智能驾驶)系统的核心技术升级。 它的核心突破在于首次将“辅助...AI最新项目6个月前02200
FlashQLA – 通义千问团队开源的一个高性能线性注意力算子库FlashQLA是通义千问团队(Qwen Team)正式开源的一个高性能线性注意力算子库。简单来说,它是专门为提升大语言模型(特别是Qwen3.5、Qwen3.6及后续系列)在处理超长文本时的训练和推...AI最新项目5个月前02180
MiniCPM-Desk-Pet – 开源AI桌面宠物应用MiniCPM-Desk-Pet是基于面壁智能MiniCPM5-1B端侧大模型开发的开源AI桌面宠物应用,完全支持本地运行、无需联网、断网可用,且硬件门槛极低。 其核心价值在于将高性能端侧AI模型与轻...AI最新项目4个月前02170
GPT-Realtime-Translate – OpenAI推出的实时流式翻译模型GPT-Realtime-Translate是OpenAI推出的一款专注于实时流式翻译的AI模型。它的核心突破在于打破了传统翻译“说完一句、停顿、再翻译”的回合制模式,实现了边听边译的“同传”体验,将...AI最新项目5个月前02170
9Router – 完全免费、开源的本地AI模型路由代理工具9Router是一款完全免费、开源的本地AI模型路由代理工具,你可以把它理解为你所有AI编程工具背后的“智能调度中心”。它的核心目标是让你用最低的成本,获得最稳定、不间断的AI编程体验。 9Route...AI最新项目4个月前02160
Ling-2.6-1T – 蚂蚁百灵开源的一款万亿参数级旗舰大模型Ling-2.6-1T是蚂蚁集团百灵大模型团队开源的一款万亿参数级旗舰大模型。它最大的特点是不盲目追求“慢思考”式的长推理链,而是独创了“快思考”机制,旨在以极低的计算成本实现高效的复杂任务执行。其综...AI最新项目5个月前02160
Stable Audio3 – Stability AI正式发布的音频生成模型系列Stable Audio3.0是Stability AI正式发布的音频生成模型系列,最大突破是将专业级音乐生成时长提升至 6 分 20 秒,首次实现AI生成结构完整、旋律连贯的歌曲级内容,标志着 AI...AI最新项目4个月前02150
Hy3 preview – 腾讯混元正式发布并开源的新一代语言模型Hy3 preview是腾讯混元(Hunyuan)团队正式发布并开源的一款新一代语言模型。 在经历底层基础设施“重建”后推出的首个成果,也是腾讯首席AI科学家姚顺雨(ReAct框架提出者)加盟后主导的...AI最新项目# 大模型2个月前02150
Xiaomi MiMo-Embodied – 小米自主研发的一款具身开源大模型Xiaomi MiMo-Embodied是由小米公司自主研发的一款具身大模型(Embodied AI Model),于2025年11月21日正式发布并全面开源。 它是业界首个成功打通自动驾驶与具身智能...AI最新项目# 大模型2个月前02150
混元Turbo S – 腾讯推出的一款旗舰级“快思考”大模型混元Turbo S是腾讯推出的一款旗舰级“快思考”大模型,也是混元家族中主打“速度”与“性价比”的核心主力。 简单来说,如果把大模型比作人脑,混元T1是负责深思熟虑的“慢思考”系统,而混元Turbo ...AI最新项目# 大模型2个月前02150
豆包App灰测打车 – 字节豆包启动的对话式打车功能灰度测试豆包App灰测打车是字节跳动旗下AI助手豆包于2026年6月22日启动的对话式打车功能灰度测试,用户无需跳转第三方应用,仅通过自然语言口述需求即可调用曹操出行服务。该功能目前仅面向北京、杭州部分用户开...AI最新项目3个月前02140
deepseek v4 flash – 深度求索发布的轻量化高效版大模型DeepSeek-V4-Flash是深度求索发布的轻量化高效版大模型,作为V4系列的“快速模式”版本,专为高频日常任务设计,在保持接近Pro版推理能力的同时,将响应速度和调用成本压缩至极致。以1/10...AI最新项目# 大模型2个月前02140
Horizon – 开源的AI驱动新闻聚合与简报生成工具Horizon是一个开源的AI驱动新闻聚合与简报生成工具,由开发者Thysrael创建,核心功能是自动从多渠道抓取信息、通过AI筛选高价值内容、生成结构化中英双语日报。Horizon解决了信息过载时代...AI最新项目4个月前02140
Hermes Agent – Nous Research开源的自进化AI智能体框架Hermes Agent是由美国硅谷AI实验室Nous Research于2026年2月开源的自进化AI智能体框架,核心特点是通过内置学习闭环系统自动沉淀经验为可复用技能,实现“越用越懂用户”的长期陪...AI最新项目4个月前02130
HyperEyes – 小红书研究团队提出的并行多模态搜索智能体HyperEyes是由小红书研究团队提出的并行多模态搜索智能体,通过重构动作空间、数据合成与强化学习框架,解决了传统多模态搜索中“串行调用”导致的效率低下问题,实现了单次交互内对图片中多个目标的并发定...AI最新项目4个月前02130
Uni-1.1 – Luma AI推出的企业级图像生成模型及API服务Uni-1.1是由硅谷初创公司Luma AI正式推出的新一代企业级图像生成模型及API服务。 它最大的技术突破在于“换道超车”:抛弃了目前主流的扩散模型,转而采用类似大语言模型的自回归(Autoreg...AI最新项目5个月前02130
TuyaClaw – 涂鸦智能2026年推出的新一代AI助理TuyaClaw是涂鸦智能2026年推出的新一代AI助理。它基于OpenClaw架构,首创打通数字与物理世界,既能操作电脑办公,又能控制智能家居。支持一键部署、微信体验及多模型自由切换,内置3200...AI最新项目6个月前02130