Wan-Dancer – 阿里通义开源的音乐驱动人像舞蹈视频生成模型Wan-Dancer是阿里巴巴通义实验室开源的音乐驱动人像舞蹈视频生成模型,能够生成分钟级、高清晰度且节奏同步的舞蹈视频。它采用分层框架,将生成过程解耦为全局关键帧规划与局部时序优化两个阶段,有效解决...AI最新项目# 大模型3周前0500
StepAmoo – 阶跃星辰研发的新一代个人智能体StepAmoo是阶跃星辰(StepFun)研发的新一代个人智能体,作为STEPX Neo智能体手机的主智能体,定位是操作系统级的原生AI伙伴,而非传统手机中附加的语音助手。它通过深度整合硬件、系统与...AI最新项目3周前0490
干细胞AI模型“归元” – 面向干细胞重编程的AI预测模型干细胞AI模型“归元”是由西湖大学与阿里巴巴达摩院联合开发的面向干细胞重编程的可解释性AI预测模型,通过算法从近400万种小分子药物与生长因子组合中精准筛选最优方案,实现对细胞命运的定向调控,解决了传...AI最新项目# 大模型4周前0840
AnySearch – 专为AI智能体设计的搜索基础设施AnySearch是专为AI智能体(Agent)设计的搜索基础设施,不是返回网页链接,而是直接向Agent提供结构化、可直接用于推理的高质量信息,解决传统搜索引擎无法满足Agent对专业数据、实时性和...AI最新项目4周前0890
PixVerse Game Engine – 一款前沿AI实时生成游戏引擎PixVerse Game Engine是一款前沿AI实时生成游戏引擎,首创机制与表现解耦(MED)架构,依托PixVerseR1实时世界模型,以连续实时视频流替代传统预渲染管线构建完整互动游戏。引擎...AI最新项目4周前0760
DuoMem – 三星研究院联合高校团队提出的轻量化AI模型增强框架DuoMem是由三星研究院联合高校团队提出的轻量化AI模型增强框架,专为解决边缘设备(如家用机器人、IoT设备)上小参数模型(4B-14B)处理复杂任务能力不足的问题。通过双路径知识迁移机制,将大模型...AI最新项目4周前0630
HyOCR-1.5 – 腾讯混元团队开源的端到端多模态OCR大模型HyOCR-1.5是腾讯混元团队开源的端到端多模态OCR大模型,通过一体化架构实现文字检测与识别的联合优化,仅需10亿参数即可覆盖8类以上文档理解任务,在OmniDocBench v1.6基准测试中以...AI最新项目# 大模型4周前0630
Agnes-2.5-Flash – Agnes AI推出的全新文本大模型Agnes-2.5-Flash是Agnes AI推出的全新高性能文本大模型,作为Agnes-2.0-Flash的升级版本,专为开发者与AI Agent工作流设计,在代码理解、工程修复、多步骤任务执行及...AI最新项目# 大模型4周前0990
SenseNova-Vision – 商汤科技发布并全面开源的统一视觉大模型SenseNova-Vision是商汤科技发布并全面开源的统一视觉大模型,将视觉能力原生融入大模型体系,首次实现目标检测、图像分割、深度预测、3D重建等经典视觉任务的单模型统一处理,彻底摒弃传统多模型...AI最新项目# 大模型4周前0620
Step Edge – 阶跃星辰发布的端侧模型全家桶Step Edge是阶跃星辰发布的端侧模型全家桶,包含基础模型、Audio模型、GUI模型和Gen模型四款垂直领域专用模型,目标是让AI智能体(Agent)在手机、汽车等终端设备上实现本地化实时响应与...AI最新项目# 大模型4周前0460
Muse Spark 1.1 – Meta发布的多模态推理模型Muse Spark 1.1是Meta发布的多模态推理模型,专为AI智能体任务设计,通过主-子智能体协作架构实现复杂任务的自动化规划与执行,支持最高100万token上下文长度,在工具调用、跨应用操作...AI最新项目# 大模型4周前0460
QMuse – 蚂蚁集团推出的AI无代码应用生成平台QMuse是蚂蚁集团推出的AI无代码应用生成平台,目前处于内测阶段,仅支持支付宝账号登录。通过自然语言对话实现零代码网页与应用开发,用户只需用一句话描述需求即可生成可运行作品,但所有生成内容若用于商业...AI最新项目4周前0810
DramaClaw – 工业级AI漫剧制作工具DramaClaw(中文名“虾导”)是成都新飞翔科技集团自主研发的工业级AI漫剧智造工具,角色、场景和叙事风格的高度一致性,实现“创意决定高度”的创作平权目标。将AI漫剧生产从“抽卡式随机生成”升级为...AI最新项目4周前0560
SeFi-Image – 基于语义优先扩散开源文本到图像生成模型SeFi-Image是基于"语义优先扩散"技术的开源文本到图像生成模型,通过分离语义与纹理生成流程,在仅需Z-Image约10%-20%训练成本(5B模型125K A800 GPU小时)的前提下,实现...AI最新项目4周前0650
Kimi K2.7 Code高速版 – 月之暗面在基础上推出的加速推理版本Kimi K2.7 Code高速版是月之暗面在标准版K2.7 Code编程模型基础上推出的加速推理版本,与标准版使用完全相同的模型架构,但通过工程优化将输出速度提升至标准版的5-6倍,专为需要实时响应...AI最新项目# 大模型4周前0490
Agents-A1 – 上海人工智能实验室开源的智能体模型Agents-A1是上海人工智能实验室开源的350亿参数混合专家(MoE)智能体模型,通过"扩展任务处理视野"而非单纯扩大参数规模,使小模型在复杂长程任务中达到接近万亿参数级模型的性能。它专为解决传统...AI最新项目4周前01.6K0
Booster T2 – 加速进化公司发布的具身智能开发旗舰平台Booster T2是加速进化公司发布的具身智能开发旗舰平台,作为当前双足人形机器人领域算力最强的开源开发载体,推动人形机器人从实验室技术验证迈向真实场景规模化应用。该平台通过2070 TFLOPS端...AI最新项目4周前0990
KAT-Coder-Pro V2.5 – 快手发布的旗舰级Agentic Coding模型KAT-Coder-Pro V2.5是快手KwaiKAT团队发布的旗舰级Agentic Coding模型,首次实现国产AI从单点代码补全到端到端跑通完整软件工程任务的突破。该模型通过大规模智能体强化学...AI最新项目# 大模型4周前0750
Kimi信用卡 – 全球首张AI原生信用卡Kimi信用卡是全球首张AI原生信用卡,由月之暗面(Kimi)、中国农业银行与美国运通于2026年7月10日联合发行。将消费行为直接转化为AI生产力资源,用户通过日常刷卡积累的积分可八折兑换Kimi算...AI最新项目4周前0960
LiteRT.js – 谷歌发布的Web端AI推理库LiteRT.js是谷歌发布的高性能Web端AI推理库,通过WebAssembly结合WebGPU/WebNN硬件加速技术,将浏览器中的AI模型推理速度提升至现有方案的3倍,并替代TensorFlow...AI最新项目4周前0580
ChatGPT Work – OpenAI发布的AI智能体产品ChatGPT Work是OpenAI发布的AI智能体产品,由GPT-5.6模型与Codex技术驱动,专为处理跨应用、多步骤的复杂任务设计。无需人工分步指令,可自主拆解目标、调用工具链、持续运行数小时...AI最新项目4周前0550
SensorFM – 谷歌开发的面向可穿戴设备健康数据的AI基础模型SensorFM是谷歌开发的面向可穿戴设备健康数据的通用AI基础模型,通过自监督学习处理20亿小时、500万人的多源生理信号,实现从“记录数据”到“理解身体状态”的关键突破。无需针对单一健康问题单独建...AI最新项目4周前0800
MkSaaS – 一站式AI SaaS全栈开发脚手架/商用模板MkSaaS全称 Make Your AI SaaS Product in a Weekend,是一套基于Next.js 16打造的AI SaaS全栈开发脚手架 / 商用模板,面向独立开发者、小团队...AI最新项目4周前0430
ellyToken – 阿里推出的AI大模型一站式聚合服务平台ellyToken是阿里生态孵化的空间智能企业"元境"推出的AI大模型一站式聚合服务平台,通过统一入口整合国产主流大模型资源,为企业及开发者提供标准化、可管控的API调用服务。其本质是一个大模型能力中...AI最新项目4周前0520
Seedream 5.0 Pro – 字节跳动发布的多模态图像创作模型Seedream 5.0 Pro是字节跳动Seed团队发布的多模态图像创作模型,作为Seedream 5.0预览版(2月上线)的重大升级版本,从“单次生成可用图像”转向“支持全流程设计生产”,重点强化...AI最新项目4周前0690
LingBot-Video – 蚂蚁开源的面向具身智能视频生成基础模型LingBot-Video是蚂蚁灵波科技开源的面向具身智能(Embodied AI)的视频生成基础模型,采用Mixture-of-Experts(MoE)架构设计,目标是解决传统视频生成模型在物理规律...AI最新项目# 大模型4周前0610
Robostral Navigate – Mistral AI发布的具身导航大模型Robostral Navigate是法国AI公司Mistral AI发布的具身导航大模型,参数量仅80亿(8B)。仅依赖单个普通RGB摄像头,即可在复杂环境中实现高精度自主导航,无需深度传感器或激光...AI最新项目# 大模型4周前0620
GPT-Live – OpenAI推出的新一代全双工语音交互模型GPT-Live是OpenAI推出的新一代全双工语音交互模型,作为ChatGPT语音功能的第三代升级,目标是彻底消除传统AI语音交互的机械感,实现接近真人对话的自然流畅体验。它通过全双工架构实现边听边...AI最新项目1个月前0880
Grok 4.5 – SpaceXAI发布的新一代闭源大语言模型Grok4.5是SpaceXAI(原xAI,2026年初并入SpaceX)发布的新一代闭源大语言模型,专为编程与智能体任务优化,以约80%的顶尖模型能力水平,实现仅25%左右的使用成本。其技术突破主要...AI最新项目1个月前0750
LingBot-VLA 2.0 – 蚂蚁灵波科技开源的新一代具身智能基座模型LingBot-VLA 2.0是蚂蚁灵波科技开源的新一代具身智能基座模型,作为机器人领域的“通用大脑”,通过6万小时高质量真实物理数据训练,首次实现对20多种不同构型机器人的统一控制能力,显著提升了双...AI最新项目# 大模型4周前0550