新CosyVoice Studio – 阿里推出的国内一站式AI语音生产力平台CosyVoice Studio是阿里巴巴于2026年8月7日正式推出的国内首个一站式AI语音生产力平台。该平台基于阿里自研语音大模型 Qwen-Audio 打造,在全球权威AI评测平台 Artifi...AI最新项目16小时前0100
新WeatherNext – 谷歌推出的AI天气预报模型家族WeatherNext是由 Google DeepMind 与 Google Research 联合开发的 AI 天气预报模型家族,是目前全球最先进的数据驱动天气预报系统之一。该模型家族经历了多代迭代...AI最新项目16小时前080
新SALMONN-2 – 字节跳动联合清华推出的开源听觉大语言模型SALMONN-2是字节跳动联合清华大学推出的开源通用听觉多模态大语言模型,属于 SALMON 系列第二代音频理解底座。它主打全品类音频统一理解,可处理语音、环境音效、音乐、副语言信号,依托自研 SP...AI最新项目16小时前080
新Neon 4B – 智能体式检索任务的模型训练方案及后训练模型Neon 开源 4B 模型是由 Neon(云原生 Serverless PostgreSQL 数据库公司)与 Castform(AI 语音智能体与模型训练平台)于 2026年8月6日联合发布的一套面向...AI最新项目23小时前0110
新Wan3.0 – 阿里巴巴通义万相团队研发的新一代视频生成大模型Wan3.0(万相3.0)是阿里巴巴通义万相团队研发的新一代视频生成大模型,于2026年8月6日正式开启公测。作为Wan系列的第三代核心版本,它在生成时长、多模态输入、画面真实感和跨帧一致性四大维度实...AI最新项目# 大模型1天前0140
新Muse Code – Meta推出的首款AI编程智能体Muse Code 是 Meta(前 Facebook)正式推出的首款 AI 编程智能体(Coding Agent),目前处于公开测试阶段(Beta)。该产品由 Meta 超级智能实验室负责人 Ale...AI最新项目1天前0100
新Hunyuan3D-Buffalo 1.0 – 腾讯混元研发的多模态3D大模型框架Hunyuan3D-Buffalo 1.0是由腾讯混元3D团队研发的一款统一的多模态 3D 大模型框架。将 3D 内容的理解、生成和编辑三大核心能力整合到了一个统一的模型中,实现了通过自然语言与 3D...AI最新项目1天前0110
新InstructAV2AV – 智源人工智能联合北大开源的音视频联合编辑模型InstructAV2AV是由北京智源人工智能研究院与北京大学联合团队提出的音视频联合编辑模型,通过单句自然语言指令实现画面与声音的同步编辑,而非传统“先改画面再补声音”的级联流程。该技术将音视频编辑...AI最新项目2天前0160
新Alpamayo 2 Super – 英伟达开源视觉-语言-动作推理模型Alpamayo 2 Super 是英伟达(NVIDIA)发布的一款320亿参数开放视觉-语言-动作推理模型(Reasoning VLA)。它由英伟达创始人兼CEO黄仁勋亲自揭幕,是Alpamayo系...AI最新项目# 大模型2天前0150
新LFM2.5-2.6B – Liquid AI发布的一款开源端侧智能体模型LFM2.5-2.6B是由人工智能初创企业Liquid AI于2026年8月5日正式发布的一款开源端侧智能体模型。该模型隶属于 Liquid AI 的 Liquid Foundation Models...AI最新项目# 大模型2天前0160
新SeedRealtime – 字节Seed团队发布的原生音视频全双工大模型SeedRealtime是字节跳动Seed团队于2026年8月5日正式发布的原生音视频全双工大模型。该模型采用统一端到端架构,将音频、视频与文本原生融合,能够在连续多模态信息流上进行实时交互,官方将其...AI最新项目# 大模型3天前0190
新JoyAI-Video-Edit – 京东开源自研的实时流式视频编辑模型JoyAI-Video-Edit是京东探索研究院于2026年8月5日正式开源自研的实时流式视频编辑模型。该模型于2026年7月18日在世界人工智能大会(WAIC)上首次亮相,8月5日在 Hugging...AI最新项目# 大模型3天前0200
新MAGI-2 Preview – Sand.ai发布并开源的统一音视频生成模型MAGI-2 Preview是北京AI视频生成创企Sand.ai(清华系团队)正式发布并开源的统一音视频生成模型。该模型总参数约114B(千亿级),采用MoE(混合专家)架构,单次前向计算仅激活约6B...AI最新项目# 大模型3天前0180
新Shieldstral – Mistral AI发布的开源多模态内容安全审核模型Shieldstral是Mistral AI发布的开源多模态内容安全审核模型(Shieldstral 1.0-3B)。这是一款仅30亿参数的多模态内容安全分类器,已在 Hugging Face 以Ap...AI最新项目# 大模型3天前0140
新Qwen-CUA – 阿里巴巴通义实验室推出的原生计算机使用智能体框架Qwen-CUA是阿里巴巴通义实验室推出的原生计算机使用智能体(Computer-Use Agent, CUA)框架,其核心能力是让大模型直接通过视觉感知屏幕界面,像人类一样操作鼠标键盘完成跨应用任务...AI最新项目3天前0170
新MemHarness – 上海AI Lab团队及其合作者推出的智能体记忆重构框架MemHarness 是由上海人工智能实验室(Shanghai AI Lab)团队及其合作者提出的一种“LLM Agent 经验重构”框架。其核心目标是让 AI 智能体(Agent)的记忆机制像人类一...AI最新项目3天前0170
新Orchard – 微软研究院开源的一个用于训练和评估AI智能体的框架Orchard 是微软研究院开源的一个用于训练和评估AI智能体(Agentic AI)的框架。它旨在解决当前智能体研究中普遍存在的基础设施壁垒,通过提供一个可复用、轻量级的环境服务,让研究人员能够以更...AI最新项目3天前0170
新Hy ASR 3.0 Preview – 腾讯混元发布的新一代语音识别模型Hy ASR 3.0 Preview是腾讯混元发布的新一代语音识别(ASR)模型。它基于腾讯最新一代大语言模型 Hy3的语言理解能力,将高精度语音识别与深度语义理解深度融合,标志着语音识别从传统的"逐...AI最新项目# 大模型3天前0170
新E-Bench – 腾讯混元团队等推出的智能体评测基准E-Bench是腾讯混元团队联合清华、东南高校推出的全合成式多步骤工具智能体评测基准,专门针对大模型智能体多轮、带状态变更、长链路工具调用能力做标准化测评,区别于仅测试单次 API 调用的传统基准。整...AI最新项目4天前0220
新MAI Realtime – 微软正在测试的首款原生实时语音交互模型MAI Realtime是微软(Microsoft AI)正在测试的首款原生实时语音交互模型,于2026年8月初被媒体曝光。它属于微软自研MAI(Microsoft AI)系列模型家族中的语音交互产品...AI最新项目# 大模型4天前0260
新MindMemOS – 华为诺亚方舟实验室开源的面向智能体记忆操作层MindMemOS是华为诺亚方舟实验室开源的、面向 AI Agent(智能体)的可迁移、自演进记忆操作层(Memory Operating Layer)。它借鉴了传统操作系统管理内存资源的思路,把"记...AI最新项目4天前0210
新GenOffice – Genspark发布的AI原生本地办公客户端GenOffice是由Genspark发布的 AI 原生(AI-Native)本地办公客户端,完全免费、开源且无广告,解决 AI 生成内容与办公文档“可交付成品”之间的格式断层问题。它通过 AI 生成...AI最新项目4天前0230
新SenseNova U1.5-Lite-Preview – 轻量级统一多模态模型预览版本SenseNova U1.5-Lite-Preview是商汤科技正式面向社区开源发布的轻量级统一多模态模型预览版本。它并非简单的模型规模升级,而是基于今年4月发布的SenseNova U1进行的一次系...AI最新项目# 大模型5天前0260
新HOST框架 – 自变量机器人开源发布的技能获取技术HOST框架是由中国具身智能企业自变量机器人于2026年8月3日开源发布的技能获取技术,全称为Human-to-robot One-Shot Skill Acquisition(人类到机器人单样本技能...AI最新项目5天前0280
新Qwen3.8-Max – 阿里正式发布的2.4万亿参数旗舰级大语言模型Qwen3.8-Max是阿里巴巴于2026年8月3日正式发布的2.4万亿参数旗舰级大语言模型,能独立完成需数天周期的完整工程和跨应用全流程办公任务,实现从“工具辅助”到“自主交付成果”的能力跃迁。该模...AI最新项目# 大模型5天前0280
新万有无界 – 阿里万有无界企业级人与AI智能体协作平台万有无界是阿里云正在内测的企业级人与AI智能体(Agent)协作平台,核心通过自动组建多角色数字员工团队,围绕复杂项目实现端到端协同交付,而非提供零散建议。将传统单智能体交互升级为多智能体分工协作模式...AI最新项目5天前0250
新PicsetAI – 电商领域的专业AI视觉生成工具PicsetAI是面向电商领域的专业AI视觉生成工具,主打商品图片批量制作与风格复刻。仅需上传产品实拍图,AI 自动识别产品特征,批量生成主图、场景图与整套详情素材。支持复刻爆款版式配色,重塑专业棚拍...AI最新项目5天前0210
新普罗米修斯 – Majestic Labs发布的AI服务器产品普罗米修斯是初创公司Majestic Labs于2026年8月2日发布的AI服务器产品,突破超大规模AI模型推理中的“内存墙”瓶颈。其最大特点是单机支持8TB–128TB LPDDR6内存,远超英伟达...AI最新项目6天前0240
新DeepSeek-V4-Flash正式版 – DeepSeek推出的API公测模型DeepSeek-V4-Flash正式版是DeepSeek推出的API公测模型,作为V4系列的经济高效版本,在保持原有架构(2840亿总参数/130亿激活参数)不变的前提下,仅通过后训练优化,显著提升...AI最新项目# 大模型6天前0240
新coze和workbuddy的区别coze和workbuddy的区别是什么?很多小伙伴都想了解这两款AI工具,今天我们来详细的说一说,Coze是“造工具的平台”,需用户主动设计AI工作流;WorkBuddy是“直接替你干活的秘书”,用...AI最新项目7天前0300