StepAudio 2.5 ASR – 阶跃星辰发布的新一代自动语音识别模型StepAudio 2.5 ASR是阶跃星辰正式发布的新一代自动语音识别模型。该模型的核心突破在于率先将大语言模型的推理加速技术引入语音识别领域,通过架构创新,在大幅提升转写精度的同时,实现了推理速度...AI最新项目4个月前01650
DeepSeek-V4 – 深度求索正式发布的新一代大模型系列预览版DeepSeek-V4是深度求索(DeepSeek)正式发布的新一代大模型系列预览版,标志着国产大模型在性能、成本和自主可控生态上迈出了关键一步。它并非单一模型,而是包含两个版本,并以其百万级上下文...AI最新项目4个月前01650
GPT-5.5 – OpenAI正式发布的最新、最智能的AI模型GPT-5.5是OpenAI正式发布的最新、最智能的AI模型。它被定位为“为真实工作而生的一类新智能”,标志着 AI 从“能回答问题”向“能自主完成复杂任务”的重大转变。 GPT-5.5核心突破 GP...AI最新项目4个月前01590
Kimi K2.6 – 月之暗面发布的最新旗舰级人工智能模型Kimi K2.6是月之暗面(Moonshot AI)发布的最新旗月之暗面舰级人工智能模型,并已在发布时同步开源。它在代码编写、长程任务执行及智能体(Agent)集群能力上实现了全面升级,旨在对标GP...AI最新项目4个月前01330
AgentScope Tuner – 为智能体应用打造的一站式自动优化引擎AgentScope Tuner是阿里通义实验室推出的、专为智能体(Agent)应用打造的一站式自动优化引擎。 它的核心目标是解决Agent开发中“训练效果好,但上线效果差”的难题,通过一个统一的平台...AI最新项目4个月前01450
HyperFrames – HeyGen开源的面向AI智能体视频渲染框架HyperFrames是由AI视频平台HeyGen在2026年4月开源的一个面向AI智能体(AI Agent)的视频渲染框架。 它的核心理念非常颠覆:“写HTML就能做视频”。 简单来说,它让开发者...AI最新项目4个月前01650
Qwen3.6-Max-Preview – 阿里通义千问系列当前最强旗舰预览版Qwen3.6-Max-Preview(2026年4月20日发布)是阿里通义千问系列当前最强旗舰预览版,定位企业级与开发者高要求场景,在智能体编程、世界知识、指令遵循三大核心能力上全面超越Qwen3...AI最新项目4个月前01590
Audio Flamingo Next – 深度解析NVIDIA开源的AF-Next架构与能力Audio Flamingo Next (AF-Next) 是由 NVIDIA(英伟达)与马里兰大学研究团队在2026年4月联合发布的最新开源大型音频语言模型(LALM)。 它是Audio Flami...AI最新项目4个月前01360
Qwen2.5-VL – 通义千问团队发布的旗舰级视觉语言模型Qwen2.5-VL 是阿里巴巴通义千问团队发布的旗舰级视觉语言模型(Vision-Language Model),它在多模态理解、精确目标定位、文档解析和长视频理解等方面实现了显著的技术飞跃。 核心...AI最新项目4个月前02130
Qwen3.5-Omni – 千问发布的端到端原生全模态大模型Qwen3.5-Omni是阿里巴巴通义千问正式发布的新一代端到端原生全模态大模型。 它打破了传统模型只能处理单一或特定组合模态的限制,实现了文本、图像、音频、视频四种模态的原生统一理解与生成,被誉为...AI最新项目4个月前01590
ERNIE-Image – 百度文心大模型团队开源的一款文生图模型ERNIE-Image是由百度文心大模型团队开发并正式开源的一款高性能文生图模型。它凭借出色的中文理解能力和高效的架构设计,在开源后迅速获得了广泛关注。 ERNIE-Image亮点与性能 在Super...AI最新项目4个月前01430
Marble 1.1 – 李飞飞World Labs公司推出3D世界生成模型系列Marble 1.1是由“AI教母”李飞飞创立的World Labs公司于2026年4月最新推出的3D世界生成模型系列。 它是业界首款商用世界模型Marble的升级版,核心突破在于能够仅凭一张图片,在...AI最新项目4个月前01430
MAI-Image-2-Efficient – 微软推出的一款文生图模型MAI-Image-2-Efficient是微软正式推出的一款低成本、高效率的文生图模型。它是微软旗舰模型 MAI-Image-2 的“轻量化”版本,专为大规模商业量产和严格成本控制的场景设计,旨在以...AI最新项目4个月前01480
Sora 2 – OpenAI发布的新一代视频生成模型Sora 2是由OpenAI发布的新一代视频生成模型。它被官方誉为“视频领域的GPT-3.5时刻”,标志着AI视频生成技术从简单的“视频生成器”进化为能够模拟物理世界的“世界模拟器”。 Sora 2不...AI最新项目4个月前01670
LPM 1.0 – 米哈游蔡浩宇旗下Anuttacon发布的首个视频大模型LPM 1.0 是由米哈游创始人蔡浩宇旗下的AI公司Anuttacon发布的首个视频大模型,全称为Large Performance Model(大型表演模型)。 它的核心突破在于,不再仅仅是生成一段...AI最新项目4个月前01430
FIPO – 阿里巴巴通义最新发布的大模型强化学习算法FIPO是阿里巴巴通义实验室(Qwen Team)最新发布的大模型强化学习算法。 它的全称是Future-KL Influenced Policy Optimization(未来KL散度影响策略优化...AI最新项目4个月前01540
QBotClaw – 腾讯发布的国内首个浏览器AI智能体QBotClaw(中文名:龙虾)是腾讯于正式发布的国内首个浏览器AI智能体(Agent)。 它不是传统意义上的浏览器插件,而是深度集成在QQ浏览器中的智能助手。它的核心突破在于将浏览器从一个“被动展示...AI最新项目4个月前01330
GO-2 – 智元机器人发布的新一代具身智能基座大模型GO-2(全称 Genie Operator-2)是智元机器人(Agibot)发布的新一代具身智能基座大模型。 简单来说,它是机器人的“超级大脑”,旨在解决机器人“脑子懂了但手没跟上”的难题,让机器人...AI最新项目4个月前01480
Seeduplex – 字节跳动发布的原生全双工语音大模型Seeduplex是字节跳动Seed团队2026年4月9日发布的原生全双工语音大模型,已全量上线豆包、抖音App。它突破传统半双工“回合制问答”限制,实现“边听边说”的实时自然交互。通过语音语义联合建...AI最新项目4个月前01950
小米XLA大模型 – 小米智能驾驶领域研发的一款端到端认知大模型小米XLA大模型是小米集团专为智能驾驶领域研发的一款端到端认知大模型,是其HAD(Hyper Autonomous Driving,小米超级智能驾驶)系统的核心技术升级。 它的核心突破在于首次将“辅助...AI最新项目4个月前01430
VoxCPM2 – OpenBMB团队开源的一款语音生成基座模型VoxCPM2 是由面壁智能(OpenBMB)团队开源的一款新一代语音生成基座模型。 如果说上一代 VoxCPM(0.5B)是以“小钢炮”著称的轻量化模型,那么 VoxCPM2 则是全面进化的“全能型...AI最新项目4个月前01350
OpenHarness – 港大开源的一款轻量级AI智能体驾驭框架OpenHarness是由香港大学数据科学研究院(HKUDS)于2026年4月开源的一款轻量级AI智能体驾驭框架(Agent Harness)。 它的核心理念是“模型即智能体,代码即驾驭框架”,旨在为...AI最新项目4个月前01560
Wan2.7-Video – 阿里巴巴发布的一款视频生成系列模型Wan2.7-Video 是阿里巴巴发布的一款视频生成系列模型。它的核心特点是拥有全面的创作控制力,将 AI 的能力从单一的素材生成扩展至“生成、编辑、复刻、重塑”等创作全链路,实现了从被动“演绎”到...AI最新项目4个月前01380
MAI-Transcribe-1 – 微软最新推出的语音转文字模型MAI-Transcribe-1是微软最新推出的一款语音转文字模型。它是微软为了减少对外部供应商(如OpenAI)的依赖,由内部团队自主研发的三款基础AI模型之一。 这款模型主打“全球最高精度”和“高...AI最新项目4个月前01370
Qwen3.6-Plus – 详解阿里最强国产编程大模型Qwen3.6-Plus是阿里巴巴于2026年4月2日发布的新一代大语言模型,也是千问3.6系列的首款产品。它被官方定位为目前国产编程能力最强的模型,整体性能相较于上一代有显著跃升。 简单来说,Qwe...AI最新项目4个月前01700
SenseAudio – 商汤科技推出的一款AI语音开放平台SenseAudio是商汤科技(SenseTime)推出的一款AI语音开放平台。 简单来说,它不仅是一个能帮你“配音”的工具,更是一个集成了语音克隆、音频编辑甚至AI视频创作的全能音频工作站。它最大的...AI最新项目4个月前01710
小米大模型miloco介绍小米的Xiaomi Miloco(全称Xiaomi Local Copilot,小米本地协同智能助手)是小米发布的一项智能家居未来探索方案。 简单来说,它不是单一的一款硬件,而是一套基于大模型驱动的全...AI最新项目4个月前01080
Claude模型介绍Claude是由美国人工智能公司Anthropic开发的一系列大型语言模型。它以强大的逻辑推理、代码能力和卓越的安全性著称,其核心理念是构建“有益、无害、诚实”的 AI。 🏢 开发公司与核心理念 开发...AI最新项目4个月前03290
Lyria 3 Pro – 谷歌推出的旗舰AI音乐生成模型Lyria 3 Pro是谷歌DeepMind于2026年3月25日推出的旗舰AI音乐生成模型,为Lyria 3进阶版。它将生成时长从30秒提升至3分钟,可完整输出带前奏、主歌、副歌的专业曲目,保持24...AI最新项目4个月前01930
TurboQuant – 谷歌全新向量量化算法详解TurboQuant是谷歌研究院(Google Research)于 2026年3月发布的、面向高维向量的无训练、近无损、极低比特向量量化算法,核心用于大语言模型(LLM)的KV缓存压缩与向量数据库检...AI最新项目4个月前01390