MiMo-V2.5-Pro-UltraSpeed – 小米推出的超高速推理模式Xiaomi MiMo-V2.5-Pro-UltraSpeed是小米与TileRT团队联合推出的MiMo-V2.5-Pro模型的超高速推理模式,首次在通用GPU上实现万亿参数模型1000tokens...AI最新项目3个月前01350
新程Alpha – 明日新程公司推出的全球首个端侧认知模型新程Alpha是明日新程(Nextie)公司推出的全球首个端侧认知模型,参数量仅4B(40亿),通过将“知识记忆”与“思考能力”解耦,专注于泛化推理和抽象决策,在群体智能任务中表现等效于GPT-5.4...AI最新项目# 大模型2个月前01350
SeedRealtime – 字节Seed团队发布的原生音视频全双工大模型SeedRealtime是字节跳动Seed团队于2026年8月5日正式发布的原生音视频全双工大模型。该模型采用统一端到端架构,将音频、视频与文本原生融合,能够在连续多模态信息流上进行实时交互,官方将其...AI最新项目# 大模型2个月前01340
Gemini 3.6 Flash – 谷歌DeepMind发布的效率型大语言模型Gemini 3.6 Flash是谷歌DeepMind发布的效率型大语言模型,定位为代码、知识工作与多模态任务的高性价比解决方案。以更低成本实现更强能力:输出Token价格从3.5 Flash的9美元...AI最新项目# 大模型2个月前01340
Grok 4.5 – SpaceXAI发布的新一代闭源大语言模型Grok4.5是SpaceXAI(原xAI,2026年初并入SpaceX)发布的新一代闭源大语言模型,专为编程与智能体任务优化,以约80%的顶尖模型能力水平,实现仅25%左右的使用成本。其技术突破主要...AI最新项目3个月前01340
motion-anything – Open Design推出的对话原生的AI动效引擎motion-anything是nexu.io旗下Open Design家族推出的本地优先、对话原生的AI动效引擎,定位为智能体时代的动效生产层。用户仅需用一句话描述动效需求,AI即可生成带动效的网页...AI最新项目# 大模型2个月前01340
Vidu S1 – 生数科技发布的实时交互的视频生成大模型Vidu S1是生数科技发布的全球首个支持实时交互的视频生成大模型,将视频生成从传统的“单向离线输出”升级为“双向实时对话”,用户可通过语音指令动态控制视频内容走向,实现540P分辨率、25FPS帧率...AI最新项目# 大模型2个月前01340
CatPaw – 美团推出的全场景AI Agent平台CatPaw是美团推出的全场景AI Agent平台,旨在为企业和商家提供开箱即用的AI工作台及企业级Agent开发托管能力,通过将美团本地生活领域的行业知识封装为可复用的智能体,实现业务流程的自动化执...AI最新项目2个月前01330
OpenAI Presence – OpenAI推出的企业级AI智能体管理平台OpenAI Presence是OpenAI推出的企业级AI智能体管理平台,帮助企业将AI智能体深度集成至核心业务流程,而非仅提供基础模型调用服务。解决企业“有模型但难落地”的痛点,通过预置业务场景适...AI最新项目2个月前01330
MiniMax H3 – MiniMax发布的开源通用全模态生成模型MiniMax H3是MiniMax发布的首款开源通用全模态生成模型,将视频生成从单一任务工具升级为商业级生产力工具。它不再区分图片、视频、音频的独立生成任务,而是通过统一理解多模态上下文直接输出连贯...AI最新项目# 大模型2个月前01320
GenCeption – 谷歌DeepMind发布的通用视觉模型GenCeption是谷歌DeepMind发布的通用视觉模型,通过逆向改造视频生成模型,实现单模型统一完成深度估计、图像分割、3D姿态估计等五类核心视觉任务。仅用7500段合成视频训练,即可通过文本指...AI最新项目# 大模型2个月前01320
Audio-Visual Flamingo – NVIDIA等推出的全开源音视频大语言模型Audio-Visual Flamingo(简称 AVF)是 NVIDIA Nemotron Labs 联合马里兰大学推出的全开源音视频大语言模型(AV-LLM),专门实现音频、图像、长视频的联合感知...AI最新项目# 大模型2个月前01320
CosyVoice – 阿里巴巴推出的AI智能输入法CosyVoice 是一款由阿里巴巴推出的新一代 AI 效率助手,本质上是一个智能输入法。它主打“说得随意,写得漂亮”的理念,旨在让用户摆脱键盘束缚,通过自然说话的方式,将口语实时转化为高质量、格式规...AI最新项目3个月前01320
getdesign.md – VoltAgent团队推出的设计规范库getdesign.md 是一个免费开源的大厂设计规范库,把66+知名品牌(Apple、Stripe、Figma、Linear 等) 的设计系统,整理成一份份标准化的DESIGN.md文件,供AI编程...AI最新项目4个月前01320
PilotDeck – 清华大学联合面壁智能开源智能体操作系统PilotDeck是由清华大学THUNLP实验室联合面壁智能、OpenBMB及AI9stars团队开源的智能体操作系统,核心价值在于通过独立工作舱架构、白盒化记忆管理及子代理级智能路由技术,显著降低A...AI最新项目4个月前01320
TuringViT – 小鹏集团发布的高效视觉编码器TuringViT是小鹏集团发布的高效视觉编码器,作为面向VLM/VLA(视觉-语言-动作)时代的物理AI统一感知底座,通过线性注意力架构、精细化数据治理与原生动态分辨率训练,以仅10%的训练数据量实...AI最新项目2个月前01310
MacWhisper 14 – macOS专业级本地语音转录工具MacWhisper 14是由独立开发者Jordi Bruin推出的macOS专业级本地语音转录工具,无需联网、保护隐私的离线 AI 转录解决方案。其最大突破在于深度整合英伟达 Parakeet 模型...AI最新项目2个月前01310
Fusion – OpenRouter平台推出的多模型协同推理技术Fusion是OpenRouter平台推出的多模型协同推理技术,通过并行调用多个大语言模型并智能融合结果,在保持高智能水平的同时显著降低单任务成本。以高性价比模型组合逼近顶级单模型性能(如Kimi K...AI最新项目3个月前01310
MiniMax M3 – MiniMax发布的新一代旗舰通用大模型MiniMax M3是国产大模型公司MiniMax正式发布的新一代旗舰通用大模型。MiniMax M3是国内首个同时集齐“前沿编程与智能体能力、百万级超长上下文、原生多模态”三大核心能力的模型,也是目...AI最新项目# 大模型2个月前01310
dots.tts – 小红书开发并开源的新一代文本转语音基座模型dots.tts 是由小红书(RedNote)AI实验室 rednote-hilab 团队开发并开源的新一代文本转语音(TTS)基座模型,总参数量约20亿(2B),采用全连续端到端自回归架构,摒弃了传...AI最新项目1个月前01300
Qwen3.8-Max – 阿里正式发布的2.4万亿参数旗舰级大语言模型Qwen3.8-Max是阿里巴巴于2026年8月3日正式发布的2.4万亿参数旗舰级大语言模型,能独立完成需数天周期的完整工程和跨应用全流程办公任务,实现从“工具辅助”到“自主交付成果”的能力跃迁。该模...AI最新项目# 大模型2个月前01300
混元1bit – 腾讯混元Hy3旗舰大模型的1比特极致量化版本1bit是腾讯混元Hy3旗舰大模型的1比特极致量化版本(IQ1_M格式),通过梯度量化技术将2950亿参数模型的权重体积从598GB压缩至85.5GiB(缩小6.7倍),实现单张96GB显存显卡即可本...AI最新项目# 大模型2个月前01300
DeepSeek Coder – 深度求索开发的完全开源、免费商用的大模型系列DeepSeek Coder是由杭州深度求索人工智能基础技术研究有限公司开发的完全开源、免费商用的代码大模型系列,专注于代码生成、理解与调试。以高效推理和多语言支持能力打破闭源模型的技术壁垒,在多项代...AI最新项目# 大模型2个月前01300
Khala – 中央音乐学院与清华大学联合研发的音乐生成大模型Khala是中央音乐学院与清华大学联合研发的统一声学Token空间音乐生成大模型,解决AI音乐生成中结构连贯性与音质保真度的矛盾,通过构建跨模态对齐的声学表征体系,实现从深层音乐语义到高质量音频的端到...AI最新项目# 大模型2个月前01300
ForgeTrain – 面壁智能联合清华等全球首个由AI自主编写ForgeTrain是由面壁智能联合清华大学及OpenBMB开源社区发布的全球首个完全由AI自主编写、零人类代码介入的生产级大模型预训练框架。 其核心突破在于AI首次独立完成大模型训练基础设施的端到端...AI最新项目# 大模型2个月前01300
CosyVoice Studio – 阿里推出的国内一站式AI语音生产力平台CosyVoice Studio是阿里巴巴于2026年8月7日正式推出的国内首个一站式AI语音生产力平台。该平台基于阿里自研语音大模型 Qwen-Audio 打造,在全球权威AI评测平台 Artifi...AI最新项目2个月前01290
WITT – 文远知行发布的聚焦物理世界认知的AI基础大模型文远知行发布的 WITT(WeRide World Intelligence Toward Truth) 是全球首个聚焦物理世界认知的AI基础大模型,目标是将真实道路数据转化为可验证、可追溯的物理事实...AI最新项目# 大模型2个月前01290
turbovec – Google算法的开源向量索引库turbovec是基于Google Research TurboQuant算法的开源向量索引库,在不损失召回率的前提下,将向量索引的内存占用压缩至传统方案的 1/8–1/16。通过理论推导预计算最优量...AI最新项目3个月前01290
GPT-Realtime-2 – OpenAI推出的旗舰级实时语音模型GPT-Realtime-2是OpenAI推出的旗舰级实时语音模型。它最大的突破在于,首次将GPT-5级别的推理能力 引入了语音交互领域,让AI语音助手从简单的“问答机器”进化为能处理复杂任务的“智能...AI最新项目5个月前01290
InstructAV2AV – 智源人工智能联合北大开源的音视频联合编辑模型InstructAV2AV是由北京智源人工智能研究院与北京大学联合团队提出的音视频联合编辑模型,通过单句自然语言指令实现画面与声音的同步编辑,而非传统“先改画面再补声音”的级联流程。该技术将音视频编辑...AI最新项目2个月前01280