MAI-Voice-2-Flash – 微软推出的超低延迟文本转语音模型MAI-Voice-2-Flash是微软推出的超低延迟文本转语音(TTS)模型,专为高并发实时交互场景设计。以32%的成本降幅实现2倍速度提升(每百万字符15美元),同时保持自然语调与高语音质量,并将...AI最新项目# 大模型2个月前0820
MAI-Image-2.5-Pro – 一款微软自研的图像生成模型MAI-Image-2.5-Pro一款自研AI模型系列中精度最高的图像生成模型,专为企业级高质量图像创作与编辑场景设计。该模型完全基于微软自有清理数据训练,不依赖第三方模型蒸馏,在文字渲染准确性、身份...AI最新项目# 大模型2个月前01000
Cursor Router – Cursor AI代码编辑器内置的智能模型路由系统Cursor Router是Cursor AI代码编辑器内置的智能模型路由系统,能够根据开发任务类型自动匹配最合适的AI模型,在保证代码生成质量的同时显著降低响应延迟与调用成本。将“模型选择”从开发者...AI最新项目2个月前01180
StoryKit – Meta推出的AI儿童故事创作应用StoryKit是Meta推出的AI儿童故事创作应用,专为家长设计,通过拍照定制角色、选择场景与价值观主题,自动生成个性化儿童故事,无需家长手动编写内容,同时内置安全过滤机制且无社交功能,旨在辅助而非...AI最新项目2个月前0970
CodeBuddy NPC – 腾讯云发布的云端研发智能体CodeBuddy NPC是腾讯云发布的云端研发智能体,让AI直接融入企业研发流程,成为能自主交付成果的“AI原住民”,而非仅辅助编写代码的工具。开发者只需下达目标,NPC即可自主完成从任务规划、编码...AI最新项目2个月前0920
GΞLIX 1 SoC – Acrab发布的首款面向边缘AI终端GΞLIX 1 SoC是初创公司Acrab发布的首款面向边缘 AI 终端的系统级芯片,支持 1000 亿参数(100B)规模大模型在本地设备高效运行,无需依赖云端算力即可完成复杂 AI 任务。该芯片通...AI最新项目2个月前01030
Mage-Flow – 微软推出的专注于图像生成与编辑的模型Mage-Flow是微软推出的Mage多模态模型家族中专注于图像生成与编辑的模型。它是一款高效的、原生分辨率的基础模型,专为文本生成图像和指令驱动的图像编辑任务而设计。 Mage-Flow核心特点 轻...AI最新项目# 大模型2个月前01150
OpenAI Presence – OpenAI推出的企业级AI智能体管理平台OpenAI Presence是OpenAI推出的企业级AI智能体管理平台,帮助企业将AI智能体深度集成至核心业务流程,而非仅提供基础模型调用服务。解决企业“有模型但难落地”的痛点,通过预置业务场景适...AI最新项目2个月前01330
Fugu Cyber – Sakana AI发布的网络安全专用多智能体编排模型Fugu Cyber是日本AI公司Sakana AI发布的网络安全专用多智能体编排模型,通过动态调度多个专家模型协同工作,在网络安全领域关键基准测试中超越GPT-5.5-Cyber等通用旗舰模型。它并...AI最新项目# 大模型2个月前0720
暑期AI通识课 – 专为假期设计的轻量化人工智能普及课程暑期AI通识课是专为假期设计的轻量化人工智能普及课程,通过实践导向的短周期学习,帮助学生快速建立AI基础认知与应用能力。按学段分层设计、强调“做中学”、结合假期场景灵活开展,既避免传统课堂的理论灌输...AI最新项目2个月前01140
Gemini 3.5 Flash-Lite – 谷歌发布的专为高频任务设计的轻量级AI模型Gemini 3.5 Flash-Lite是谷歌发布的专为高频任务设计的轻量级AI模型,以极低成本实现超高吞吐量执行,尤其适合智能体(Agent)工作流中的子任务处理。其最大特点是输出速度达350 t...AI最新项目# 大模型2个月前0960
Gemini 3.5 Flash Cyber – 专为网络安全场景微调的轻量级AI模型Gemini 3.5 Flash Cyber是谷歌发布的专为网络安全场景微调的轻量级AI模型,以更低成本高效发现并修复软件安全漏洞。该模型并非独立开放服务,而是深度集成于谷歌的代码安全智能体平台Cod...AI最新项目# 大模型2个月前01180
Gemini 3.6 Flash – 谷歌DeepMind发布的效率型大语言模型Gemini 3.6 Flash是谷歌DeepMind发布的效率型大语言模型,定位为代码、知识工作与多模态任务的高性价比解决方案。以更低成本实现更强能力:输出Token价格从3.5 Flash的9美元...AI最新项目# 大模型2个月前01340
GenCeption – 谷歌DeepMind发布的通用视觉模型GenCeption是谷歌DeepMind发布的通用视觉模型,通过逆向改造视频生成模型,实现单模型统一完成深度估计、图像分割、3D姿态估计等五类核心视觉任务。仅用7500段合成视频训练,即可通过文本指...AI最新项目# 大模型2个月前01320
vivago R1 – 智象未来发布的视频生成与编辑的多模态创作智能体vivago R1是智象未来发布的全球首款支持无限时长视频生成与编辑的多模态创作智能体。它通过多智能体协同架构和自研操作系统,突破了行业长期存在的15-30秒时长限制,首次实现从单点素材生成到全链路长...AI最新项目2个月前01490
LoHoSearch – 美团发布的高难度搜索智能体评测基准LoHoSearch是美团LongCat团队发布的高难度搜索智能体评测基准,旨在突破传统人工构建评测的难度上限,通过基于762万实体维基百科知识图谱的自动化题目生成,系统性控制"搜索空间"与"结构复杂...AI最新项目2个月前01510
Audio-Visual Flamingo – NVIDIA等推出的全开源音视频大语言模型Audio-Visual Flamingo(简称 AVF)是 NVIDIA Nemotron Labs 联合马里兰大学推出的全开源音视频大语言模型(AV-LLM),专门实现音频、图像、长视频的联合感知...AI最新项目# 大模型2个月前01320
TuringViT – 小鹏集团发布的高效视觉编码器TuringViT是小鹏集团发布的高效视觉编码器,作为面向VLM/VLA(视觉-语言-动作)时代的物理AI统一感知底座,通过线性注意力架构、精细化数据治理与原生动态分辨率训练,以仅10%的训练数据量实...AI最新项目2个月前01310
Matrix -Game3.5 – Skywork团队发布的开源多模态世界模型Matrix-Game 3.5是昆仑万维旗下Skywork团队发布的开源多模态世界模型,实现Patch级空间记忆机制与单卡实时交互能力,使AI能生成具有物理因果一致性的可交互虚拟世界。它标志着世界模型...AI最新项目# 大模型2个月前01810
Hyra-1.0 – 腾讯混元团队推出的科学发现智能体Hyra-1.0(Hunyuan Research Agent)是腾讯混元团队推出的科学发现智能体,实现递归自我改进能力,能够通过自博弈、自评价和用户反馈驱动的闭环机制,在科研与工程任务中持续自主优化...AI最新项目2个月前01220
MiniCPM-RobotTrack – 视觉-语言-动作(VLA)跟踪导航模型MiniCPM-RobotTrack是面壁智能发布的具身智能系列模型中的轻量级端到端视觉-语言-动作(VLA)跟踪导航模型,专为机器人目标跟踪与自主导航设计。实现无网环境下的纯本地化实时跟踪能力,仅需...AI最新项目# 大模型2个月前01500
MiniCPM-RobotManip – 开源通用视觉-语言-动作(VLA)模型MiniCPM-RobotManip是面壁智能发布的开源通用视觉-语言-动作(VLA)模型,参数规模仅1.5B,但通过视觉Token极致压缩和流式上下文管理技术,实现了机器人领域关键的长时记忆能力突破...AI最新项目# 大模型2个月前01010
Qwen-Audio-3.0-TTS – 阿里通义发布的新一代实时语音合成大模型Qwen-Audio-3.0-TTS是阿里巴巴通义实验室发布的新一代实时语音合成大模型,包含面向实时交互的Flash版本(首包延迟约300毫秒)和面向高质量生成的Plus版本。该模型在全球第三方权威榜...AI最新项目# 大模型2个月前01480
MiniCPM-Robot – 面壁智能发布的开源具身智能系列模型MiniCPM-Robot是面壁智能发布的开源具身智能系列模型,包含视觉-语言-动作模型(MiniCPM-RobotManip)和跟踪导航模型(MiniCPM-RobotTrack)两款核心产品。该系...AI最新项目# 大模型2个月前01110
神珍 – 上海科学智能研究院发布的科学多模态基础模型“神珍”(Monkey King Bang, MKB)是上海科学智能研究院发布的科学多模态基础模型,总参数量约110亿,专为统一处理DNA、RNA、蛋白质、小分子、地球系统和医学影像六类科学数据而设计...AI最新项目# 大模型2个月前0970
MiniCPM5-2B – 面壁智能发布的20亿参数规模端侧大语言模型MiniCPM5-2B是面壁智能联合OpenBMB发布的20亿参数规模端侧大语言模型,在Artificial Analysis(AA)权威榜单中以17分成绩登顶全球4B以下模型榜首,成为当前同级参数规...AI最新项目# 大模型2个月前01060
Tempolor v4.7 – 趣丸科技发布的天谱乐大模型最新版本Tempolor v4.7是趣丸科技在世界人工智能大会(WAIC)发布的天谱乐大模型最新版本,将AI音乐创作从“单次生成结果”升级为支持深度二次创作的工具。该版本不再仅追求“能否生成一首歌”,而是聚焦...AI最新项目# 大模型2个月前0990
HappyOyster 1.0 – 阿里发布的可实时交互的开放式世界模型HappyOyster 1.0(快乐生蚝1.0)是阿里巴巴ATH创新事业部发布的可实时交互的开放式世界模型产品,将AI从“生成静态内容”升级为“模拟可操控的动态数字世界”。用户仅需一句话或一张图即可生...AI最新项目# 大模型2个月前01250
秒哒3.5 – 百度发布的对话式无代码应用开发平台新版本秒哒3.5是百度发布的对话式无代码应用开发平台新版本,让用户无需任何编程基础,仅通过自然语言描述需求即可完成应用开发、部署、运营及商业变现的全流程。将AI应用开发门槛降至全民可参与水平,8岁儿童也能独...AI最新项目2个月前01010
Qwen3.8-Max-Preview – 千问推出的2.4万亿参数旗舰大模型预览版Qwen3.8-Max-Preview是阿里通义千问系列推出的2.4万亿参数旗舰大模型预览版,定位为当前综合能力仅次于Fable 5的顶级开源模型之一。通过超大规模参数与创新架构设计,显著提升复杂任务...AI最新项目# 大模型2个月前0960