Qwen-VLA – 阿里通义团队最新发布的通用机器人基础模型Qwen-VLA是阿里通义团队最新发布的通用机器人基础模型。 简单来说,如果之前的视觉模型是让AI拥有一双“眼睛”去理解世界,那么Qwen-VLA就是给这双眼睛配上了“灵活的手脚”,让AI不仅能看、能...AI最新项目# 大模型4周前01060
Gemini 3 Flash – 谷歌推出的轻量级多模态大模型Gemini 3 Flash是谷歌推出的轻量级高性能多模态大模型,核心定位是以速度与成本效率为核心优化目标,在保持接近旗舰模型推理能力的同时,响应速度达到前代Gemini 2.5 Pro的3倍,且完成...AI最新项目2个月前01060
LongCat-Flash-Prover – 美团5677亿MoE数学推理大模型详解LongCat-Flash-Prover是美团开源的5677亿参数MoE大模型,专攻复杂数学定理与形式化推理。融合 Lean4 证明器与 AST 校验,严格防幻觉;依托HisPO强化学习稳定长链推导...AI最新项目5个月前01060
OCR 4 – Mistral AI推出的最新文档内容识别模型OCR 4是Mistral AI推出的最新文档内容识别模型,专为高精度、多语言文档处理设计。解决传统 OCR 在复杂文档结构、多语言混排及下游任务适配中的局限性,输出质量经人类评估优于 GPT-5.5...AI最新项目1个月前01050
HiDream-O1-Image-1.5 – 智象未来推出的商用版图像生成模型HiDream-O1-Image-1.5智象未来推出的商用版图像生成模型,在Artificial Analysis全球文生图榜单中评分1265ELO,位列中国第一、全球第二(仅次于OpenAI),采用...AI最新项目# 大模型4周前01050
Gemini 3.5 Live Translate – 谷歌发布的实时语音互译音频模型Gemini 3.5 Live Translate是谷歌发布的实时语音互译音频模型,通过流式处理实现仅数秒延迟的连续语音翻译,同时保留说话者的原始语调、语速和情感特征,使跨语言对话接近真人同传体验。 ...AI最新项目2个月前01050
Kairos-HomeWorld – 大晓机器人发布的全屋三维可交互世界模型Kairos-HomeWorld是大晓机器人联合香港中文大学多媒体实验室、深圳河套学院发布的全球首个全屋三维可交互世界模型,仅需一句文本指令即可生成结构连贯、物理合理且支持物体级交互的完整中国家庭3D...AI最新项目2个月前01050
NVIDIA Nemotron 3 Ultra – 英伟达推出的开源大语言模型NVIDIA Nemotron 3 Ultra是英伟达推出的开源大语言模型旗舰产品,专为长时间运行的AI智能体(Agent)设计,采用 5500亿总参数、550亿活跃参数的混合专家(MoE)架构,在复...AI最新项目1个月前01040
新程Alpha – 明日新程公司推出的全球首个端侧认知模型新程Alpha是明日新程(Nextie)公司推出的全球首个端侧认知模型,参数量仅4B(40亿),通过将“知识记忆”与“思考能力”解耦,专注于泛化推理和抽象决策,在群体智能任务中表现等效于GPT-5.4...AI最新项目# 大模型4周前01040
语构 – 阿里达摩院上线的零代码AI原生应用开发平台语构是阿里达摩院于2026年6月2日正式上线的零代码AI原生应用开发平台,基于Vibe Coding技术实现“一句话生成完整应用”的能力,支持网页、小程序、互动工具等多元形态开发。 其核心突破在于彻底...AI最新项目2个月前01040
MAI-Image-2.5 – 微软发布的最新文本生成图像模型MAI-Image-2.5是微软发布的最新文本生成图像模型,在权威评测平台Arena的文生图排行榜中以1254分位列全球第三,仅次于OpenAI的gpt-image-2. 该模型重点强化了文字渲染能力...AI最新项目2个月前01040
openPangu 2.0 Flash – 华为发布的开源盘古大模型轻量化版本openPangu-2.0-Flash是在华为开发者大会(HDC 2026)发布的开源盘古大模型轻量化版本,采用稀疏专家混合(MoE)架构,总参数量920亿(92B),但推理时仅激活60亿(6B)参数...AI最新项目# 大模型4周前01030
DeepSeek Coder – 深度求索开发的完全开源、免费商用的大模型系列DeepSeek Coder是由杭州深度求索人工智能基础技术研究有限公司开发的完全开源、免费商用的代码大模型系列,专注于代码生成、理解与调试。以高效推理和多语言支持能力打破闭源模型的技术壁垒,在多项代...AI最新项目# 大模型4周前01030
ABot-Earth0.5 – 高德地图发布全球首个3D原生城市世界模型ABot-Earth0.5是高德地图发布的全球首个3D原生城市世界模型,仅需单张卫星图像或文字描述,即可在10分钟内通过消费级GPU生成公里级可编辑3D城市场景。该模型将3D制图成本降至传统方式的百分...AI最新项目# 大模型4周前01030
MMSkills – 上海交通大学与小红书团队研发的多模态技能框架MMSkills是上海交通大学与小红书团队联合研发的多模态技能框架,旨在解决视觉智能体在操作图形界面时因缺乏视觉状态理解而导致的任务失败问题。将程序性知识从纯文本升级为图文结合的动态技能包,使AI能像...AI最新项目1个月前01020
AstraBrain-WBC 0.5 – 银河通用人形机器人通用小脑GPT基础模型AstraBrain-WBC 0.5是银河通用机器人发布的全球首个人形机器人通用小脑GPT基础模型,采用2万小时人类动作数据训练(20亿帧),参数规模达8040万,首次实现人形机器人全身运动控制的零样...AI最新项目2个月前01020
StockBuddy – 腾讯自选股垂直金融AI智能体StockBuddy是腾讯自选股垂直金融AI智能体,接入专业金融数据源,全面覆盖沪深港美全市场行情数据。支持自然语言对话交互,可提供个股深度研究、行业动态解读、大盘走势分析与智能盯盘服务,同步支持模拟...AI最新项目2个月前01020
Seedance 2.0 Fast – 字节跳动为速度与成本平衡设计的中间版本Seedance 2.0 Fast是字节跳动Seedance 2.0系列中专为速度与成本平衡设计的中间版本,生成速度比标准版提升约30%,单秒成本降至0.8元左右(720P规格),较标准版降低约20...AI最新项目2个月前01020
WBench – 首个面向交互式视频世界模型的系统性多轮评测基准WBench是美团LongCat团队与复旦大学联合发布的首个面向交互式视频世界模型的系统性多轮评测基准,首次实现对世界模型在连续交互、多维度能力上的统一量化评估,而非仅关注单次生成的视频质量。当前研究...AI最新项目2个月前01020
Kimi Work – 月之暗面推出的本地桌面AI智能体Kimi Work是月之暗面推出的本地桌面AI智能体,依托Kimi Code引擎,适配Windows、Mac客户端。依托自然语言下达指令即可自动拆分任务、本地执行操作,支持网页抓取、文件管理、多格式文...AI最新项目2个月前01020
MAI-Voice-2 – 微软发布的新一代自研多语言语音合成模型MAI-Voice-2是微软发布的新一代自研多语言语音合成模型,支持15种以上语言的高自然度语音生成,并首次实现复杂情感语调模拟与短样本声音克隆能力。 其核心突破在于通过端到端神经声学建模,在保证超低...AI最新项目2个月前01020
OpenHuman – 本地优先个人AI超级助手OpenHuman是一款真正懂你的“本地优先”个人AI超级助手。它和传统的聊天机器人最大的不同在于,它不是一个被动等待提问的工具,而是一个会主动感知你工作上下文、在后台持续学习和思考的AI智能体(Ag...AI最新项目3个月前01020
Agnes-2.5-Flash – Agnes AI推出的全新文本大模型Agnes-2.5-Flash是Agnes AI推出的全新高性能文本大模型,作为Agnes-2.0-Flash的升级版本,专为开发者与AI Agent工作流设计,在代码理解、工程修复、多步骤任务执行及...AI最新项目# 大模型4周前01010
M-Robots OS 1.0 – 基于开源鸿蒙打造的机器人操作系统M-Robots OS 1.0是中国首个基于开源鸿蒙(OpenHarmony)打造的分布式异构多机协同机器人操作系统,由深圳开鸿数字产业发展有限公司发布通过统一技术底座解决机器人产业长期存在的生态割裂...AI最新项目1个月前01010
PlanningBench – 腾讯混元等联合开源规划能力评测与训练框架PlanningBench是由中国人民大学高瓴人工智能学院与腾讯混元联合开发的开源大模型规划能力评测与训练框架,核心目标是系统化评估和提升AI模型在多约束、多步骤决策任务中的全局规划能力。 其突破性在...AI最新项目2个月前01010
Mellum2 – JetBrains推出的开源混合专家(MoE)模型Mellum2是JetBrains推出的120亿参数开源混合专家(MoE)模型,专为软件工程场景设计,核心目标是通过超低延迟推理与私有化部署能力,解决企业级AI工作流中的实时性与成本瓶颈。 Mellu...AI最新项目# 大模型4周前01010
Keye-VL-2.0-30B-A3B – 快手发布的30B级多模态大模型Keye-VL-2.0-30B-A3B是快手发布的30B级多模态大模型,其核心突破在于首次将DSA机制引入多模态领域,实现256K超长上下文的高效处理能力,并在长视频时序理解任务中达到接近无损的推理精...AI最新项目2个月前01010
Aholo Viewer – 群核科技开源的3D高斯浏览器Aholo Viewer是群核科技(Manycore)开源的3D高斯浏览器,其核心突破在于无需安装客户端,用户直接通过网页浏览器即可流畅浏览包含10亿级高斯点的城市级超大3D场景。 该技术通过Chun...AI最新项目2个月前01010
CloudDM – ClouGence开发的开源数据库统一管理平台CloudDM是由开云集致(ClouGence)开发的开源数据库统一管理平台,基于Apache 2.0协议全面开放所有功能,核心解决多源数据库的查询、变更审批与权限管控问题,支持 30+ 种数据源的统...AI最新项目3个月前01010
谷歌Gemini助手 – 谷歌基于Gemini系列大模型推出的AI助手谷歌Gemini助手是谷歌基于Gemini系列大模型推出的智能AI助手产品,将AI从“问答工具”升级为“任务执行代理”。它通过深度集成谷歌生态,支持多模态交互、跨应用任务自动化及个性化服务,不仅能回答...AI最新项目1个月前01000