Gemma 4 12B – 谷歌DeepMind发布的统一多模态模型Gemma 4 12B是谷歌DeepMind于2026年6月4日发布的120亿参数统一多模态模型,最大突破在于通过无编码器架构实现仅需16GB内存的消费级笔记本即可本地运行完整多模态AI能力(支持文本...AI最新项目2个月前04860
Kimi Work – 月之暗面推出的本地桌面AI智能体Kimi Work是月之暗面推出的本地桌面AI智能体,依托Kimi Code引擎,适配Windows、Mac客户端。依托自然语言下达指令即可自动拆分任务、本地执行操作,支持网页抓取、文件管理、多格式文...AI最新项目2个月前01030
JoyAI-Echo – 京东开源的长音视频生成框架JoyAI-Echo是京东开源的长音视频生成框架,首次系统性解决长视频生成的三大行业难题(角色一致性差、声音不稳定、生成效率低),通过跨模态记忆库、对话式编辑和7.5倍推理加速技术,实现5分钟级长视频...AI最新项目2个月前01920
MAI Transcribe-1.5 – 微软发布的升级版语音转文字(ASR)模型MAI-Transcribe-1.5是微软于2026年6月发布的升级版语音转文字(ASR)模型,作为MAI系列自研模型的重要迭代,在43种语言支持、专业术语识别精度和处理速度上实现突破性提升,批量转录...AI最新项目2个月前01160
Bernini – 字节跳动开源的统一视频生成与编辑框架Bernini是字节跳动于2026年6月正式开源的统一视频生成与编辑框架,首创“语义规划+视觉渲染”的两阶段解耦架构,通过让AI先理解指令逻辑再生成画面,显著提升视频编辑的可控性与稳定性,解决传统模型...AI最新项目2个月前01070
MAI-Voice-2 – 微软发布的新一代自研多语言语音合成模型MAI-Voice-2是微软发布的新一代自研多语言语音合成模型,支持15种以上语言的高自然度语音生成,并首次实现复杂情感语调模拟与短样本声音克隆能力。 其核心突破在于通过端到端神经声学建模,在保证超低...AI最新项目2个月前01020
ECC – 开源的AI Agent性能优化系统ECC(Everything Claude Code)是一个开源的AI Agent性能优化系统,由Anthropic黑客松冠军Affaan Mustafa基于10个月高强度生产环境实践开发,核心目标是...AI最新项目2个月前01200
OpenClacky – 李亚飞团队开源的低成本AI Agent框架OpenClacky是李亚飞团队开源的低成本AI Agent框架,核心目标是通过工程化优化将AI任务执行的Token消耗降至行业最低水平,使专业用户能全天候无负担地运行AI助手。 其关键突破在于通过缓...AI最新项目2个月前0960
语构 – 阿里达摩院上线的零代码AI原生应用开发平台语构是阿里达摩院于2026年6月2日正式上线的零代码AI原生应用开发平台,基于Vibe Coding技术实现“一句话生成完整应用”的能力,支持网页、小程序、互动工具等多元形态开发。 其核心突破在于彻底...AI最新项目2个月前01040
Polar – 英伟达开源的强化学习训练框架Polar是英伟达(NVIDIA)开源的强化学习训练框架,专为解决代码智能体(如Codex、Claude Code、Qwen Code等)接入强化学习时的高成本与信号丢失问题而设计。 其核心突破在于无...AI最新项目2个月前01070
Dubbing v2 – ElevenLabs推出的最新AI配音模型Dubbing v2是ElevenLabs推出的AI配音模型,首次实现 跨语言情感迁移,能够将原始语音中的语调、节奏、停顿、情绪起伏等表演细节完整保留并自然映射到目标语言中。 其核心突破在于 摒弃传统...AI最新项目2个月前01310
Gamma-World – 英伟达与清华大学推出的多智能体世界模型Gamma-World是由英伟达与清华大学团队联合提出的多智能体世界模型,旨在解决传统单智能体世界模型无法模拟多主体在共享环境中交互的核心缺陷。 其核心突破在于通过身份对称性编码和稀疏通信架构,首次实...AI最新项目2个月前01090
Music v2 – ElevenLabs发布的新一代专业级音乐生成模型Music v2是ElevenLabs发布的新一代专业级音乐生成模型,其核心突破在于将AI音乐创作从“抽卡式随机生成”推进到可精准编辑、支持商业落地的工业化阶段。 该模型基于完全授权的数据集训练,生成...AI最新项目2个月前0950
Gemini 3.1 Pro – 谷歌发布的旗舰人工智能基础模型Gemini 3.1 Pro是谷歌(Google)发布的新一代旗舰人工智能基础模型。它定位为一款专为解决复杂问题而生的高阶推理工具,主打深度思考和复杂任务处理。 Gemini 3.1 Pro核心特点与...AI最新项目2个月前01090
Webwright – 微软研究院开源的终端原生Web代理框架Webwright是微软研究院开源的终端原生Web代理框架,其核心突破在于 摒弃传统“逐次点击”操作模式,转而让AI模型直接在终端编写Playwright代码控制浏览器。该框架通过将代理与浏览器解耦...AI最新项目2个月前01150
getdesign.md – VoltAgent团队推出的设计规范库getdesign.md 是一个免费开源的大厂设计规范库,把66+知名品牌(Apple、Stripe、Figma、Linear 等) 的设计系统,整理成一份份标准化的DESIGN.md文件,供AI编程...AI最新项目2个月前0910
美团GEO营销门户 – 美团推出的生成式引擎优化(GEO)平台美团GEO营销门户是美团推出的生成式引擎优化(GEO)平台,助力本地商家在豆包、DeepSeek等主流AI大模型对话中获得更多推荐与曝光。提供策略建议、AI内容生成、多平台监测、效果追踪四大核心能力...AI最新项目2个月前01670
Taste-Skill – 专治AI生成的模板脸UI让AI帮你写个前端页面,它倒是写得挺快,但结果总是那种“标准的、毫无灵魂的”模板脸:居中排版、蓝色按钮、白色背景,要多无聊有多无聊 就像下面这种: 这也不能全怪AI,毕竟训练数据里这种“模板脸”太多了...AI最新项目2个月前01300
Compound Engineering – 这款插件让AI帮你写代码作为一名程序员,你有没有这种感觉——代码越写越多,但脑子越来越不够用? 刚写的代码,过俩月自己都看不懂了;修个bug吧,结果越修越乱;项目越来越大,新人入职完全无从下手……今天给各位介绍一个神器——C...AI最新项目2个月前0970
HeiMaClaw – 黑马程序员推出的一款生产级企业AI Agent平台HeiMaClaw是由黑马程序员推出的一款生产级企业AI Agent平台。与面向个人用户的助手不同,HeiMaClaw的定位非常明确:它是一个企业级基础设施,旨在通过工程化手段(Harness Eng...AI最新项目2个月前01850
阿里云百炼 CLI – 阿里云开源的命令行工具,专为AI Agent设计阿里云百炼CLI是阿里云开源的命令行工具,专为AI Agent设计,一行命令即可接入百炼平台150+模型与全套能力。原生支持多种主流Agent框架,集成多模态调用、知识库、记忆库、联网搜索与文件处理...AI最新项目2个月前01220
PilotDeck – 清华大学联合面壁智能开源智能体操作系统PilotDeck是由清华大学THUNLP实验室联合面壁智能、OpenBMB及AI9stars团队开源的智能体操作系统,核心价值在于通过独立工作舱架构、白盒化记忆管理及子代理级智能路由技术,显著降低A...AI最新项目2个月前0980
Hy-Memory – 腾讯混元推出的长期协作型Agent记忆插件Hy-Memory是腾讯混元推出的、面向长期协作型Agent(如Openclaw)的记忆插件,堪称Agent的“第二大脑”。它采用6层记忆框架、System1/System2双系统与演化链三层核心架构...AI最新项目2个月前01130
Claude Opus 4.8 – Anthropic发布旗舰大语言模型小版本迭代Claude Opus 4.8是Anthropic发布的旗舰大语言模型小版本迭代,核心突破在于显著提升模型诚实性与多智能体协作能力,而非基础架构的颠覆性升级。它在保持与Opus 4.7相同定价的前提下...AI最新项目2个月前01070
Step 3.7 Flash – 阶跃星辰开源的多模态推理模型Step 3.7 Flash是阶跃星辰发布并开源的面向生产级Agent场景优化的多模态推理模型。其核心定位是在速度、成本、任务可靠性与复杂能力之间实现平衡,而非单纯追求参数规模或峰值智能。 该模型采用...AI最新项目2个月前01440
Qwen-Image-Bench – 通义千问团队推出的文生图专用评测基准Qwen-Image-Bench是阿里云通义千问团队推出的文生图专用评测基准,主打创作者视角与专业标准。含1000 个中英双语 prompt,从画质、美学、图文对齐、真实保真、创作生成 5 大维度,设...AI最新项目2个月前01350
Guizang Social Card Skill – 归藏开源的AI图文排版工具Guizang Social Card Skill是由开发者 op7418(归藏)开源的AI图文排版工具,专为小红书、公众号等平台设计,核心目标是通过技术路径规避平台对 AI 生成内容的强制标识要求...AI最新项目2个月前01290
Wall-OSS-0.5 – 自变量机器人团队开源的具身基础模型Wall-OSS-0.5是自变量机器人团队开源的全球首个实现"预训练即可部署"的具身基础模型,无需针对下游任务进行后训练,直接在真实机器人上完成零样本操作任务,其核心突破在于通过技术重构使预训练模型自...AI最新项目2个月前01080
Fara1.5 – 微软研究院发布的浏览器智能体模型系列Fara1.5是微软研究院AI Frontiers实验室发布的浏览器智能体模型系列,专为直接操作真实浏览器界面完成复杂任务而设计,不依赖网页DOM结构或无障碍树,仅通过视觉截图理解界面。 其核心突破在...AI最新项目2个月前01190
MAI-Image-2.5 – 微软发布的最新文本生成图像模型MAI-Image-2.5是微软发布的最新文本生成图像模型,在权威评测平台Arena的文生图排行榜中以1254分位列全球第三,仅次于OpenAI的gpt-image-2. 该模型重点强化了文字渲染能力...AI最新项目2个月前01040