Gemini-SQL2 – 谷歌发布的专用文本转SQL(Text-to-SQL)模型Gemini-SQL2是谷歌发布的专用文本转SQL(Text-to-SQL)模型,基于Gemini 3.1 Pro深度优化,在权威评测基准BIRD上以80.04%的执行准确率登顶单模型榜单。通过自然语...AI最新项目3个月前01540
Claude Opus 4.7 – Anthropic推出的旗舰级大语言模型Claude Opus 4.7是Anthropic推出的旗舰级大语言模型,作为当时公开可用的最强代码与多模态模型,将AI从“对话助手”升级为“可自主执行复杂任务的智能体”。Claude Opus 4...AI最新项目2个月前01540
Qwen2.5-7B – 阿里云通义千问系列开源大语言模型Qwen2.5-7B是阿里云通义千问系列推出的76.1亿参数开源大语言模型,核心特点为支持131.072 tokens超长上下文、原生结构化输出能力及显著提升的数学与编程性能,适用于需平衡推理成本与专...AI最新项目# 大模型2个月前01540
InsForge – 专为AI编码智能体打造的一站式开源后端平台InsForge是一个专为AI编码智能体(AI Coding Agents)量身打造的一站式开源后端平台。InsForge的核心理念是“为智能体开发而构建的后端”,旨在解决当前AI辅助编程(如使用Cu...AI最新项目4个月前01540
Seedream 5.0 Pro – 字节跳动发布的多模态图像创作模型Seedream 5.0 Pro是字节跳动Seed团队发布的多模态图像创作模型,作为Seedream 5.0预览版(2月上线)的重大升级版本,从“单次生成可用图像”转向“支持全流程设计生产”,重点强化...AI最新项目3个月前01530
Microsoft Scout – 微软开发者大会上推出的首款个人AI同事Microsoft Scout是微软开发者大会上推出的首款"真正意义的个人AI同事",具备独立身份、能主动接管高频低价值职场任务的自治式智能体。 深度嵌入Microsoft 365生态,以Teams联...AI最新项目4个月前01530
PixVerse Game Engine – 一款前沿AI实时生成游戏引擎PixVerse Game Engine是一款前沿AI实时生成游戏引擎,首创机制与表现解耦(MED)架构,依托PixVerseR1实时世界模型,以连续实时视频流替代传统预渲染管线构建完整互动游戏。引擎...AI最新项目2个月前01520
LingBot-Video – 蚂蚁开源的面向具身智能视频生成基础模型LingBot-Video是蚂蚁灵波科技开源的面向具身智能(Embodied AI)的视频生成基础模型,采用Mixture-of-Experts(MoE)架构设计,目标是解决传统视频生成模型在物理规律...AI最新项目# 大模型2个月前01520
Gemini 3.5 Flash – 谷歌发布的轻量级AI模型Gemini 3.5 Flash是谷歌于2026年5月20日在I/O开发者大会上发布的轻量级AI模型,在保持Flash系列高速响应特性的同时,其智能体与编程能力已全面超越上一代旗舰Gemini 3.1...AI最新项目4个月前01520
小米大模型miloco介绍小米的Xiaomi Miloco(全称Xiaomi Local Copilot,小米本地协同智能助手)是小米发布的一项智能家居未来探索方案。 简单来说,它不是单一的一款硬件,而是一套基于大模型驱动的全...AI最新项目6个月前01520
LoHoSearch – 美团发布的高难度搜索智能体评测基准LoHoSearch是美团LongCat团队发布的高难度搜索智能体评测基准,旨在突破传统人工构建评测的难度上限,通过基于762万实体维基百科知识图谱的自动化题目生成,系统性控制"搜索空间"与"结构复杂...AI最新项目2个月前01510
GenEvolve – 开源图像生成智能体框架GenEvolve是由香港科技大学(广州)、美团、香港科技大学和新加坡国立大学等机构联合提出的开源图像生成智能体框架,将传统“一句话生图”模式升级为可自主调用外部工具、自我进化的多步骤工作流。它通过模...AI最新项目3个月前01510
MotiClaw – 一个本地优先的AI伙伴与智能体控制平台MotiClaw是一个本地优先的AI伙伴与智能体控制平台,理念是“一个人干活,最怕不是忙,是东西太散”。它旨在帮助个人或小团队将散落在微信、飞书、文档、截图等地方的信息和任务收拢起来,通过组建一个本地...AI最新项目3个月前01510
Qwen-Robot Suite – 阿里巴巴发布的千问大模型具身智能模型Qwen-Robot Suite是阿里巴巴于2026年6月16日发布的千问大模型家族首个完整具身智能模型系列,包含Qwen-RobotManip(操作模型)、Qwen-RobotNav(导航模型)和Q...AI最新项目# 大模型2个月前01510
MiniCPM-RobotTrack – 视觉-语言-动作(VLA)跟踪导航模型MiniCPM-RobotTrack是面壁智能发布的具身智能系列模型中的轻量级端到端视觉-语言-动作(VLA)跟踪导航模型,专为机器人目标跟踪与自主导航设计。实现无网环境下的纯本地化实时跟踪能力,仅需...AI最新项目# 大模型2个月前01500
yuxinlu1 Gemma4-12B – 深度微调的本地化专业模型系列yuxinlu1 Gemma4-12B是开发者逯雨鑫基于谷歌官方Gemma4-12B模型深度微调的本地化专业模型系列,主要包括编程专用版(Coder版)和故事创作版(Agentic-Fable版)。通...AI最新项目# 大模型2个月前01500
vivago R1 – 智象未来发布的视频生成与编辑的多模态创作智能体vivago R1是智象未来发布的全球首款支持无限时长视频生成与编辑的多模态创作智能体。它通过多智能体协同架构和自研操作系统,突破了行业长期存在的15-30秒时长限制,首次实现从单点素材生成到全链路长...AI最新项目2个月前01490
百度ai智能报志愿 – 2026年高考季推出的免费志愿填报辅助工具百度AI智能报志愿服务是2026年高考季推出的免费志愿填报辅助工具,通过“AI算法生成+真人专家审核”双轨机制,为考生提供数据驱动且可验证的个性化志愿方案。信息整合与决策辅助工具,而非替代考生自主判断...AI最新项目3个月前01490
MMAE – 腾讯混元联合众多大学机构推出的音频编辑评测基准MMAE是腾讯混元联合上海交通大学、南洋理工大学、天津大学、北京大学、复旦大学等机构推出的全球首个面向自然语言指令驱动音频编辑任务的大规模多任务评测基准。系统性评估AI模型对已有音频进行精准定向编辑的...AI最新项目3个月前01490
LearnBuddy – 腾讯云推出的首款教育行业专用AI智能体平台LearnBuddy是腾讯云推出的首款教育行业专用AI智能体平台,通过“师-生-机”三元协同模式,将AI从单点工具升级为可沉淀知识资产的教育基础设施。它以“专家分身”技术为核心,动态匹配学生需求提供引...AI最新项目3个月前01490
Aholo Viewer – 群核科技开源的3D高斯浏览器Aholo Viewer是群核科技(Manycore)开源的3D高斯浏览器,其核心突破在于无需安装客户端,用户直接通过网页浏览器即可流畅浏览包含10亿级高斯点的城市级超大3D场景。 该技术通过Chun...AI最新项目4个月前01490
Reasonix – 专为DeepSeek模型优化的开源终端AI编程助手Reasonix是一款专为DeepSeek模型深度优化的开源终端AI编程助手,核心通过 "只追加不修改"的会话管理机制实现 90% 以上的缓存命中率,将长会话场景下的 API 成本降低至普通工具的 1...AI最新项目4个月前01490
FLUX 3 – Black Forest Labs发布的多模态基础模型FLUX 3是德国人工智能公司Black Forest Labs发布的全球首个在统一架构下联合训练图像、视频、音频及机器人动作预测的多模态基础模型。通过Self-Flow技术将物理世界的因果逻辑融入生...AI最新项目# 大模型2个月前01480
Qwen-Audio-3.0-TTS – 阿里通义发布的新一代实时语音合成大模型Qwen-Audio-3.0-TTS是阿里巴巴通义实验室发布的新一代实时语音合成大模型,包含面向实时交互的Flash版本(首包延迟约300毫秒)和面向高质量生成的Plus版本。该模型在全球第三方权威榜...AI最新项目# 大模型2个月前01480
Booster T2 – 加速进化公司发布的具身智能开发旗舰平台Booster T2是加速进化公司发布的具身智能开发旗舰平台,作为当前双足人形机器人领域算力最强的开源开发载体,推动人形机器人从实验室技术验证迈向真实场景规模化应用。该平台通过2070 TFLOPS端...AI最新项目2个月前01480
Nano Banana 2(Gemini 3.1 Flash Image)介绍Nano Banana 2是谷歌发布的图像生成模型,其官方技术名称为Gemini 3.1 Flash Image。该模型通过分层生成策略与实时知识整合,在保持接近专业级图像质量的同时,将生成速度提升至...AI最新项目3个月前01480
Gemini 3.5 Live Translate – 谷歌发布的实时语音互译音频模型Gemini 3.5 Live Translate是谷歌发布的实时语音互译音频模型,通过流式处理实现仅数秒延迟的连续语音翻译,同时保留说话者的原始语调、语速和情感特征,使跨语言对话接近真人同传体验。 ...AI最新项目3个月前01480
MaineCoon – 社交互动场景设计的实时音视频自回归世界模型MaineCoon是全球首个专为社交互动场景设计的实时音视频自回归世界模型,由10人中国初创团队Catnip研发,实现音视频流式生成与实时交互的深度融合,彻底解决传统AI视频模型在社交场景中“延迟高...AI最新项目3个月前01470
Webwright – 微软研究院开源的终端原生Web代理框架Webwright是微软研究院开源的终端原生Web代理框架,其核心突破在于 摒弃传统“逐次点击”操作模式,转而让AI模型直接在终端编写Playwright代码控制浏览器。该框架通过将代理与浏览器解耦...AI最新项目4个月前01470
子曰4.0 – 网易有道发布的全模态大模型4.0版本子曰4.0是网易有道发布的全模态大模型4.0版本,同步开源多模态理解模型与TTS语音合成引擎,其中Confucius4-TTS作为业内首个支持14种语言跨语种无口音、且无需参考文本即可完成语音克隆的开...AI最新项目# 大模型2个月前01460