文明旁观者的头像

文明旁观者

帅气的我简直无法用语言描述!
Fugu Cyber – Sakana AI发布的网络安全专用多智能体编排模型

Fugu Cyber – Sakana AI发布的网络安全专用多智能体编排模型

Fugu Cyber是日本AI公司Sakana AI发布的网络安全专用多智能体编排模型,通过动态调度多个专家模型协同工作,在网络安全领域关键基准测试中超越GPT-5.5-Cyber等通用旗舰模型。它并...
文明旁观者的头像2周前
0410
暑期AI通识课 – 专为假期设计的轻量化人工智能普及课程

暑期AI通识课 – 专为假期设计的轻量化人工智能普及课程

暑期AI通识课是专为假期设计的轻量化人工智能普及课程,通过实践导向的短周期学习,帮助学生快速建立AI基础认知与应用能力。按学段分层设计、强调“做中学”、结合假期场景灵活开展,既避免传统课堂的理论灌输...
文明旁观者的头像2周前
0400
Gemini 3.5 Flash-Lite – 谷歌发布的专为高频任务设计的轻量级AI模型

Gemini 3.5 Flash-Lite – 谷歌发布的专为高频任务设计的轻量级AI模型

Gemini 3.5 Flash-Lite是谷歌发布的专为高频任务设计的轻量级AI模型,以极低成本实现超高吞吐量执行,尤其适合智能体(Agent)工作流中的子任务处理。其最大特点是输出速度达350 t...
文明旁观者的头像2周前
0590
Gemini 3.5 Flash Cyber – 专为网络安全场景微调的轻量级AI模型

Gemini 3.5 Flash Cyber – 专为网络安全场景微调的轻量级AI模型

Gemini 3.5 Flash Cyber是谷歌发布的专为网络安全场景微调的轻量级AI模型,以更低成本高效发现并修复软件安全漏洞。该模型并非独立开放服务,而是深度集成于谷歌的代码安全智能体平台Cod...
文明旁观者的头像2周前
0520
Gemini 3.6 Flash – 谷歌DeepMind发布的效率型大语言模型

Gemini 3.6 Flash – 谷歌DeepMind发布的效率型大语言模型

Gemini 3.6 Flash是谷歌DeepMind发布的效率型大语言模型,定位为代码、知识工作与多模态任务的高性价比解决方案。以更低成本实现更强能力:输出Token价格从3.5 Flash的9美元...
文明旁观者的头像2周前
0550
GenCeption – 谷歌DeepMind发布的通用视觉模型

GenCeption – 谷歌DeepMind发布的通用视觉模型

GenCeption是谷歌DeepMind发布的通用视觉模型,通过逆向改造视频生成模型,实现单模型统一完成深度估计、图像分割、3D姿态估计等五类核心视觉任务。仅用7500段合成视频训练,即可通过文本指...
文明旁观者的头像2周前
0390
vivago R1 – 智象未来发布的视频生成与编辑的多模态创作智能体

vivago R1 – 智象未来发布的视频生成与编辑的多模态创作智能体

vivago R1是智象未来发布的全球首款支持无限时长视频生成与编辑的多模态创作智能体。它通过多智能体协同架构和自研操作系统,突破了行业长期存在的15-30秒时长限制,首次实现从单点素材生成到全链路长...
文明旁观者的头像3周前
0550
豆包问答入口

豆包问答入口

在人工智能应用逐渐从“尝鲜”走向“日常”的当下,寻找一个稳定、高效且入口便捷的AI助手,成为了许多用户提升效率的关键。作为字节跳动推出的国民级AI产品,豆包(Doubao)凭借其强大的多模态能力和深度...
文明旁观者的头像3周前
0520
LoHoSearch – 美团发布的高难度搜索智能体评测基准

LoHoSearch – 美团发布的高难度搜索智能体评测基准

LoHoSearch是美团LongCat团队发布的高难度搜索智能体评测基准,旨在突破传统人工构建评测的难度上限,通过基于762万实体维基百科知识图谱的自动化题目生成,系统性控制"搜索空间"与"结构复杂...
文明旁观者的头像3周前
0630
Audio-Visual Flamingo – NVIDIA等推出的全开源音视频大语言模型

Audio-Visual Flamingo – NVIDIA等推出的全开源音视频大语言模型

Audio-Visual Flamingo(简称 AVF)是 NVIDIA Nemotron Labs 联合马里兰大学推出的全开源音视频大语言模型(AV-LLM),专门实现音频、图像、长视频的联合感知...
文明旁观者的头像3周前
0680