文明旁观者的头像

文明旁观者

帅气的我简直无法用语言描述!
DeepSeek-V4-Flash正式版 – DeepSeek推出的API公测模型

DeepSeek-V4-Flash正式版 – DeepSeek推出的API公测模型

DeepSeek-V4-Flash正式版是DeepSeek推出的API公测模型,作为V4系列的经济高效版本,在保持原有架构(2840亿总参数/130亿激活参数)不变的前提下,仅通过后训练优化,显著提升...
文明旁观者的头像6天前
0250
腾讯AI软件叫什么(腾讯AI工具汇总一览)

腾讯AI软件叫什么(腾讯AI工具汇总一览)

腾讯AI软件叫什么名字?腾讯AI软件不是单一的叫法,而是基于自研混元大模型(Tencent HY) 构建了多款面向不同场景的AI应用产品矩阵。其核心产品分为个人效率工具和企业级解决方案两大类,接下来可...
文明旁观者的头像1周前
0280
coze和workbuddy的区别

coze和workbuddy的区别

coze和workbuddy的区别是什么?很多小伙伴都想了解这两款AI工具,今天我们来详细的说一说,Coze是“造工具的平台”,需用户主动设计AI工作流;WorkBuddy是“直接替你干活的秘书”,用...
文明旁观者的头像1周前
0310
FeyNoBg – Feyn团队发布的开源背景移除模型

FeyNoBg – Feyn团队发布的开源背景移除模型

FeyNoBg是Feyn团队发布的开源背景移除(抠图)模型,基于BiRefNet架构深度优化,参数量263M,在八大主流基准测试中四项登顶SOTA(State-of-the-Art),并配套开源NoB...
文明旁观者的头像1周前
0330
coze是免费的还是收费的

coze是免费的还是收费的

Coze(中文名称“扣子”)采用的是“免费增值+按量计费”的混合模式。对于大多数个人用户和初学者来说,它提供了非常宽裕的免费额度,几乎可以实现“零成本”开发;但对于高频使用者或专业开发者,平台设有明确...
文明旁观者的头像1周前
0290
模型算法原理介绍

模型算法原理介绍

在人工智能技术日新月异的今天,我们每天都在与各种智能助手、聊天机器人打交道。你是否好奇,这些能够流畅对话、写诗作画甚至编写代码的“大模型”,究竟是如何思考的?今天,我们就剥开复杂的数学外衣,用通俗易懂...
文明旁观者的头像1周前
0300
Qwen-Audio-3.0-ASR-Flash-Streaming – 实时流式语音识别服务

Qwen-Audio-3.0-ASR-Flash-Streaming – 实时流式语音识别服务

Qwen-Audio-3.0-ASR-Flash-Streaming是阿里云百炼平台推出的实时流式语音识别服务,基于单模型架构实现300毫秒级超低延迟响应,原生支持中、日、韩、东南亚语言、阿拉伯语及欧...
文明旁观者的头像1周前
0290
K-EXAONE 2.0 – LG AI研究院发布的开源大型人工智能基础模型

K-EXAONE 2.0 – LG AI研究院发布的开源大型人工智能基础模型

K-EXAONE 2.0是LG AI研究院发布的开源大型人工智能基础模型,采用混合注意力专家混合(MoE)架构,总参数规模达7500亿,实际激活参数为370亿,是当前韩国开发规模最大的AI基础模型。该...
文明旁观者的头像1周前
0330
Inkling-Small – Thinking Machines Lab发布的轻量级开源大模型

Inkling-Small – Thinking Machines Lab发布的轻量级开源大模型

Inkling-Small是Thinking Machines Lab发布的轻量级开源大模型,采用混合专家(MoE)架构,总参数276B、激活参数仅12B(约为原版Inkling的四分之一),却在多项...
文明旁观者的头像1周前
0310
Qwen-Audio-3.0-ASR-Filetrans – 阿里巴巴推出的非实时语音识别模型

Qwen-Audio-3.0-ASR-Filetrans – 阿里巴巴推出的非实时语音识别模型

Qwen-Audio-3.0-ASR-Filetrans是阿里巴巴推出的非实时语音识别模型,专为长音频文件离线转写设计,高精度处理12小时以内大体积音频(单文件≤2GB),支持字级时间戳与上下文增强...
文明旁观者的头像1周前
0330