文明旁观者的头像

文明旁观者

帅气的我简直无法用语言描述!
指令微调是什么意思

指令微调是什么意思

指令微调(Instruction Tuning)是一种针对大语言模型(LLM)的训练技术,通过在预训练模型基础上,使用大量“人类指令-理想响应”对进行监督微调,使模型能精准理解并执行自然语言指令(如...
文明旁观者的头像4周前
0740
HyOCR-1.5 – 腾讯混元团队开源的端到端多模态OCR大模型

HyOCR-1.5 – 腾讯混元团队开源的端到端多模态OCR大模型

HyOCR-1.5是腾讯混元团队开源的端到端多模态OCR大模型,通过一体化架构实现文字检测与识别的联合优化,仅需10亿参数即可覆盖8类以上文档理解任务,在OmniDocBench v1.6基准测试中以...
文明旁观者的头像4周前
0630
Agnes-2.5-Flash – Agnes AI推出的全新文本大模型

Agnes-2.5-Flash – Agnes AI推出的全新文本大模型

Agnes-2.5-Flash是Agnes AI推出的全新高性能文本大模型,作为Agnes-2.0-Flash的升级版本,专为开发者与AI Agent工作流设计,在代码理解、工程修复、多步骤任务执行及...
文明旁观者的头像4周前
01020
SenseNova-Vision – 商汤科技发布并全面开源的统一视觉大模型

SenseNova-Vision – 商汤科技发布并全面开源的统一视觉大模型

SenseNova-Vision是商汤科技发布并全面开源的统一视觉大模型,将视觉能力原生融入大模型体系,首次实现目标检测、图像分割、深度预测、3D重建等经典视觉任务的单模型统一处理,彻底摒弃传统多模型...
文明旁观者的头像4周前
0630
Step Edge – 阶跃星辰发布的端侧模型全家桶

Step Edge – 阶跃星辰发布的端侧模型全家桶

Step Edge是阶跃星辰发布的端侧模型全家桶,包含基础模型、Audio模型、GUI模型和Gen模型四款垂直领域专用模型,目标是让AI智能体(Agent)在手机、汽车等终端设备上实现本地化实时响应与...
文明旁观者的头像4周前
0470
Muse Spark 1.1 – Meta发布的多模态推理模型

Muse Spark 1.1 – Meta发布的多模态推理模型

Muse Spark 1.1是Meta发布的多模态推理模型,专为AI智能体任务设计,通过主-子智能体协作架构实现复杂任务的自动化规划与执行,支持最高100万token上下文长度,在工具调用、跨应用操作...
文明旁观者的头像4周前
0460
用DeepSeek需要关注的:V4来了,旧接口7月24日停用

用DeepSeek需要关注的:V4来了,旧接口7月24日停用

最近DeepSeek出了两件大事,一个好消息一个坏消息,我先说坏消息。 坏消息:旧接口7月24号直接停,没缓冲 咱们现在用的deepseek-chat和deepseek-reasoner这俩老接口,到...
文明旁观者的头像4周前
0630
用Hy3帮我完成了电脑C盘清理,效果还行

用Hy3帮我完成了电脑C盘清理,效果还行

我用Hy3帮我完成了电脑C盘清理 故事是这样的。 昨天晚上我正折腾事儿呢,电脑突然卡得一批。我顺手看了眼C盘,好家伙,150G的盘红了,剩4个G。 4个G。 我当时就愣住了。我明明没往C盘塞过啥大东西...
文明旁观者的头像4周前
0620
QMuse – 蚂蚁集团推出的AI无代码应用生成平台

QMuse – 蚂蚁集团推出的AI无代码应用生成平台

QMuse是蚂蚁集团推出的AI无代码应用生成平台,目前处于内测阶段,仅支持支付宝账号登录。通过自然语言对话实现零代码网页与应用开发,用户只需用一句话描述需求即可生成可运行作品,但所有生成内容若用于商业...
文明旁观者的头像4周前
0810
DramaClaw – 工业级AI漫剧制作工具

DramaClaw – 工业级AI漫剧制作工具

DramaClaw(中文名“虾导”)是成都新飞翔科技集团自主研发的工业级AI漫剧智造工具,角色、场景和叙事风格的高度一致性,实现“创意决定高度”的创作平权目标。将AI漫剧生产从“抽卡式随机生成”升级为...
文明旁观者的头像4周前
0560