最新 最热

【机器学习】Google开源大模型Gemma2:原理、微调训练及推理部署实战

Gemma 是 Google 推出的轻量级、先进的开放模型系列,采用与 Gemini 模型相同的研究成果和技术构建而成。它们是仅使用解码器的文本到文本大型语言模型(提供英语版本),为预训练变体和指令调整变体具有开放权重。Gemma 模型...

2024-08-13
12

【人工智能】Transformers之Pipeline(概述):30w+大模型极简应用

pipeline(管道)是huggingface transformers库中一种极简方式使用大模型推理的抽象,将所有大模型分为语音(Audio)、计算机视觉(Computer vision)、自然语言处理(NLP)、多模态(Multimodal)等4大类,28小类任务(tasks)。共计覆盖32万个...

2024-08-13
20

【人工智能】Transformers之Pipeline(九):物体检测(object-detection)

pipeline(管道)是huggingface transformers库中一种极简方式使用大模型推理的抽象,将所有大模型分为音频(Audio)、计算机视觉(Computer vision)、自然语言处理(NLP)、多模态(Multimodal)等4大类,28小类任务(tasks)。共计覆盖32万个...

2024-08-13
20

【人工智能】Transformers之Pipeline(八):文生图/图生图(text-to-image/image-to-image)

pipeline(管道)是huggingface transformers库中一种极简方式使用大模型推理的抽象,将所有大模型分为音频(Audio)、计算机视觉(Computer vision)、自然语言处理(NLP)、多模态(Multimodal)等4大类,28小类任务(tasks)。共计覆盖32万个...

2024-08-13
20

【人工智能】Transformers之Pipeline(七):图像分割(image-segmentation)

pipeline(管道)是huggingface transformers库中一种极简方式使用大模型推理的抽象,将所有大模型分为音频(Audio)、计算机视觉(Computer vision)、自然语言处理(NLP)、多模态(Multimodal)等4大类,28小类任务(tasks)。共计覆盖32万个...

2024-08-13
23

AIGC时代下的视频创作革命:重塑内容生产格局

在人工智能技术不断突破的今天,AI Generated Content(AIGC)已经成为内容创作领域的一股强大力量。特别是在视频制作方面,AIGC正以其独特的优势,改变着传统视频生产的模式,为创作者和观众带来前所未有的体验。本文将深入探讨...

2024-08-13
7

【人工智能】Transformers之Pipeline(六):图像分类(image-classification)

pipeline(管道)是huggingface transformers库中一种极简方式使用大模型推理的抽象,将所有大模型分为音频(Audio)、计算机视觉(Computer vision)、自然语言处理(NLP)、多模态(Multimodal)等4大类,28小类任务(tasks)。共计覆盖32万个...

2024-08-13
21

【人工智能】Transformers之Pipeline(五):深度估计(depth-estimation)

pipeline(管道)是huggingface transformers库中一种极简方式使用大模型推理的抽象,将所有大模型分为音频(Audio)、计算机视觉(Computer vision)、自然语言处理(NLP)、多模态(Multimodal)等4大类,28小类任务(tasks)。共计覆盖32万个...

2024-08-13
18

【人工智能】Transformers之Pipeline(四):零样本音频分类(zero-shot-audio-classification)

pipeline(管道)是huggingface transformers库中一种极简方式使用大模型推理的抽象,将所有大模型分为音频(Audio)、计算机视觉(Computer vision)、自然语言处理(NLP)、多模态(Multimodal)等4大类,28小类任务(tasks)。共计覆盖32万个...

2024-08-13
23

【人工智能】Transformers之Pipeline(三):文本转音频(text-to-audio/text-to-speech)

pipeline(管道)是huggingface transformers库中一种极简方式使用大模型推理的抽象,将所有大模型分为音频(Audio)、计算机视觉(Computer vision)、自然语言处理(NLP)、多模态(Multimodal)等4大类,28小类任务(tasks),共计覆盖32万个模...

2024-08-13
26