DeepSeek等大模型工具使用手册(实战篇)_177页_14mb
报告摘要
DeepSeek等大模型及其AIGC技术应用手册
厦门大学大数据教学团队于2025年5月2日发布,涵盖AIGC技术概述、应用场景及工具使用方法。团队负责人林子雨副教授带领核心成员(46岁以下)致力于大数据教育领域11年,专注教学型、科研型与实验工程师团队建设,其作品在教材数量、MOOC学习人数、网站访问量等指标中居国内高校前列。
AIGC(人工智能生成内容)全称为Artificial Intelligence Generated Content,利用生成对抗网络(GAN)、大模型等技术生成文字、音乐、图像、视频等内容,其核心思想是通过数据训练模型实现创意内容生成。AIGC与大模型相互促进:大模型为AIGC提供算力与数据支持,而AIGC需求推动大模型发展。AIGC发展历程分为三个阶段:早期萌芽期(1957年出现电脑创作音乐)到快速发展期(如2024年OpenAI发布Sora文本生成视频模型)。当前主流工具包括OpenAI的ChatGPT、百度文心一言、科大讯飞讯飞星火、阿里通义千问、字节跳动豆包、Kimi等。
文本类AIGC应用广泛,如新闻报道、广告文案、社交媒体内容、教育领域(如总结年报、批改试卷)及文学创作。使用技巧包括明确提示词(如要求“仿李白风格写诗”)、分步骤提问(如要求“列出必去景点→安排行程→推荐餐厅→推荐酒店”)、指定输出结构(如“现状/问题/解决方案”格式)、设定角色(如“扮演小红书文案撰写者”)及调整语气风格(如幽默、正式、抒情)。DeepSeek支持文档处理功能,可通过“回形针”图标上传文件并执行摘要生成、问答提取、数据可视化等操作。
图片类AIGC涵盖创意生成、老照片修复、图片扩展、抠图融合、涂抹消除及风格转换。案例显示,即梦AI可生成“梦幻森林精灵聚会”等艺术图片;百度AI图片助手能修复黑白老照片并优化画质;AI可将普通图片扩展至高清格式,并实现人物与背景的智能融合。
语音类AIGC应用包括实时翻译(豆包支持)、文本配音(腾讯智影可选择主播音色与语速)、语音克隆(米可智能通过上传音频生成定制音色)。
视频类AIGC以Sora、可灵AI、即梦AI等为代表,可实现文生视频、图生视频及数字人播报。例如,可灵AI通过输入文字描述生成5秒短视频;即梦AI先生成图片再拓展为视频,并可为其配乐;腾讯智影基于PPT自动生成数字人播报视频,支持背景、贴纸、音色调整。
AIGC在辅助编程中应用,如豆包可生成Python代码(如绘制五角星)、HTML动态页面(如豆苗生长动画、光折射演示)等,提升开发效率。
AI搜索技术填补传统搜索不足,通过语义理解、深度学习及多模态交互提供精准答案。纳米AI搜索集成16款大模型,支持文字、语音、图像等多种输入方式,适用于日常问题解答、旅游规划、跨语言交流等场景。
材料指出AIGC对内容创作、生产力提升、用户体验优化及行业转型具有深远影响。同时,新兴职业如AI训练师、机器学习工程师兴起,传统职业需适应技术革新,通过持续学习掌握工具使用技巧。
总结内容主要围绕AIGC技术定义、核心工具、应用案例及行业影响展开,强调其在提升效率、创新创作、降低门槛方面的价值,并提供实际操作示例与提示词优化建议。
试读结束,高清完整版pdf/doc/ppt,请点下载