会员
周边
新闻
博问
闪存
赞助商
Chat2DB
所有博客
当前博客
我的博客
我的园子
账号设置
会员中心
简洁模式
...
退出登录
注册
登录
commuter
博客园
园子
首页
新随笔
联系
管理
订阅
上一页
1
2
3
4
5
6
7
8
9
下一页
2025年4月9日
生成式问答机器人
摘要: 可以通过生成式问答机器人解决一些业务中的问答问题,但是一般采用小模型生成的结果都需要再进行一些润色才能达到更好的效果。 这里问答使用mxmax/Chinese_Chat_T5_Base模型,而润色则使用RichardErkhov/IDEA-CCNL_-_Wenzhong-GPT2-110M-4bit
阅读全文
posted @ 2025-04-09 09:58 月薪几千的牛马
阅读(81)
评论(0)
推荐(0)
2025年4月8日
使用Swanlab进行训练记录
摘要: Swanlab是一个简单易用的工具,可用于模型微调过程中对其训练数据进行记录。借助这个工具,可以简化训练数据的记录。 其调用方法类似如下: import swanlab # 登录到平台 swanlab.login(api_key="...") run = swanlab.init( project=
阅读全文
posted @ 2025-04-08 18:38 月薪几千的牛马
阅读(199)
评论(0)
推荐(0)
Prompt学习
摘要: 列举一些关于提示词学习的文章: Prompt Learning 超强入门教程 简单了解prompt learning是什么? 【P-Tuning】 一种自动学习 prompt pattern 的方法(附源码)
阅读全文
posted @ 2025-04-08 15:58 月薪几千的牛马
阅读(26)
评论(0)
推荐(0)
数据标注工具推荐
摘要: 下面推荐一些数据标注工具: doccano,适合文本分类、序列标注及序列到序列的任务
阅读全文
posted @ 2025-04-08 15:26 月薪几千的牛马
阅读(128)
评论(0)
推荐(0)
2025年4月6日
使用gradio生成看图说话界面
摘要: 这个应用看起来很像小学生写作文的场景,主要利用的还是多模态模型来实现的。 界面比较简单,根据上传图片对其进行描述。下面是一个简单的效果: 当然对于模型来说,它可能无法很好的区分性别。 其实现代码如下: import gradio def process(image, choice): .... de
阅读全文
posted @ 2025-04-06 15:39 月薪几千的牛马
阅读(73)
评论(0)
推荐(0)
2025年4月4日
使用gradio生成检索机器人界面
摘要: 可以使用gradio生成一个简单的检索机器人界面,当用户输入问题后经过检索后将最接近的3个选项的标题及内容显示出来。 其效果类似如下: 将相应的模型加载进来后,接收到用户输入的问题后将其进行嵌入并向量化后,经过召回和重排序后直接显示: 相应数据集来自百度知道,可以访问进行下载。 其相应界面代码如下:
阅读全文
posted @ 2025-04-04 21:44 月薪几千的牛马
阅读(72)
评论(0)
推荐(0)
文本纠错数据集
摘要: 以下是一些文本纠错数据集: shibing624/CSC,其中训练集有282万 另外还有文本生成模型textgen
阅读全文
posted @ 2025-04-04 16:40 月薪几千的牛马
阅读(72)
评论(0)
推荐(0)
2025年3月30日
安装PyTorch旧版本
摘要: 访问https://pytorch.org/get-started/previous-versions/按照页面内容进行安装 而CUDA的历史版本为https://developer.nvidia.com/cuda-toolkit-archive
阅读全文
posted @ 2025-03-30 16:45 月薪几千的牛马
阅读(62)
评论(0)
推荐(0)
2025年3月29日
外卖评价看不懂?BERT模型帮你轻松分辨好评差评!
摘要: 其实通过BERT模型对外卖数据集进行分类,从而得到其归类是好评还是差评。其中数据集使用的是waimai_10k。 该数据集中有1.1万条记录,其中差评占绝大多数。需要根据情况拆分为训练集和测试集。 主要考验对Transformers库的使用,就当是训练和学习。 如果不想训练,可以使用已经训练好的模型
阅读全文
posted @ 2025-03-29 16:11 月薪几千的牛马
阅读(102)
评论(0)
推荐(0)
2025年3月28日
HNSW算法简述
摘要: HNSW是Hierarchical Navigable Small Worlds的缩写,其是一种基于图的数据结构,通过构建多层图从而实现高效的相似性搜索。其相关论文可以参考。 HNSW通过将数据组织成层次结构,每一层都包含由边连接的节点。顶层较为稀疏,可以在图中进行大范围的跳转。而下层密度增加,提供
阅读全文
posted @ 2025-03-28 17:49 月薪几千的牛马
阅读(243)
评论(0)
推荐(0)
上一页
1
2
3
4
5
6
7
8
9
下一页
公告