通过 node 进行简书内容的迁移

简书文章导出

在简书的设置下面,就有一键导出的按钮,可以将 markdown 全部下载到本地。

413f0aa7-b164-43e9-91ae-5988eda3e4c4.jpeg

虽然下载了 markdown,但是在简书导出内容的时候,图片并没有一并导出,还是简书内部的图片 URL。所以需要一些手段来进行爬取。

创建一个 node 项目

我们将下载下来的文件放到 docs 目录下,再创建一个 imgs 目录来存放图片。

|- jianshu
  |- docs
    |- 开发日志
      |- 01.md
      |- 02.md
  |- imgs
    |- 1.webp
    |- 2.webp
    |- 3.webp
    |- 5.webp
  |- index.js
  |- package.json

由于用到了 request 来发起请求,所以需要进行安装。

> cd jianshu
> npm init
> yarn add request

使用 node.js 来进行图片的爬取

下面是完整的爬取代码。

let request = require("request");
const fs = require("fs");

// 拿到所有 md 文件路径
const paths = recursiveQueryFile("./docs");

const allFilePaths = [];
function getFilePaths(arr) {
  arr.forEach((item) => {
    if (item.children) {
      getFilePaths(item.children);
    }
    if (item.isFile) {
      allFilePaths.push(item.path);
    }
  });
}
getFilePaths(paths.children);

// 拿到所有图片 URL 路径
const imgList = [];
allFilePaths.forEach((path) => {
  const data = fs.readFileSync(path, "utf-8");
  const matchResults = data.match(/!\[\S+\]\(\S+\)/g);
  if (matchResults) {
    matchResults.forEach((str) => {
      let url = str.replace(/!\[\S+\]\(/, "");
      url = url.replace(")", "");

      imgList.push(url);
    });
  }
});
console.log("imgList", imgList);

// 逐个请求 URL,并将图片下载到本地
const map = {};
async function queryAll() {
  let i = 1;

  for (const url of imgList) {
    const imgName = `/imgs/${i}.webp`;
    map[url] = imgName;
    await request({ url }).pipe(
      fs.createWriteStream("." + imgName).on("close", (err) => {
        if (err) {
          console.log("写入失败", err);
        } else {
          console.log(imgName + " 写入成功");
        }
      })
    );
    i++;
    await waitForTimeout(100);
  }
  console.log("map", map);
  await waitForTimeout(100);
  replaceUrl();
}
queryAll();

// 遍历所有 markdown 文件,替换图片 URL
function replaceUrl() {
  allFilePaths.forEach((path) => {
    let data = fs.readFileSync(path, "utf-8");
    if (data.match(/!\[\S+\]\(\S+\)/g)) {
      Object.keys(map).forEach((key) => {
        data = data.replace(key, map[key]);
      });
      fs.writeFileSync(path, data);
      console.log(path + " 保存完毕!");
    }
  });
}

function waitForTimeout(time) {
  return new Promise((resolve, reject) => setTimeout(resolve, time));
}

function recursiveQueryFile(path) {
  const children = fs.readdirSync(path);
  return {
    path,
    children: children.map((child) => {
      const childPath = path + "/" + child;
      const stat = fs.statSync(childPath);
      if (stat.isDirectory()) {
        return recursiveQueryFile(path + "/" + child);
      } else {
        return {
          path: childPath,
          isFile: true,
        };
      }
    }),
  };
}

实现步骤

  • 递归读取 docs 目录下所有的文件名称(非目录)
  • 读取所有文件内容,通过正则收集 markdown 的图片链接写法 [name](url) 来奶到图片 URL
  • 使用 request 请求图片,并保存到 imgs 目录下。并且为这些图片另外去一个名称。
  • 记录下图片 URL 和图片名称的对应关系 map。
  • 通过对应关系 map 将所有 markdown 文件中的图片 URL。

最后

一开始选择简书是因为它简洁清爽的界面、好用的 markdown 编辑器、快速上传图片这三个功能。后来又用上了日更的功能,坚持日更的确让我收获颇丰。
但是,现在的简书无论是网页端还是 APP 都充斥着广告,让人很不爽。而且再简书上传的图片无法直接在其他网站使用,导致我往往需要上传两遍图片,也是很恶心人的一点。
最近突然有了自己搞个类似简书的网站的想法,来避开简书的这些恶心人的事情。所以选择导出文章搬家~

©著作权归作者所有,转载或内容合作请联系作者
  • 序言:七十年代末,一起剥皮案震惊了整个滨河市,随后出现的几起案子,更是在滨河造成了极大的恐慌,老刑警刘岩,带你破解...
    沈念sama阅读 216,651评论 6 501
  • 序言:滨河连续发生了三起死亡事件,死亡现场离奇诡异,居然都是意外死亡,警方通过查阅死者的电脑和手机,发现死者居然都...
    沈念sama阅读 92,468评论 3 392
  • 文/潘晓璐 我一进店门,熙熙楼的掌柜王于贵愁眉苦脸地迎上来,“玉大人,你说我怎么就摊上这事。” “怎么了?”我有些...
    开封第一讲书人阅读 162,931评论 0 353
  • 文/不坏的土叔 我叫张陵,是天一观的道长。 经常有香客问我,道长,这世上最难降的妖魔是什么? 我笑而不...
    开封第一讲书人阅读 58,218评论 1 292
  • 正文 为了忘掉前任,我火速办了婚礼,结果婚礼上,老公的妹妹穿的比我还像新娘。我一直安慰自己,他们只是感情好,可当我...
    茶点故事阅读 67,234评论 6 388
  • 文/花漫 我一把揭开白布。 她就那样静静地躺着,像睡着了一般。 火红的嫁衣衬着肌肤如雪。 梳的纹丝不乱的头发上,一...
    开封第一讲书人阅读 51,198评论 1 299
  • 那天,我揣着相机与录音,去河边找鬼。 笑死,一个胖子当着我的面吹牛,可吹牛的内容都是我干的。 我是一名探鬼主播,决...
    沈念sama阅读 40,084评论 3 418
  • 文/苍兰香墨 我猛地睁开眼,长吁一口气:“原来是场噩梦啊……” “哼!你这毒妇竟也来了?” 一声冷哼从身侧响起,我...
    开封第一讲书人阅读 38,926评论 0 274
  • 序言:老挝万荣一对情侣失踪,失踪者是张志新(化名)和其女友刘颖,没想到半个月后,有当地人在树林里发现了一具尸体,经...
    沈念sama阅读 45,341评论 1 311
  • 正文 独居荒郊野岭守林人离奇死亡,尸身上长有42处带血的脓包…… 初始之章·张勋 以下内容为张勋视角 年9月15日...
    茶点故事阅读 37,563评论 2 333
  • 正文 我和宋清朗相恋三年,在试婚纱的时候发现自己被绿了。 大学时的朋友给我发了我未婚夫和他白月光在一起吃饭的照片。...
    茶点故事阅读 39,731评论 1 348
  • 序言:一个原本活蹦乱跳的男人离奇死亡,死状恐怖,灵堂内的尸体忽然破棺而出,到底是诈尸还是另有隐情,我是刑警宁泽,带...
    沈念sama阅读 35,430评论 5 343
  • 正文 年R本政府宣布,位于F岛的核电站,受9级特大地震影响,放射性物质发生泄漏。R本人自食恶果不足惜,却给世界环境...
    茶点故事阅读 41,036评论 3 326
  • 文/蒙蒙 一、第九天 我趴在偏房一处隐蔽的房顶上张望。 院中可真热闹,春花似锦、人声如沸。这庄子的主人今日做“春日...
    开封第一讲书人阅读 31,676评论 0 22
  • 文/苍兰香墨 我抬头看了看天上的太阳。三九已至,却和暖如春,着一层夹袄步出监牢的瞬间,已是汗流浃背。 一阵脚步声响...
    开封第一讲书人阅读 32,829评论 1 269
  • 我被黑心中介骗来泰国打工, 没想到刚下飞机就差点儿被人妖公主榨干…… 1. 我叫王不留,地道东北人。 一个月前我还...
    沈念sama阅读 47,743评论 2 368
  • 正文 我出身青楼,却偏偏与公主长得像,于是被迫代替她去往敌国和亲。 传闻我的和亲对象是个残疾皇子,可洞房花烛夜当晚...
    茶点故事阅读 44,629评论 2 354

推荐阅读更多精彩内容