240 发简信
IP属地:广东
  • Resize,w 360,h 240
    多模态大模型推理流程解析

    本文想从数据流的方式走一遍多模态大模型推理流程,但不包含vit和llm具体的计算流程,因为里面基本是常见的attention计算方式。atten...

  • Resize,w 360,h 240
    RoPE通俗讲解

    现有的attention结构如下图所示,输入的N长度的features之间在计算attention的时候是没有位置关系的。但是在不管是文本、图片...

  • Resize,w 360,h 240
    ControlNet论文详解

    文章地址:https://arxiv.org/abs/2302.05543[https://arxiv.org/abs/2302.05543]代...

  • Resize,w 360,h 240
    《Mask2Former》算法详解

    文章地址:《Masked-attention Mask Transformer for Universal Image Segmentation...

  • Resize,w 360,h 240
    MedianFlow 跟踪算法详解

    在技术日新月异的时代,今天的技术可能在明天就会被新的技术取代,例如现在爆火的大模型。但目前看来,大模型还不能做到无所不能。 所以这篇博客还是来考...

  • Resize,w 360,h 240
    从新的角度看待大模型微调

    一、前言 一切要从最近大火的Lora(《LORA: LOW-RANK ADAPTATION OF LARGE LAN�GUAGE MODELS》...

  • Resize,w 360,h 240
    关于OpenCV中minAreaRect角度记录

    一、问题引出 最近看到stackflow关于minAreaRect的讨论: MinAreaRect angles - Unsure about ...

  • 【转载】JNI内存方面说明以及相关类型手动释放内存

    一、Java内存 Java程序所涉及的内存可以从逻辑上划分为两部分:Heap Memory和Native Memory。 1)Heap Memo...

  • Resize,w 360,h 240
    ChatGPT Prompt Engineering for Developers from DeepLearning.AI

    链接:https://learn.deeplearning.ai/chatgpt-prompt-eng/lesson/1/introductio...