摘要: 插播:之前写的《动手学 AutoML》终于出版了,从 NAS 到超参优化都有覆盖,适合想系统入门 AutoML 的同学。好了广告结束,现在进入正题。 DAC'26 | ExpertFlow:让 MoE 大模型在单卡上跑起来,内存省 93%、速度快 10 倍 原文:ExpertFlow: Effici 阅读全文
posted @ 2026-07-23 14:14 marsggbo 阅读(22) 评论(0) 推荐(0)
摘要: 微信公众号:AutoML机器学习 MARSGGBO♥原创 如有意合作或学术讨论欢迎私戳联系~邮箱:marsggbo@foxmail.com 阅读全文
posted @ 2021-11-29 21:12 marsggbo 阅读(306) 评论(0) 推荐(0)
摘要: 论文: AutoML: Survey of the State-of-the-Art 下面这个网站会不断更新AutoML相关的论文,当然如果你的论文未被收录,你也可以手动上传你的论文让更多人看到: https://marsggbo.github.io/automl_a_survey_of_state 阅读全文
posted @ 2020-07-09 19:01 marsggbo 阅读(1492) 评论(1) 推荐(0)
摘要: 之前已经发过一篇文章来介绍我写的 "AutoML综述" ,最近把文章内容做了更新,所以这篇稍微细致地介绍一下。由于篇幅有限,下面介绍的方法中涉及到的细节感兴趣的可以移步到论文中查看。 论文地址:https://arxiv.org/abs/1908.00709 1. Introduction 以往的模 阅读全文
posted @ 2020-02-11 12:01 marsggbo 阅读(1887) 评论(0) 推荐(2)
摘要: 特大喜讯!!! 本专栏开通了同步更新的微信公众号【AutoML机器学习】,不常用知乎的小伙伴们欢迎关注,一起学习!!! 阅读全文
posted @ 2020-01-28 18:28 marsggbo 阅读(707) 评论(2) 推荐(1)
摘要: 做件好事,考四级的兄弟们一起共勉~~~ 链接:https://pan.baidu.com/s/1im4BDVZofZbT9f5PZtsxdA 密码:9i5h ​若链接失效请关注如下公众号,后台私信【计算机四级】即可获得更新链接。 微信公众号:AutoML机器学习 MARSGGBO♥原创 如有意合作或 阅读全文
posted @ 2018-03-08 10:54 marsggbo 阅读(4910) 评论(0) 推荐(0)
摘要: 第一章 神经网络与深度学习(Neural Network & Deeplearning) "DeepLearning.ai学习笔记(一)神经网络和深度学习 Week3浅层神经网络" "DeepLearning.ai学习笔记(一)神经网络和深度学习 Week4深层神经网络" 第二章 改善深层神经网络 阅读全文
posted @ 2017-09-03 20:44 marsggbo 阅读(10389) 评论(1) 推荐(2)
摘要: 因为是Jupyter Notebook的形式,所以不方便在博客中展示,具体可在我的github上查看。 github传送门 : "deeplearning.ai_JupyterNotebooks" 笔记传送门 : "DeepLearning.ai课程相关系列笔记" 微信公众号:AutoML机器学习 阅读全文
posted @ 2017-08-31 17:34 marsggbo 阅读(5985) 评论(0) 推荐(0)
摘要: 笔记总结,各章节主要内容已总结在标题之中 "Andrew Ng机器学习课程笔记–week1(机器学习简介&线性回归模型)" "Andrew Ng机器学习课程笔记 week2(多元线性回归&正规公式)" "Andrew Ng机器学习课程笔记 week3(逻辑回归&正则化参数)" "Andrew Ng机 阅读全文
posted @ 2017-08-25 18:28 marsggbo 阅读(5968) 评论(0) 推荐(3)
摘要: OSDI'26 | 双路 CPU + 两张 5090,本地跑满血 671B DeepSeek:云端 SLO 是怎么在消费级硬件上达成的 原文:Achieving Cloud-Grade SLOs for Local Mixture-of-Experts Inference through CPU–G 阅读全文
posted @ 2026-07-27 11:24 marsggbo 阅读(33) 评论(0) 推荐(0)
摘要: arXiv'25 | SMoE:expert 不在 GPU 上?别搬了,找个"平替"直接算 原文:SMoE: An Algorithm-System Co-Design for Pushing MoE to the Edge via Expert Substitution 1. 前言 MoE off 阅读全文
posted @ 2026-07-27 11:23 marsggbo 阅读(20) 评论(0) 推荐(0)
摘要: arXiv'26 | 无损压缩逼近 Shannon 极限:你的 LLM 权重里一半以上的 bit 是白存的 原文:Approaching Shannon Bound with Lossless LLM Weight Compression 1. 前言 你有没有想过,当你把一个 bf16 的模型权重加 阅读全文
posted @ 2026-07-27 11:22 marsggbo 阅读(34) 评论(0) 推荐(0)
摘要: arXiv'26 | PLENA:Agent 时代的 LLM 推理,被两堵 Memory Wall 卡住了 原文:Combating the Memory Walls: Optimization Pathways for Long-Context Agentic LLM Inference 1. 前 阅读全文
posted @ 2026-07-27 11:21 marsggbo 阅读(29) 评论(0) 推荐(0)
摘要: arXiv'26 | ST-MoE:expert 激活不是随机的——用时空相关性把 expert 提前搬上片 原文:A Spatio-Temporal Expert Prefetching Framework for Efficient MoE-based LLM Inference 1. 前言 M 阅读全文
posted @ 2026-07-27 11:20 marsggbo 阅读(30) 评论(0) 推荐(0)
摘要: arXiv'26 | DySHARP:MoE 通信里一半流量是重复的,让 NVSwitch 帮你去重 原文:Accelerating MoE with Dynamic In-Switch Computing on Multi-GPUs 1. 前言 作为研究 MoE 系统的牛马,expert para 阅读全文
posted @ 2026-07-27 11:18 marsggbo 阅读(28) 评论(0) 推荐(0)
摘要: ISCA26 | Cassandra:不训练、不加显存,把 draft model 从 target 模型的 bit 里抠出来 原文:Cassandra: Enabling Reasoning LLMs at Edge via Self-Speculative Decoding 1. 前言 先交代下 阅读全文
posted @ 2026-07-27 11:16 marsggbo 阅读(17) 评论(0) 推荐(0)
摘要: DAC'26 | SlideFormer 让单张 4090 全参微调 123B 模型 原文:An Efficient Heterogeneous Co-Design for Fine-Tuning on a Single GPU 1. 前言 你有没有算过一笔账:全参微调一个 8B 模型,到底需要多少 阅读全文
posted @ 2026-07-27 11:14 marsggbo 阅读(8) 评论(0) 推荐(0)
摘要: arXiv'26 | StepAudio 2.5:一个底座三种人格,ASR 模式把 RTF 干到 0.0053 原文:StepAudio 2.5 Technical Report 1. 前言 最近在系统性地翻各家大厂的 ASR 技术报告,今天想和大家聊聊阶跃星辰(StepFun)2026 年 5 月 阅读全文
posted @ 2026-07-27 11:12 marsggbo 阅读(26) 评论(0) 推荐(0)
摘要: Self-Speculative Decoding 简史:不引入额外模型,用自己给自己打草稿这件事到底能走多远 声明:本文是对以下七篇论文的简单概要,基于论文原文和博客整理,内容有所精简,不构成完整综述。如需深入了解,建议阅读各论文原文(正文附有链接)。 1. 为什么要研究 Self-Specula 阅读全文
posted @ 2026-07-27 11:11 marsggbo 阅读(30) 评论(0) 推荐(0)