- formatting
- images
- links
- math
- code
- blockquotes
•
•
•
•
•
-
长音频转写慢 10 倍、99% 的 Attention 在白做功——MURMUR 是怎么解决的 - marsggbo
长音频转写慢 10 倍、99% 的 Attention 在白做功——MURMUR 是怎么解决的 原文:MURMUR: An Efficient Inference System for Long-Form ASR 1. 前言 你有没有遇到过这种场景:一小时的会议录音,想转成带时间戳和说话人标注的文字
-
一篇 Markdown,一键发到微信、知乎、小红书、Twitter - marsggbo
一篇 Markdown,一键发到微信、知乎、小红书、Twitter 开源地址:marsggbo/markdown2anything VS Code 商店搜 Markdown2Anything · CLI:npm i -g md2any 1. 它解决什么 写技术博客我一直是 Markdown 一把梭。
-
Gemma 4 拆解 | 多模态怎么塞进端侧,MTP drafter 又是怎么自带投机采样的 - marsggbo
Gemma 4 拆解 | 多模态怎么塞进端侧,MTP drafter 又是怎么自带投机采样的 原文:Gemma 4 Technical Report 1. 前言 我看 LLM 技术报告有个习惯:跳过刷榜表格,直接翻到架构章节里那些"为了省内存/省算力我们做了什么妥协"的段落。因为真正决定一个模型能不
-
arXiv'26 | Foundry 把 LLM 冷启动的 CUDA Graph 捕获从 10 分钟压到 3.9 秒
-
ICML'26 Workshop | 韩英混说训好了,韩日混说能白拿吗?答案是:几乎不能