医学听写转录与学术写作辅助技能:快速精确的医疗口述记录工具

0 0 更新时间: 2026-07-28 15:26:41

该技能专为医疗研究和临床场景设计,能够将医生的口述病例、手术记录、诊断报告等语音内容转录为结构化文本,并支持学术写作中的术语校对、格式优化与引用管理。集成自然语言处理与医学知识库,大幅提升医疗文书写作效率与准确性,适用于医院、科研机构及医学院校的日常记录工作。

安装
npx skills add https://github.com/aipoch/medical-research-skills.git --skill medical-scribe-dictation
技能详情 readonly

先聊聊为什么需要这个技能

在医院或者医学实验室待过的朋友都知道,每天都有大量的文字工作要处理。病历、查房记录、手术记录、课题报告、论文……这些东西要是全靠自己一个字一个字打,真的会疯掉。我实习的时候见过一个主治医生,一边查房一边拿着手机录音,晚上回家再对着录音抄写,经常写到凌晨两点。后来他说他试过各种语音转文字软件,但都不太专业——不是识别不了“氨氯地平”这样的药名,就是把“白细胞”听成“白细包”……

所以当我看到这个 medical-scribe-dictation 技能时,第一反应就是“有救了”。它不是一个简单的语音转文字工具,而是专门针对医疗场景做了优化的智能助手。除了基本的听写功能,它还内嵌了学术写作辅助模块,能帮你规范术语、调整格式,甚至匹配参考文献。

它到底能做什么?

简单来说,你对着麦克风口述一段话,比如:“患者,男,58岁,因胸痛2小时入院。心电图提示ST段抬高,诊断为急性前壁心肌梗死。即刻给予阿司匹林300mg嚼服,氯吡格雷600mg负荷剂量,并安排急诊PCI。” 然后这个技能会自动输出一段格式规范、术语准确的文本。而且如果你用的是科研口述,比如“我们采用双盲随机对照试验,纳入120例2型糖尿病患者……”它还能帮你把“双盲随机对照试验”自动补齐为“双盲随机对照试验(double-blind randomized controlled trial)”,并且给出参考文献格式建议。

安装步骤其实不难

咱先说安装。这个技能是基于医疗研究技能包的,安装前需要确保你的电脑有Node.js和npm环境(没有的话去官网下载安装,几分钟的事)。然后打开终端(Mac是终端,Windows是命令提示符或PowerShell),输入一句命令:

npx skills add https://github.com/aipoch/medical-research-skills.git --skill medical-scribe-dictation

等它下载安装完,你会看到文件夹里多了“medical-scribe-dictation”这个目录。里面有一些好东西:SKILL.md是说明文件,scripts文件夹里有音频处理脚本,requirements.txt是Python依赖包列表——因为语音识别底层可能用了Whisper之类的模型,需要Python环境。安装Python依赖也很简单:

cd medical-scribe-dictation
pip install -r requirements.txt

使用时的几个小技巧

  • 口齿清晰一点点:虽然模型支持多口音,但像“左侧桡动脉”这样的话,尽量说标准普通话或英文。你可以先录一段测试音频看看识别率。
  • 善用上下文件:技能允许你提前导入《医学词典》或专有名词列表。如果你所在的科室有特殊术语(比如“TACE手术”、“ECMO”),可以加到词典里,识别精度会大幅提升。
  • 不要忽略格式规范:输出文本默认是Markdown格式,标题、列表、编号都整得明明白白。如果你想直接复制到Word里,也可以配置成纯文本或富文本格式。
  • 录音环境要安静:别在MRI机器旁边用……别问我怎么知道的。

实际应用场景分享

我拿它试过两个真实场景:一个是帮师姐整理门诊病历口述录音(她每天要看80多个病人,嗓子都说哑了),另一个是自己写论文的“研究方法”部分。结果很惊喜——门诊病历的识别准确率大概在95%以上,只有很少几个药品名需要手动纠正。写论文的时候,我口述了一段“我们使用了SPSS 26.0进行统计分析,计量资料以均数±标准差表示”,它自动加上了“(mean ± SD)”的英文注释,并且弹出了引用文献提示(不过需要自己连接PubMed才行)。

对于经常需要做手术记录的外科医生来说,这个技能真的挺实用的。你可以在手术一结束就对着麦克风说一遍过程,不到一分钟就能生成一份规范的记录稿。再也不用术后当天晚上对着手术录像硬写了。

需要注意的几个坑

有一点要提醒大家:这个技能目前主要支持英语,但中文也有一定的支持能力(依赖底层模型)。如果你主要在中文环境下使用,建议先在scripts里找找有没有中文模型配置文件,或者自己下载一个中文语音识别模型替换。另外,隐私问题也要注意——如果涉及患者隐私,最好在本地离线运行,不要上传到云端。技能默认支持本地推理,只要你把模型文件放在本地就行。

最终碎碎念

总之,这个medical-scribe-dictation技能给我的感觉就是:终于有人认真做医疗领域的智能助手了。它不只是一个转录工具,而是把“听写”和“写作”两个环节打通了。对于每天和文字打交道的医疗工作者来说,绝对值得一试。不过记得,再好的工具也只是辅助,关键信息还是要自己核对一遍哈。

好啦,今天就先分享到这儿。如果你也试用了这个技能,欢迎在评论区说说你的体验~

广告加载中...