让Deepseek教我用AI辅助看没字幕的xx动作片??

原创 嵌入式软件实战派 2025-02-21 12:01

之前在某宝上买了两个拆机硬盘,这个文章(我在二手硬盘里发现了一堆不可描述的内容)有描述其中的内,后来觉得很鸡肋,然后送我朋友了。

没多久,那家伙吞吞吐吐问我那个硬盘坏了能不能修复,我搞不明白他对硬盘塞了什么不可描述的内容,导致其承受不了崩了,我在这个文章(《一块不可描述的硬盘坏了,又不好意思去修……》)讲了这个事情的经过。

最后,反正我没修好,也不知道他对硬盘干了啥。他知道我没帮他修好硬盘,将大腿都拍烂了。

又过了段时间,他找我唠叨,说看片没字幕,很好奇里面是啥剧情。我跟他说网上一大堆字幕网站,很容易找到影片对应的字幕文件的。

他说找不到的,真的找不到,然后又在叹气,说好不容易下了几个4K HDR的片子,画面贼溜,就是缺了字幕,很是遗憾。

我还在纳闷啥玩意呢,听他这么说似乎瞬间又明白他看得是啥片子了。

我一下子也不知道怎么搞,直接跟他说:要不你学学这门外语?你之前为了批量爬取这些信息把Python都啃下了,这对你来说还不是“湿湿碎”?!

他没理我,过一会他突发奇想,说最近Deepseek很火,能不能用AI帮忙搞搞?辅助看片 or 提取字幕?

咦?对于身为程序员且颇有好奇心的我,为啥不试试呢?我对不可描述技术研究可是很感兴趣的。

用AI辅助看片?我以前真没想过这种操作!

AI同声传译

于是我发挥我的想象力,把手机摆在电脑旁边,开着AI实时语音翻译或同声传译功能?

但是,这样也能解决问题,但总觉得怪怪的。

在线音频提取文字

于是乎,从网上搜提取字幕的工具或方法,但是经验告诉我:别用度娘,浪费时间浪费精力!

呵呵,广告!在线提取……

这里提个醒,不要将不可描述的内容上传到网上哈,不然分分钟被警察叔叔找你喝茶都不知道怎么回事。

然后呢,好像都不尽如意!

Whisper

不是说用AI辅助看片吗,这事肯定问AI啊。

于是我问好几个AI(中间结果我就不展示了),最终发现还是鼎鼎大名的Deepseek给我的答案靠谱点。

他贴心地告诉我,提取字幕的方法分两类:提取内嵌字幕和通过语言识别生成字幕。而且,还给我做了个总结。

他不知道我问这个问题是想用AI帮忙看片哈,第一种方法是不适用的,我想要的是第二种。

看名字,好像Whisper很厉害的样子,窃窃私语都能懂。

接着,我从OpenAI的官网找到这个Whisper。

Whisper是一个自动语音识别系统,它是在从网络上收集的 68 万小时的多语言、多任务监督数据上进行训练的。

然后,看这配图,不觉明历!

ASR Summary Of Model Architecture

表面上的原理很简单,它是一个end-to-end模型,实现一个encoder-decoder的转换,输入的音频会被切片成30秒的小块,然后就巴拉巴拉……

Diagram detailing how ASR models are trained

好吧,这原理我看不懂,反正觉得它应该搞得定。

怎么玩呢?

首先要安装whisper,如果用Python的话,还要安装PyTorch

pip install -U openai-whisper

或者

pip install git+https://github.com/openai/whisper.git 

然后下载模型包。注意,这是AI模型来的,所以要下载人家训练好的模型来使用。这里有6种模型,存在性能和准确度的差异,以下官方提供了个表做对比:

Size
Parameters
English-only model
Multilingual model
Required VRAM
Relative speed
tiny
39 M
tiny.entiny
~1 GB
~10x
base
74 M
base.enbase
~1 GB
~7x
small
244 M
small.ensmall
~2 GB
~4x
medium
769 M
medium.enmedium
~5 GB
~2x
large
1550 M
N/A
large
~10 GB
1x
turbo
809 M
N/A
turbo
~6 GB
~8x

你不知道用哪个,都下几个来试试。

这不用说,肯定是越大就越精确,但是就运行效率越低,那你就根据你的电脑性能来选咯。

在哪下载模型呢?

在huggingface.co上可以下载,但是要技术上网,你懂的。如果你不懂,继续往下看,还有方法解决。

还有另一种,就是找国内的镜像了,例如gitee上面就能找到(https://gitee.com/organizations/hf-models/projects)。

好了,那怎么用呢?

import whisper# 加载模型model = whisper.load_model("large - v2")# 转录音频文件result = model.transcribe("path_to_your_audio_file.wav")# 打印识别结果print(result["text"])

就这样,简单吧。

还有命令行方式的

whisper audio.flac audio.mp3 audio.wav --model turbo

当然也可以指定语言的,例如Japanese

whisper japanese.wav --language Japanese

此时,你提取的文字是日文的哦,看得懂当我没说,不行的话就去翻译吧(这一步简单,我就不啰嗦了)。

然后把字幕扔到播放器就可以愉快地看片了

你还可以通过--help查看相关参数使用。

whisper --help

但是,还是有点麻烦啊。

PotPlayer+Whisper

PotPlayer 241212 版本新增了使用 Whisper 从语音生成字幕的功能,用PotPlayer播放视频可实现识别音频为字幕的功能。

步骤:

  1. 右键打开菜单

  2. 点击“字幕”

  3. 点击“创建有声字幕”

  4. 点击“创建有声字幕……”

然后再打开的对话框里选择参数

这里看一眼就懂了,注意这里这个“型号”就是大模型的名称,例如图中的medium表示faster-whisper-medium模型。

如果你的电脑配置牛逼,你可以选large-v3,这个模型的精确度高很多,当然你要提前下载好这些模型。

完了吗?

Potplayer还给你提供自动翻译的途径。就是这里哈

你可以点击上面的“实时字幕翻译设置……”

这个不难,有兴趣的同学你自己研究吧。

好了,好了。方法有了,软件也装好了,片呢?

我朋友不肯给我片子啊!

回头翻了下前面几个文章,我也不知道,为什么这几篇文章的阅读量那么高,而且比其他的高得离谱。是不是很多人对这个“不可描述”感兴趣,还是平台热度问题。

要是我这个文章超过100个赞,老子豁出去了,将我朋友摁在地上,开个专栏,让他写那个“学Python”的经过,你懂的!

更多内容,请关注“嵌入式软件实战派”!

看完别走,记得点赞、点关注啊!

图片

相关文章>>>

一块不可描述的硬盘坏了,又不好意思去修……

我在二手硬盘里发现了一堆不可描述的内容


嵌入式软件实战派 专注嵌入式软件开发领域知识传授,包括C语言精粹,RTOS原理与使用,MCU驱动开发,AUTOSAR搭建,软件架构方法设计等。
评论 (0)
  • 文/Leon编辑/cc孙聪颖‍2023年,厨电行业在相对平稳的市场环境中迎来温和复苏,看似为行业增长积蓄势能。带着对市场向好的预期,2024 年初,老板电器副董事长兼总经理任富佳为企业定下双位数增长目标。然而现实与预期相悖,过去一年,这家老牌厨电企业不仅未能达成业绩目标,曾提出的“三年再造一个老板电器”愿景,也因市场下行压力面临落空风险。作为“企二代”管理者,任富佳在掌舵企业穿越市场周期的过程中,正面临着前所未有的挑战。4月29日,老板电器(002508.SZ)发布了2024年年度报告及2025
    华尔街科技眼 2025-04-30 12:40 77浏览
  • 一、gao效冷却与控温机制‌1、‌冷媒流动设计‌采用低压液氮(或液氦)通过毛细管路导入蒸发器,蒸汽喷射至样品腔实现快速冷却,冷却效率高(室温至80K约20分钟,至4.2K约30分钟)。通过控温仪动态调节蒸发器加热功率,结合温度传感器(如PT100铂电阻或Cernox磁场不敏感传感器),实现±0.01K的高精度温度稳定性。2、‌宽温区覆盖与扩展性‌标准温区为80K-325K,通过降压选件可将下限延伸至65K(液氮模式)或4K(液氦模式)。可选配475K高温模块,满足材料在ji端温度下的性能测试需求
    锦正茂科技 2025-04-30 13:08 71浏览
  • 随着电子元器件的快速发展,导致各种常见的贴片电阻元器件也越来越小,给我们分辨也就变得越来越难,下面就由smt贴片加工厂_安徽英特丽就来告诉大家如何分辨的SMT贴片元器件。先来看看贴片电感和贴片电容的区分:(1)看颜色(黑色)——一般黑色都是贴片电感。贴片电容只有勇于精密设备中的贴片钽电容才是黑色的,其他普通贴片电容基本都不是黑色的。(2)看型号标码——贴片电感以L开头,贴片电容以C开头。从外形是圆形初步判断应为电感,测量两端电阻为零点几欧,则为电感。(3)检测——贴片电感一般阻值小,更没有“充放
    贴片加工小安 2025-04-29 14:59 121浏览
  • 你是不是也有在公共场合被偷看手机或笔电的经验呢?科技时代下,不少现代人的各式机密数据都在手机、平板或是笔电等可携式的3C产品上处理,若是经常性地需要在公共场合使用,不管是工作上的机密文件,或是重要的个人信息等,民众都有防窃防盗意识,为了避免他人窥探内容,都会选择使用「防窥保护贴片」,以防止数据外泄。现今市面上「防窥保护贴」、「防窥片」、「屏幕防窥膜」等产品就是这种目的下产物 (以下简称防窥片)!防窥片功能与常见问题解析首先,防窥片最主要的功能就是用来防止他人窥视屏幕上的隐私信息,它是利用百叶窗的
    百佳泰测试实验室 2025-04-30 13:28 76浏览
  • 在智能硬件设备趋向微型化的背景下,语音芯片方案厂商针对小体积设备开发了多款超小型语音芯片方案,其中WTV系列和WT2003H系列凭借其QFN封装设计、高性能与高集成度,成为微型设备语音方案的理想选择。以下从封装特性、功能优势及典型应用场景三个方面进行详细介绍。一、超小体积封装:QFN技术的核心优势WTV系列与WT2003H系列均提供QFN封装(如QFN32,尺寸为4×4mm),这种封装形式具有以下特点:体积紧凑:QFN封装通过减少引脚间距和优化内部结构,显著缩小芯片体积,适用于智能门铃、穿戴设备
    广州唯创电子 2025-04-30 09:02 105浏览
  • 网约车,真的“饱和”了?近日,网约车市场的 “饱和” 话题再度引发热议。多地陆续发布网约车风险预警,提醒从业者谨慎入局,这背后究竟隐藏着怎样的市场现状呢?从数据来看,网约车市场的“过剩”现象已愈发明显。以东莞为例,截至2024年12月底,全市网约车数量超过5.77万辆,考取网约车驾驶员证的人数更是超过13.48万人。随着司机数量的不断攀升,订单量却未能同步增长,导致单车日均接单量和营收双双下降。2024年下半年,东莞网约出租车单车日均订单量约10.5单,而单车日均营收也不容乐
    用户1742991715177 2025-04-29 18:28 106浏览
  • 浪潮之上:智能时代的觉醒    近日参加了一场课题的答辩,这是医疗人工智能揭榜挂帅的国家项目的地区考场,参与者众多,围绕着医疗健康的主题,八仙过海各显神通,百花齐放。   中国大地正在发生着激动人心的场景:深圳前海深港人工智能算力中心高速运转的液冷服务器,武汉马路上自动驾驶出租车穿行的智慧道路,机器人参与北京的马拉松竞赛。从中央到地方,人工智能相关政策和消息如雨后春笋般不断出台,数字中国的建设图景正在智能浪潮中徐徐展开,战略布局如同围棋
    广州铁金刚 2025-04-30 15:24 66浏览
  • 文/郭楚妤编辑/cc孙聪颖‍越来越多的企业开始蚕食动力电池市场,行业“去宁王化”态势逐渐明显。随着这种趋势的加强,打开新的市场对于宁德时代而言至关重要。“我们不希望被定义为电池的制造者,而是希望把自己称作新能源产业的开拓者。”4月21日,在宁德时代举行的“超级科技日”发布会上,宁德时代掌门人曾毓群如是说。随着宁德时代核心新品骁遥双核电池的发布,其搭载的“电电增程”技术也走进业界视野。除此之外,经过近3年试水,宁德时代在换电业务上重资加码。曾毓群认为换电是一个重资产、高投入、长周期的产业,涉及的利
    华尔街科技眼 2025-04-28 21:55 73浏览
  •  探针台的维护直接影响其测试精度与使用寿命,需结合日常清洁、环境控制、定期校准等多维度操作,具体方法如下:一、日常清洁与保养1.‌表面清洁‌l 使用无尘布或软布擦拭探针台表面,避免残留清洁剂或硬物划伤精密部件。l 探针头清洁需用非腐蚀性溶剂(如异丙醇)擦拭,检查是否弯曲或损坏。2.‌光部件维护‌l 镜头、观察窗等光学部件用镜头纸蘸取wu水jiu精从中心向外轻擦,操作时远离火源并保持通风。3.‌内部防尘‌l 使用后及时吹扫灰尘,防止污染物进入机械滑
    锦正茂科技 2025-04-28 11:45 94浏览
  • 在CAN总线分析软件领域,当CANoe不再是唯一选择时,虹科PCAN-Explorer 6软件成为了一个有竞争力的解决方案。在现代工业控制和汽车领域,CAN总线分析软件的重要性不言而喻。随着技术的进步和市场需求的多样化,单一的解决方案已无法满足所有用户的需求。正是在这样的背景下,虹科PCAN-Explorer 6软件以其独特的模块化设计和灵活的功能扩展,为CAN总线分析领域带来了新的选择和可能性。本文将深入探讨虹科PCAN-Explorer 6软件如何以其创新的模块化插件策略,提供定制化的功能选
    虹科汽车智能互联 2025-04-28 16:00 136浏览
  • 4月22日下午,备受瞩目的飞凌嵌入式「2025嵌入式及边缘AI技术论坛」在深圳深铁皇冠假日酒店盛大举行,此次活动邀请到了200余位嵌入式技术领域的技术专家、企业代表和工程师用户,共享嵌入式及边缘AI技术的盛宴!1、精彩纷呈的展区产品及方案展区是本场活动的第一场重头戏,从硬件产品到软件系统,从企业级应用到高校教学应用,都吸引了现场来宾的驻足观看和交流讨论。全产品矩阵展区展示了飞凌嵌入式丰富的产品线,从嵌入式板卡到工控机,从进口芯片平台到全国产平台,无不体现出飞凌嵌入式在嵌入式主控设备研发设计方面的
    飞凌嵌入式 2025-04-28 14:43 123浏览
  • 贞光科技代理品牌紫光国芯的车规级LPDDR4内存正成为智能驾驶舱的核心选择。在汽车电子国产化浪潮中,其产品以宽温域稳定工作能力、优异电磁兼容性和超长使用寿命赢得市场认可。紫光国芯不仅确保供应链安全可控,还提供专业本地技术支持。面向未来,紫光国芯正研发LPDDR5车规级产品,将以更高带宽、更低功耗支持汽车智能化发展。随着智能网联汽车的迅猛发展,智能驾驶舱作为人机交互的核心载体,对处理器和存储器的性能与可靠性提出了更高要求。在汽车电子国产化浪潮中,贞光科技代理品牌紫光国芯的车规级LPDDR4内存凭借
    贞光科技 2025-04-28 16:52 166浏览
我要评论
0
0
点击右上角,分享到朋友圈 我知道啦
请使用浏览器分享功能 我知道啦