{
  "text": "这几天 DeepSeek-V4-Flash 模型正式发布公测了 Agent 能力强 性价比极高 直接秒了一大半其他模型 更香的是 它原生支持了 Responses API 只要 2 分钟 我就能带你把 DeepSeek 接入 Codex 并成功识图\n节省上百块订阅费 首先打开 DeepSeek 的 API 开放平台 创建一个 API Key 这是调用 AI 大模型的凭证 一定要保存好 然后打开 DeepSeek 官方文档 可以看到它提供了一键配置脚本\n能够自动完成接入 Codex 的配置 注意 运行前要确保已经安装 Codex 命令行工具或者 ChatGPT 桌面 APP 并且至少运行过一次 然后根据操作系统复制对应的命令 打开终端 粘贴命令并执行\n脚本会引导你选择接入哪个模型 输入 1 使用 v4 flash 回车 然后输入前面获取到的 API Key 注意不要对外泄露哦 回车 唰唰唰 脚本就会修改 Codex 配置 把 DeepSeek 接入到 Codex 中了\n最后重新打开 Codex 看到了对应的模型名称 就可以愉快地对话使用了 桌面 APP 也已经成功接入了 不用单独配置 是不是很简单 比我之前分享的用 CC Switch 工具 来接入国产模型要方便多了 请大家在弹幕打出 梁圣恩情还不完\n不过可惜的是 DeepSeek-V4-Flash 是纯文本模型 不能识别理解图片 所以我们需要给 AI 编程工具 装一个识图 Skill 引导 AI 用另一个多模态视觉模型来帮它看图 先准备一个支持图片理解的视觉模型 比如最新的 Qwen3.8-Max\n并且到对应的大模型平台 获取到模型的 API Key 然后直接在 Codex 中发一段提示词 让 AI 帮你完成识图 Skill 的安装和配置 安装完成后 当 AI 需要看图时 识图 Skill 就会自动把图片发给视觉模型\n让它把图片内容转成文字描述 再交给 DeepSeek 继续推理 好了 这下学习 AI 编程的门槛更低了 那我之前出过 Codex 的保姆级教程 放到了我免费开源的 AI 编程零基础教程上 有帮助的话记得点赞收藏三连哦 拜拜",
  "language": "zh",
  "duration": 158.081438,
  "segments": [
    {
      "start": 0.133,
      "end": 18.566,
      "text": "这几天 DeepSeek-V4-Flash 模型正式发布公测了 Agent 能力强 性价比极高 直接秒了一大半其他模型 更香的是 它原生支持了 Responses API 只要 2 分钟 我就能带你把 DeepSeek 接入 Codex 并成功识图",
      "source": "source_caption"
    },
    {
      "start": 18.7,
      "end": 37.366,
      "text": "节省上百块订阅费 首先打开 DeepSeek 的 API 开放平台 创建一个 API Key 这是调用 AI 大模型的凭证 一定要保存好 然后打开 DeepSeek 官方文档 可以看到它提供了一键配置脚本",
      "source": "source_caption"
    },
    {
      "start": 37.5,
      "end": 56.6,
      "text": "能够自动完成接入 Codex 的配置 注意 运行前要确保已经安装 Codex 命令行工具或者 ChatGPT 桌面 APP 并且至少运行过一次 然后根据操作系统复制对应的命令 打开终端 粘贴命令并执行",
      "source": "source_caption"
    },
    {
      "start": 57.1,
      "end": 75.266,
      "text": "脚本会引导你选择接入哪个模型 输入 1 使用 v4 flash 回车 然后输入前面获取到的 API Key 注意不要对外泄露哦 回车 唰唰唰 脚本就会修改 Codex 配置 把 DeepSeek 接入到 Codex 中了",
      "source": "source_caption"
    },
    {
      "start": 75.433,
      "end": 96.433,
      "text": "最后重新打开 Codex 看到了对应的模型名称 就可以愉快地对话使用了 桌面 APP 也已经成功接入了 不用单独配置 是不是很简单 比我之前分享的用 CC Switch 工具 来接入国产模型要方便多了 请大家在弹幕打出 梁圣恩情还不完",
      "source": "source_caption"
    },
    {
      "start": 99.8,
      "end": 119.966,
      "text": "不过可惜的是 DeepSeek-V4-Flash 是纯文本模型 不能识别理解图片 所以我们需要给 AI 编程工具 装一个识图 Skill 引导 AI 用另一个多模态视觉模型来帮它看图 先准备一个支持图片理解的视觉模型 比如最新的 Qwen3.8-Max",
      "source": "source_caption"
    },
    {
      "start": 120.3,
      "end": 138.966,
      "text": "并且到对应的大模型平台 获取到模型的 API Key 然后直接在 Codex 中发一段提示词 让 AI 帮你完成识图 Skill 的安装和配置 安装完成后 当 AI 需要看图时 识图 Skill 就会自动把图片发给视觉模型",
      "source": "source_caption"
    },
    {
      "start": 139.1,
      "end": 157.866,
      "text": "让它把图片内容转成文字描述 再交给 DeepSeek 继续推理 好了 这下学习 AI 编程的门槛更低了 那我之前出过 Codex 的保姆级教程 放到了我免费开源的 AI 编程零基础教程上 有帮助的话记得点赞收藏三连哦 拜拜",
      "source": "source_caption"
    }
  ],
  "transcript_selection": {
    "schema": "videonote.transcript_selection.v1",
    "status": "SELECTED",
    "requested_language": "zh",
    "duration": 158.081438,
    "reference_path": "/Users/sagawa/AI_WORK/video_notes/url/20260806_205314__DeepSeek_V4_Flash_接入_Codex_识图_2_分钟搞定_ai_codex_deepseek_ai编程_vibecoding_程序员/reference_subtitle.vtt",
    "reference_kind": "manual",
    "reference_language": "zh",
    "selected_source": "youtube_manual",
    "decision_reason": "trusted_full_source_selected_after_cross_check",
    "whisper_rejected": false,
    "source_profile": {
      "segment_count": 8,
      "first_start": 0.133,
      "final_end": 157.866,
      "duration_coverage": 0.998637,
      "maximum_gap_seconds": 3.367,
      "inverted_count": 0,
      "language": {
        "requested": "zh",
        "matched": true,
        "latin": 209,
        "han": 550,
        "kana": 0,
        "hangul": 0
      },
      "hallucination_region_count": 0,
      "hallucination_regions": [],
      "usable_full": true,
      "usable_partial": true
    },
    "whisper_profile": {
      "segment_count": 35,
      "first_start": 0.0,
      "final_end": 158.0,
      "duration_coverage": 0.999485,
      "maximum_gap_seconds": 2.0,
      "inverted_count": 0,
      "language": {
        "requested": "zh",
        "matched": true,
        "latin": 200,
        "han": 559,
        "kana": 0,
        "hangul": 0
      },
      "hallucination_region_count": 0,
      "hallucination_regions": [],
      "usable_full": true,
      "usable_partial": true
    },
    "comparison": {
      "window_seconds": 30.0,
      "compared_window_count": 6,
      "median_score": 0.6597,
      "divergent_window_count": 0,
      "divergent_ratio": 0.0,
      "divergent_windows": []
    }
  }
}