計算機視覺實戰-語意分割與目標偵測
賈壯
- 出版商: 中國鐵道
- 出版日期: 2024-07-01
- 售價: $479
- 貴賓價: 9.5 折 $455
- 語言: 簡體中文
- 頁數: 270
- 裝訂: 平裝
- ISBN: 7113312225
- ISBN-13: 9787113312220
-
相關分類:
Computer Vision
立即出貨 (庫存 < 4)
買這商品的人也買了...
-
FreeRTOS 內核實現與應用開發實戰指南 — 基於 STM32$594$564 -
$1,014ROS 機器人編程:原理與應用 (A Systematic Approach to Learning Robot Programming with ROS) -
$351ROS 機器人編程與 SLAM 算法解析指南 -
$294無人機詳解與剖析 -
$214ROS2 源代碼分析與工程應用 -
$601大疆無人機二次開發教程:基於 Mobile SDK 與 UX SDK -
$327智能機器人開發與實踐 -
$594無人機編程實戰:基於 ArduPilot 和 Pixhawk (Advanced Robotic Vehicles Programming: An Ardupilot and Pixhawk Approach) -
$402OpenCV 4.5 電腦視覺開發實戰:基於 Python -
$611計算機視覺 40例從入門到深度學習 (OpenCV-Python) -
GPT5 新時代 - 多模態深度學習精實操練$680$537 -
$407計算機視覺核心技術演算法與開發實戰 -
$703深度學習 — 智慧機器人應用的理論與實踐 -
$611精通 ROS 機器人編程 (原書第3版) -
無人機應用開發指南:基於大疆 Payload SDK$474$450 -
$407機器人作業系統 (ROS2) 入門與實踐 -
AI 圖片增強 - 影像畫質演算法及深層視覺技術$980$774 -
$382視頻智能分析與理解 -
$606ROS 2 智能機器人開發實踐 -
讓 AI 好好說話!從頭打造 LLM (大型語言模型) 實戰秘笈$680$537 -
$305Python預訓練視覺和大語言模型 -
$559ROS 地面無人系統開發實踐和進階 -
AI Vision × LLM 電腦視覺應用聖經:OpenCV × YOLO × Ollama 解鎖多模態全攻略$880$695 -
視覺語言模型 VLM 原理與實戰$594$564 -
模式識別與機器學習$1,193$1,133
簡體書新到貨|2書75折 (8/25--8/31) 詳見活動內容 »
-
VIP 95折
量子計算與人工智能$648$615 -
VIP 95折
圖解Skill+OpenClaw:零代碼打造你的AI智能助手$414$393 -
VIP 95折
OpenClaw快速上手極簡部署與實戰$299$284 -
VIP 95折
LangChain與大語言模型應用開發實踐$299$284 -
85折
$1,014系統安全工程導論 -
85折
$351機器人學基礎 第4版 -
85折
$254國產龍蝦實操手冊:12款OpenClaw國產AI工具零基礎入門+全場景應用(視頻教學版) -
85折
$606openvela輕量系統開發實戰 -
85折
$504智能網聯汽車:AUTOSAR Adaptive平臺技術體系與應用指南 -
VIP 95折
智能體的超級大腦:大模型工作原理揭秘$359$341 -
VIP 95折
30天輕松學會SQL$599$569 -
VIP 95折
大模型賦能的智能體系統原理與實踐$299$284 -
VIP 95折
先進智能感知技術與應用$1,008$957 -
VIP 95折
視覺智能 — 技術前沿與應用探索$894$849 -
VIP 95折
分布式數據庫系統:原理解析與架構設計$474$450 -
VIP 95折
理解深度學習$534$507 -
VIP 95折
AI 優先:面向未來的企業和品牌行動指南$414$393 -
VIP 95折
玩賺 AI 短視頻 : DeepSeek + 即夢 + 剪映 打造爆款視頻$474$450 -
VIP 95折
飛書雲端安全養蝦 極簡OpenClaw實操手冊$479$455 -
VIP 95折
雲網融合的新型網絡架構$594$564 -
VIP 95折
Seedance創富手冊:零基礎做電商帶貨和自媒體$474$450 -
VIP 95折
Python辦公自動化:基於銀河麒麟(Kylin)系統的實現方法$414$393 -
VIP 95折
自然語言處理實踐:語義理解與信息抽取$534$507 -
VIP 95折
大模型應用$354$336 -
VIP 95折
生成式大模型項目實戰(微課版)$359$341
相關主題
商品描述
本書主要介紹了電腦視覺中的語意分割和目標偵測的相關技術,
重點講解了任務設定和度量指標、基於深度學習的經典模型和演算法方案。
另外,對於分割和偵測任務中的小樣本、弱監督、小目標等特殊設定下的演算法想法和方案也透過典型模型進行了講解。
同時,書中也提供了多個簡單易上手的語意分割與目標偵測的實戰項目。
目錄大綱
第1章 深度學習與電腦視覺基礎知識
1.1 深度學習與人工智能
1.1.1 人工智能歷史回顧
1.1.2 深度學習原理及其應用簡介
1.2 電腦視覺及其應用場景簡介
1.3 開始之前的準備工作
1.3.1 程式碼工具準備
1.3.2 相關數學工具準備
第2章 神經網絡模型:原理、模型與流程
2.1 神經網絡模型的基本原理
2.1.1 神經元與人工神經網絡
2.1.2 梯度下降與反向傳播演算法(BP演算法)
2.1.3 神經網絡的正規化策略
2.2 捲積神經網絡與註意力機制
2.2.2 註意力機制與Vision Transformer
2.3 神經網絡模型訓練與推理的一般流程
2.3.1 訓練流程:資料增強、優化器與策略調整器
2.3.2 推理流程:測驗時增強與量化部署
第3章 語意分割演算法原理
3.1 語意分割任務概述
3.1.1 語意分割的目標與傳統方案
3.1.2 語意分割的困難點
3.1.3 語意分割的度量指標
3.1.4 語意分割的應用場景
3.2 語意分割的代表性模型
3.2.1 FCN:從影像分類到像素級分割
3.2.2 Unet和Unet++:U刑對稱業解碼網故及其增強版
3.2.3 DeepLab系列:基於空洞捲積的分割網絡
3.2.4 PSPNet:金字塔池化的特徵融合
3.2.5 OCRNet:如何利用目標情境訊息
3.2.6 Segmenter:基於Transformer的端對端分割
3.2.7 PointRend;針對物體邊緣分割的最佳化
3.2.8 Segment Anything:prompt驅動的分割大模型
3.3 小樣本、弱監督和交互式語意分割
3.3.1 小樣本分割任務與模型
3.3.2 弱監督語意分割任務與模型
3.3.3 交互式分割任務與模型
第4章 語意分割項目實戰
4.1 DeepLabV3+網絡的寵物分割識別
4.1.1 任務描述與資料集準備
4.1.2 程式碼庫基本情況說明
4.1.3 相關設定檔配置與訓練
4.1.4 基線網絡訓練效果測試
4.1.5 實驗最佳化與結果分析
4.2 Unet++的視網膜血管分割
4.2.1 任務描述與資料集準備
4.2.2 資料讀取代碼修改
4.2.3 模型訓練與效果測試
4.3 Segment Anything是基於prompt的分割
4.3.1 Segment Anything程式碼庫簡介
4.3.2 本地配置與分割功能測試
4.3.3 基於SAM的交互式分割程式碼開發與實驗
第5章 目標偵測演算法原理
5.1 目標偵測任務概述
5.1.1 目標檢測方法的發展
5.1.2 目標偵測的困難點
5.1.3 目標偵測方法的評估準則
5.1.4 目標偵測的應用場景
5.2 目標偵測經典模型
5.2.1 R-CNN:從傳統方法到CNN方法
5.2.2 SPP-net:空間金字塔池化網絡
5.2.3 Fast R-CNN和Faster R-CNN:R-CNN的演化
5.2.4 YOLO:單階段目標偵測器的代表模型
5.2.5 SSD:多尺度預測目標偵測器
5.2.6 FPN:特徵金宇塔用於目標偵測
5.2.7 RetinaNet;樣本平衡問題與Focal Loss
5.2.8 Mask R-CNN:RolAlign與實例分割
5.2.9 無錨框的目標偵測範式:ConerNet、CenterNet和FCOS
5.2.10 YOLO的演化:從v2到v
5.2.11 DETR:基於Transformer的偵測框預測
5.3 小目標偵測與旋轉目標偵測
5.3.1 小目標偵測任務與方案
5.3.2 旋轉目標偵測任務與模型
第6章 目標偵測項目實戰
6.1 實戰一:基於YOLOv8的口罩人臉偵測
6.1.1 YOLOv8程式碼庫簡介
6.1.2 任務簡述與資料集獲取
6.1.3 模型訓練與效果評估
6.2 實戰二:Faster R-CNN交通車偵測識別
6.2.1 任務與資料集概述
6.2.2 MMDetection程式碼庫簡介與配置
6.2.3 Faster R-CNN訓練與結果驗證
6.3 實戰三:即時手勢偵測辨識流程搭建實驗
6.3.1 任務目標與整體流程
6.3.2 資料採集標註與資料集準備
6.3.3 模型訓練與導出
6.3.4 即時手勢監測與辨識demo測試
後記
參考文獻
