Chen Yin-ChenCYCU Biz Design
Home
Semester 1・AI
RingkasanMemprediksi duniaSejarah AILab AIBelajar mandiri
Semester 2・Programming
RingkasanJS Basic TutorialJavaScriptP5.js (Lecture)Computational Thinking & ProgrammingGames
Eksplorasi
Human Motion SystemAstrology SystemArchitecture SystemIndigenous Loom
About
AboutSchedule

Language

Traditional ChineseSimplified ChineseEnglishJapaneseBahasa Indonesia

Chen Yin-Chen

Business Design Department, Chung Yuan Christian University
Zishen Technology

Quick Links

  • About
  • Schedule
  • Games
  • JavaScript

Contact & Social

© 2026 Chen Yin-Chen。All rights reserved。

Built with Next.js & Tailwind CSS

🧪 總覽📜 AI 歷史📖 理論概念💻 上機實驗🎯 強化學習

AI 實驗室 · 強化學習 · 可打分

貪食蛇

調吃果/死亡/每步成本與學習參數,訓練蛇活得久、吃得多。

目標:整局總分最高

真正要優化的是整局吃了幾顆,不是「下一秒有沒有吃到」。 「馬上追果」常常把路堵死;「長遠總分」會在不安全時故意晚點吃,改走 S 形掃場。 過關看平均吃果 ≥ 12(Q 學習需先訓練)。

●
🍎

本局吃了 0 顆 · 步數 0

訓練後會顯示:橫軸=訓練局數,縱軸=平均吃果數

策略(比的是整局總分)

建議先選「長遠總分」按測平均分/看這一局,再對照「貪心追果」——同樣規則下,誰的整局總分高就對了。 Q 學習若獎勵太強調立刻吃果,會學成貪心,難學到長遠策略。