Inteligência artificial aplicada ao texas hold’em: uma abordagem com aprendizado por reforço profundo e algoritmo de predição monte carlo
| dc.contributor.advisor | Lopes, Kennedy Reurison | |
| dc.contributor.advisormail | kennedy.lopes@ufersa.edu.br | |
| dc.contributor.author | Grangeiro, Pedro Hércules Souza | |
| dc.contributor.referee1 | Lopes, Kennedy Reurison | |
| dc.contributor.referee2 | Rego, Rosana Cibely Batista | |
| dc.contributor.referee3 | Maia, Marcos Daniel Nogueira | |
| dc.coverage.spatial | Pau dos Ferros | |
| dc.date.accessioned | 2026-07-21T12:47:12Z | |
| dc.date.available | 2026-07-21T12:47:12Z | |
| dc.date.issued | 2026-06-23 | |
| dc.description.abstract | Este trabalho tem por objetivo o desenvolvimento de um agente inteligente utilizando redes neurais de aprendizado profundo para jogar o pôquer Texas Hold’Em. Tendo em vista que o jogo possui uma quantidade quase infinita de estados e acesso incompleto a informações, agentes por aprendizado tendem a cair em ótimos locais e ficarem estagnados sem evoluir. Este trabalho utilizou da técnica de Deep Q-Network (DQN) e algoritmos de predição Monte Carlo, além de modelagem de recompensa e de um motor base 15 capaz de executar desempates de maneira robusta, usufruindo da Application Programming Interface (API) TensorFlow.js usando a ferramenta Node.js para desenvolvimento. Os gráficos gerados mostram o sucesso do agente, demonstrando o ganho de fichas de maneira concisa, perdendo menos do que ganhando, exibindo os locais em que o agente explorava e onde o mesmo explotava para receber o máximo possível de fichas. Tornando assim a explotação uma tática viável para agentes que jogam o Texas Hold’Em, já que eles conseguiam explorar as falhas dos rivais, também dispensando a necessidade de supercomputadores. A utilização de JavaScript permite a implementação do agente por meio de uma arquitetura assíncrona, que permite integração de maneira prática e eficaz. | |
| dc.description.abstract2 | This work aims to develop an intelligent agent using deep neural networks to play Texas Hold’Em poker. Given that the game features a nearly infinite number of states and incomplete access to information, learning agents tend to fall into local optima and stagnate without evolving. This work utilized the DQN technique and Monte Carlo prediction algorithms, alongside reward modeling and a base-15 engine capable of robustly handling tie-breakers, leveraging the Ten sorFlow.js API and the Node.js runtime environment for development. The generated graphsdemonstrate the agent’s success, showing a consistent gain in chips—losing less than it wins—and exhibiting the states where the agent explored and where it exploited to maximize its chip returns. This makes exploitation a viable tactic for Texas Hold’Em agents, as they were able to exploit their opponents’ flaws, while also eliminating the need for supercomputers. The use of JavaScript enables the agent’s implementation through an asynchronous architecture, allowing for practical and effective integration. | |
| dc.description.physical | 49 f. | |
| dc.format.mimetype | ||
| dc.identifier.bibliographicCitation | GRANJEIRO, Pedro Hércules Souza. Inteligência artificial aplicada ao texas hold’em: uma abordagem com aprendizado por reforço profundo e algoritmo de predição monte carlo. 49 f. 2026. Monografia (Bacharelado Interdisciplinar em Tecnologia da Informaçãom) – Centro Multidisciplinar de Pau dos Ferros, Universidade Federal Rural do Semi-Árido, Pau dos Ferros, 2026. | |
| dc.identifier.uri | https://repositorio.ufersa.edu.br/handle/prefix/15436 | |
| dc.language.iso | pt_BR | |
| dc.publisher.center | Centro Multidisciplinar de Pau dos Ferros - CMPF | |
| dc.publisher.country | Brasil | |
| dc.publisher.department | Departamento de Engenharias e Tecnologia - DETEC | |
| dc.publisher.initials | UFERSA | |
| dc.publisher.institution | Universidade Federal Rural do Semi-Árido | |
| dc.rights | info:eu-repo/semantics/openAccess | |
| dc.rights.holder | UFERSA | |
| dc.rights.license | CC0 1.0 Universal | en |
| dc.rights.uri | http://creativecommons.org/publicdomain/zero/1.0/ | |
| dc.subject.cnpq | CIENCIAS EXATAS E DA TERRA::TECNOLOGIA DA INFORMACAO | |
| dc.subject.keyword | Inteligência artificial | |
| dc.subject.keyword | Texas hold'em | |
| dc.subject.keyword | Deep q-network | |
| dc.subject.keyword | Modelagem de recompensas | |
| dc.subject.keyword | TensorFlow.js | |
| dc.title | Inteligência artificial aplicada ao texas hold’em: uma abordagem com aprendizado por reforço profundo e algoritmo de predição monte carlo | |
| dc.type | info:eu-repo/semantics/bachelorThesis |
