All authors

Claude Skills by hiyenwong
github.com/hiyenwong9,934 skills5 installs19,223 views
- Arxiv 2608 26950v1 From Atomic To Agentic Towards Interpretable Evalu**arXiv ID:** 2608.26950v1 **Authors:** Jiayi Kuang, Yinghui Li, Yunze Song, Keyu Chen, Zhifeng Shen, Yangning Li, Yidong Wang, Di Yin, Ruizhi Qiao, Xing Sun, Kai Jin, Ying Shen, Liang Lin, Philip S. Yu **URL:** http://arxiv.org/abs/2608.26950v1 **Utility Score:** 1.00Votes: 0GitHub stars: 3
- Arxiv 2608 27127v1 Transmeme A Multi Agent Framework For Cross Cultur**arXiv ID:** 2608.27127v1 **Authors:** Jingyi Zheng, Yule Liu, Zifan Peng, Tianyi Hu, Yuemeng Zhao, Xinhu Zheng, Xinlei He **URL:** http://arxiv.org/abs/2608.27127v1 **Utility Score:** 1.00Votes: 0GitHub stars: 3
- Arxiv 2608 27260v1 What Makes Good Agentic Data An Ace Lens On Data G**arXiv ID:** 2608.27260v1 **Authors:** Xingshan Zeng, Zishan Xu, Boju Zhang, Yuzhou Wu, Lingzhi Wang, Jianghao Lin, Liangyou Li, Yasheng Wang, Lifeng Shang, Xin Jiang, Weinan Zhang, Yong Yu, Qun Liu, Weiwen Liu **URL:** http://arxiv.org/abs/2608.27260v1 **Utility Score:** 1.00Votes: 0GitHub stars: 3
- Arxiv 2608 27439v1 Redevoagent Automatic Red Teaming Agent With Exper**arXiv ID:** 2608.27439v1 **Authors:** Junjie Zhang, Hui Liu, Kecheng Chen, Xianbo Mo, Changsheng Chen, Haoliang Li **URL:** http://arxiv.org/abs/2608.27439v1 **Utility Score:** 1.00Votes: 0GitHub stars: 3
- Arxiv 2608 27454v1 Wikiskill Compiling Agent Experience Into Persiste**arXiv ID:** 2608.27454v1 **Authors:** Liyan Tang, Cyrus Rashtchian, Chun-Sung Ferng, Andrew Tomkins, Da-Cheng Juan, Tu Vu **URL:** http://arxiv.org/abs/2608.27454v1 **Utility Score:** 1.00Votes: 0GitHub stars: 3
- Arxiv 2608 30603v1 Diffsac Diffusion Guided Sampling For Consensus Ba**arXiv ID:** 2608.30603v1 **Authors:** Chang Nie, Guangming Wang, Zhe Liu, Hesheng Wang **URL:** http://arxiv.org/abs/2608.30603v1 **Utility Score:** 1.00Votes: 0GitHub stars: 3
- Arxiv 2608 30672v1 Hirs Agent A Hierarchical Multi Agent System For R**arXiv ID:** 2608.30672v1 **Authors:** Boyang Mu, Zhiwei Wei, Mugen Peng, Wenjia Xu **URL:** http://arxiv.org/abs/2608.30672v1 **Utility Score:** 1.00Votes: 0GitHub stars: 3
- Arxiv 2608 30676v1 Medagent R1 Faithfulness Aware Reinforcement Learn**arXiv ID:** 2608.30676v1 **Authors:** Jiangwang Chen, Chenghao Zhang, Hengxing Cai **URL:** http://arxiv.org/abs/2608.30676v1 **Utility Score:** 1.00Votes: 0GitHub stars: 3
- Arxiv 2608 30702v1 An Agentic Retrobiosynthesis Framework With Learne**arXiv ID:** 2608.30702v1 **Authors:** Philippe Meyer, Guillaume Gricourt, Thomas Duigou, Joan Hérisson, Jean-Loup Faulon **URL:** http://arxiv.org/abs/2608.30702v1 **Utility Score:** 1.00Votes: 0GitHub stars: 3
- Arxiv 2608 30724v1 Baitbench Measuring Agent Reward Hacking With Opti**arXiv ID:** 2608.30724v1 **Authors:** Pradyumna Shyama Prasad, Meiri Anto, Leon Eshuijs, Julian Moncarz, Kaustubh Kislay, Juan J. Vazquez **URL:** http://arxiv.org/abs/2608.30724v1 **Utility Score:** 1.00Votes: 0GitHub stars: 3
- Arxiv 2608 30753v1 Learning From What You Retrieve Online Rl Fine Tun**arXiv ID:** 2608.30753v1 **Authors:** Shaowei Wei, Chong Huang, Songtao Fang, Jin Zhang, Zhuojun Wang, Chengfu Huo **URL:** http://arxiv.org/abs/2608.30753v1 **Utility Score:** 1.00Votes: 0GitHub stars: 3
- Arxiv 2608 30765v1 T3s Improving Multi Task Reinforcement Learning Wi**arXiv ID:** 2608.30765v1 **Authors:** Yuanqiang Yu, Tianpei Yang, Yongliang Lv, Yan Zheng, Jianye Hao **URL:** http://arxiv.org/abs/2608.30765v1 **Utility Score:** 1.00Votes: 0GitHub stars: 3
- Arxiv 2608 30952v1 One Policy Is Enough Single Agent Reinforcement Le**arXiv ID:** 2608.30952v1 **Authors:** Armin Dariani, Sifan Wu, Bang Liu, Entao Yang **URL:** http://arxiv.org/abs/2608.30952v1 **Utility Score:** 1.00Votes: 0GitHub stars: 3
- Arxiv 2608 30976v1 A Human In The Loop Autonomous Agent For Industry**arXiv ID:** 2608.30976v1 **Authors:** Xiaoyu Tao, Mingyue Cheng, Ze Guo, Bokai Pan, Qi Liu, Shijin Wang, Enhong Chen **URL:** http://arxiv.org/abs/2608.30976v1 **Utility Score:** 1.00Votes: 0GitHub stars: 3
- Arxiv 2608 31057v1 Measure Before You Manage Evaluating Agent Working**arXiv ID:** 2608.31057v1 **Authors:** Le Chen, Zishen Wan, Baixi Sun, Xiaolong Ma, Chih-Hsuan Yang, Feng Yan, Sheng Di, Franck Cappello, Rajeev Thakur **URL:** http://arxiv.org/abs/2608.31057v1 **Utility Score:** 1.00Votes: 0GitHub stars: 3
- Arxiv 2609 00577v1 Geopar Large Scale Multi Agent Combinatorial Optim**arXiv ID:** 2609.00577v1 **Authors:** Wenjian Wu, Zesheng Jia, Jiaying Tang, Benyuan Yang, Jin Wang **URL:** http://arxiv.org/abs/2609.00577v1 **Utility Score:** 1.00Votes: 0GitHub stars: 3
- Arxiv 2609 01811v1 Reinforcement Learning To Choose Optimizers**arXiv ID:** 2609.01811v1 **Authors:** Martin van der Schelling, Deepesh Toshniwal, Miguel A. Bessa **URL:** http://arxiv.org/abs/2609.01811v1 **Utility Score:** 1.00Votes: 0GitHub stars: 3
- Arxiv 2609 02095v1 Ready Or Not Reliable Enterprise Agent Deployment**arXiv ID:** 2609.02095v1 **Authors:** Veronica Chatrath, Bryan Zhu, Jingxuan Fan, George Pu, Soham Dinesh Tiwari, Soham Dan, Ryan Young, Yuan, Li, Yuang Yao, Apaar Shanker, Minglai Yang, Daniel Yue Zhang, Yunzhong He, Ying Liu, Chenguang Wang, Zhijun Yin, Yuan Xue **URL:** http://arxiv.org/abs/2609.02095v1 **Utility Score:** 1.00Votes: 0GitHub stars: 3
- Arxiv 2609 02170v1 Dmrl Document Mediated Reinforcement Learning For**arXiv ID:** 2609.02170v1 **Authors:** Wei Zhang, Hongji Li, Song Sun, Peng Yu, Xue Yang, Lei Zhao, Peng Jiang **URL:** http://arxiv.org/abs/2609.02170v1 **Utility Score:** 1.00Votes: 0GitHub stars: 3
- Arxiv 2609 02191v1 Examining The Vulnerability Of Multi Agent Medical**arXiv ID:** 2609.02191v1 **Authors:** Benjamin C Liu, Dillon Mehta, Rishi Malhotra, Adam Zobian, Yong Ying Tan, Samir Chopra, Daniella Rand, Natalie Pang, Abhiram Gudimella, Kevin Zhu **URL:** http://arxiv.org/abs/2609.02191v1 **Utility Score:** 1.00Votes: 0GitHub stars: 3
- Arxiv 2609 02216v1 Pearl Path Entity Aligned Relational Learning With**arXiv ID:** 2609.02216v1 **Authors:** Yunchi Yang, Longlong Li, Cunquan Qu **URL:** http://arxiv.org/abs/2609.02216v1 **Utility Score:** 1.00Votes: 0GitHub stars: 3
- Arxiv 2609 02253v1 Apex Distillation Of Agent Procedural Experience F**arXiv ID:** 2609.02253v1 **Authors:** Jie Ding, Rui Sun, Xinyuan Zhang, Zeyu Zhang, Xin Liu **URL:** http://arxiv.org/abs/2609.02253v1 **Utility Score:** 1.00Votes: 0GitHub stars: 3
- Arxiv 2609 02566v1 Online Reinforcement Learning In The Met Office Un**arXiv ID:** 2609.02566v1 **Authors:** Pritthijit Nath, Sebastian Schemm, Peter Haynes, Emily Shuckburgh, Mark Webb **URL:** http://arxiv.org/abs/2609.02566v1 **Utility Score:** 1.00Votes: 0GitHub stars: 3
- Arxiv 2609 02677v1 Eliciting Esg Preferences For Reinforcement Learni**arXiv ID:** 2609.02677v1 **Authors:** Giovanni Dispoto, Marcello Restelli, Carmine Ventre **URL:** http://arxiv.org/abs/2609.02677v1 **Utility Score:** 1.00Votes: 0GitHub stars: 3
- Arxiv 2609 03416v1 Dude A Dual Detection Multi Agent System For Paper**arXiv ID:** 2609.03416v1 **Authors:** Weijie Liu, Running Zhao, Wenhao Yuan, Jinfeng Xu, Zhanfeng Xu, Xiaoxi Zhang, Edith Cheuk-Han Ngai **URL:** http://arxiv.org/abs/2609.03416v1 **Utility Score:** 1.00Votes: 0GitHub stars: 3
- Arxiv 2609 03619v1 Remember And Reweight Enhancing Multi Agent Debate**arXiv ID:** 2609.03619v1 **Authors:** Xuanfa Jin, Zhijian Ma, Yongcheng Zeng, Xinyu Cui, Haifeng Zhang, Jun Wang **URL:** http://arxiv.org/abs/2609.03619v1 **Utility Score:** 1.00Votes: 0GitHub stars: 3
- Arxiv 2609 03753v1 Simskill A Lifelong Learning Ai Agent For Autonomo**arXiv ID:** 2609.03753v1 **Authors:** Qi Liu, Qinzheng Wang, Yiming Bie **URL:** http://arxiv.org/abs/2609.03753v1 **Utility Score:** 1.00Votes: 0GitHub stars: 3
- Arxiv 2609 03860v1 Adapting To Evolving Requirements Agentic Ai For R**arXiv ID:** 2609.03860v1 **Authors:** Lei Zheng, Liping Yang, Zihao Li, Guodong Lyu, Chaik Ming Koh, Chung-Piaw Teo **URL:** http://arxiv.org/abs/2609.03860v1 **Utility Score:** 1.00Votes: 0GitHub stars: 3
- Arxiv 2609 03920v1 Value Preserving Architectures For Agentic Ai Syst**arXiv ID:** 2609.03920v1 **Authors:** Alessandro Pesare, Tommaso Dolci, Katja Hose, Emanuel Sallinger **URL:** http://arxiv.org/abs/2609.03920v1 **Utility Score:** 1.00Votes: 0GitHub stars: 3
- Arxiv 2609 03955v1 Two Stage Reinforcement Learning For Sound And Adv**arXiv ID:** 2609.03955v1 **Authors:** Jiacheng Xu, Wentao Zhang, Zhiyi Lyu, Fuxiang Zhang, Chaojie Wang, Yang Liu, Bo An **URL:** http://arxiv.org/abs/2609.03955v1 **Utility Score:** 1.00Votes: 0GitHub stars: 3
- Arxiv 2609 03977v1 Cooperative Multi Task Semantic Communication For**arXiv ID:** 2609.03977v1 **Authors:** Ahmad Halimi Razlighi, Mohammad Siddiqur Rahman, Maximilian H. V. Tillmann, Edgar Beck, Armin Dekorsy **URL:** http://arxiv.org/abs/2609.03977v1 **Utility Score:** 1.00Votes: 0GitHub stars: 3
- Arxiv 2609 04048v1 Translation As A Decision Space A Multi Agent Pers**arXiv ID:** 2609.04048v1 **Authors:** Hasan Alkhder, Mohammad Abboush, Igor Tchappi, Ahmet Zengin, Amro Najjar **URL:** http://arxiv.org/abs/2609.04048v1 **Utility Score:** 1.00Votes: 0GitHub stars: 3
- Arxiv 2609 04148v1 Terminal Universe Turning Agent Trajectories Into**arXiv ID:** 2609.04148v1 **Authors:** Jie Wu, Zhenru Zhang, Beichen Zhang, Xuwu Wang, Yuhui Su, Mouxiang Chen, Peng Wang, Zhihai Wang, Que Shen, Hao Zhou, An Yang, Fei Huang, Yujiu Yang, Dayiheng Liu **URL:** http://arxiv.org/abs/2609.04148v1 **Utility Score:** 1.00Votes: 0GitHub stars: 3
- Arxiv 2609 04159v1 Sentinel Rl Offloading Topological Reasoning From**arXiv ID:** 2609.04159v1 **Authors:** Uday Vallabhaneni, Cassie L. Cagwin, David J. Wild **URL:** http://arxiv.org/abs/2609.04159v1 **Utility Score:** 1.00Votes: 0GitHub stars: 3
- Arxiv 2609 08273v1 Memforest Efficient Agent Memory Management Via Ev**arXiv ID:** 2609.08273v1 **Authors:** Junxi Wang, Te Sun, Jiayi Zhu, Chen Zhang, Siyuan Li, Xuyang Liu, Zichen Wen, Xiaobing Tu, Jinkui Ren, Xiantao Zhang, Ziqi Yuan, Linfeng Zhang **URL:** http://arxiv.org/abs/2609.08273v1 **Utility Score:** 1.00Votes: 0GitHub stars: 3
- Arxiv 2609 08642v1 Sun Reaching For Novelty In Reinforcement Learning**arXiv ID:** 2609.08642v1 **Authors:** Wenyan Yang, Arsenii Mustafin, Dominik Baumann, Joni Pajarinen, Simone Parisi **URL:** http://arxiv.org/abs/2609.08642v1 **Utility Score:** 1.00Votes: 0GitHub stars: 3
- Arxiv 2609 08719v1 Goant Quality Diversity Multi Agent Search For Alp**arXiv ID:** 2609.08719v1 **Authors:** Stella Zhao, Tommy Sha **URL:** http://arxiv.org/abs/2609.08719v1 **Utility Score:** 1.00Votes: 0GitHub stars: 3
- Arxiv 2609 08977v1 Omni Interaction Agent Technical Report**arXiv ID:** 2609.08977v1 **Authors:** Orantqing, Shengpeng Ji, Junlong Tong, Jialong Zuo, Dongjie Fu, Di Cao, Yangzhuo Li, Shangda Wu, Franz, Evan, Theron Veyra, Changhao Pan, Jingyu Lu, Dongchao Yang, Zhifei Xie, Yang Tan, Xiaoyu Shen, Xiaoda Yang, Wenfu Wang, Teddysun, Steveyves, Zhou Zhao, Bryanytian **URL:** http://arxiv.org/abs/2609.08977v1 **Utility Score:** 1.00Votes: 0GitHub stars: 3
- Arxiv 2609 09059v1 Playtrain An Efficient Reinforcement Learning Fram**arXiv ID:** 2609.09059v1 **Authors:** Ryan Truong, Lance Ying, Samuel J. Gershman, Kazuki Irie **URL:** http://arxiv.org/abs/2609.09059v1 **Utility Score:** 1.00Votes: 0GitHub stars: 3
- Arxiv 2609 09578v1 Cityplanner A Sandbox Agent For Executable Urban P**arXiv ID:** 2609.09578v1 **Authors:** Wentao Zhang, Jingyuan Wang, Zetong Zhou, Yifan Yang, Wenrui Wang **URL:** http://arxiv.org/abs/2609.09578v1 **Utility Score:** 1.00Votes: 0GitHub stars: 3
- Arxiv 2609 09646v1 Robustsgpo Search Space Control For Agent Harness**arXiv ID:** 2609.09646v1 **Authors:** Zibo Zhao, Jijun Shi, Mo Zhou, Zhongyuan Wang, Shifu Bie, Yunfei Zhang, Xuanting Zhou, Xiangyu Wu, Bin Liu, Ruiming Tang, Wenwu Ou, Kun Gai **URL:** http://arxiv.org/abs/2609.09646v1 **Utility Score:** 1.00Votes: 0GitHub stars: 3
- Arxiv 2609 09647v1 Black Box Red Teaming Of Agentic Ai A Taxonomy Dri**arXiv ID:** 2609.09647v1 **Authors:** Divyanshu Kumar, Nitin Aravind Birur, Tanay Baswa, Sahil Agarwal, Prashanth Harshangi **URL:** http://arxiv.org/abs/2609.09647v1 **Utility Score:** 1.00Votes: 0GitHub stars: 3
- Arxiv 2609 09671v1 Introducing Consort A Spec First Agent Framework F**arXiv ID:** 2609.09671v1 **Authors:** Kevin Hartman **URL:** http://arxiv.org/abs/2609.09671v1 **Utility Score:** 1.00Votes: 0GitHub stars: 3
- Arxiv 2609 09981v1 Optimal Value Inference For Reinforcement Learning**arXiv ID:** 2609.09981v1 **Authors:** Nan Lu, Ethan Lee, James M. Robins, David Simchi-Levi, Junwei Lu **URL:** http://arxiv.org/abs/2609.09981v1 **Utility Score:** 1.00Votes: 0GitHub stars: 3
- Arxiv 2609 10248v1 A Jit Agentic Just In Time Software Construction**arXiv ID:** 2609.10248v1 **Authors:** Mark Marron, Earl T. Barr **URL:** http://arxiv.org/abs/2609.10248v1 **Utility Score:** 1.00Votes: 0GitHub stars: 3
- Arxiv 2609 10263v1 What Should An Agent Forget Separating What Is Sto**arXiv ID:** 2609.10263v1 **Authors:** Yuhang Li, Yuchen Li **URL:** http://arxiv.org/abs/2609.10263v1 **Utility Score:** 1.00Votes: 0GitHub stars: 3
- Arxiv 2609 10382v1 Searching For New Physics With Reinforcement Learn**arXiv ID:** 2609.10382v1 **Authors:** Jacky Kumar, Marianne Bouchard, David London **URL:** http://arxiv.org/abs/2609.10382v1 **Utility Score:** 1.00Votes: 0GitHub stars: 3
- Arxiv 2609 10433v1 Multi Agent Reinforcement Learning For Autonomous**arXiv ID:** 2609.10433v1 **Authors:** Caden Chandra, Jerry Ng **URL:** http://arxiv.org/abs/2609.10433v1 **Utility Score:** 1.00Votes: 0GitHub stars: 3
- Arxiv 2609 10522v1 Show Harness Just A Vlm Agent Can Play Robots**arXiv ID:** 2609.10522v1 **Authors:** Yanzhe Chen, Zechen Bai, Zhijun Cao, Wenzheng Zeng, Kevin Qinghong Lin, Yiqi Lin, Guoqiang Liang, Kevin Yuchen Ma, Qiming Huang, Mike Zheng Shou **URL:** http://arxiv.org/abs/2609.10522v1 **Utility Score:** 1.00Votes: 0GitHub stars: 3
- Asymmetric Actor Critic For Image Based Robot LearSkill for AI agent capabilitiesVotes: 0GitHub stars: 3