서론
정말.. 많은 일이 있었다 이전의 포스팅을 보면 평화 그 자체였던 시기였던 거 같고 이후의 삶은 크게 달라져
여러 뭐로 스트레스도 받고 하고 싶었던 공부는 무슨 아무것도 못했다
주말에도 평일에도 실수에 좌절하고 결과에 좌절하고
지금 주어진 업무의 정답이 있는가? 내가 하고 있는 게 최선인가? 더 잘할 수 있었을까? 의심을 넘어
나에 대한 능력 부족을 절실히 느꼈지만 여기서 어떻게 다르게 했어야 했지? 후회가 아닌 혼돈, 그냥 난 감히 말할 수 있다.
최선이었다고
이것 보다 더 열심히 살고 노력할 수 있을 거지만 아마 그런 삶은 진즉에 무너졌을 것이다.
그러다 보니 초등학교 때부터 잘못된 건가 그때 공부 더 열심히 할걸 이런 쓸 때 없는 생각을 하면 지쳐가는 도중 어떻게든 마무리 후 숨 몰아쉬고 있다.
그래서 무슨 일이 있었는지 좀 정리해 보겠다.
0. Kaggle Competition 우승
네부캠 도중에 사람들과 같이 나간 대회의 결과가 4월 중후반쯤 공개되었다.
결과는 1st, 3만 달러의 상금을 수령했다.
이것도 이제 너무 시간이 지나버려 그때의 감동을 말로 설명하기는 어려운 거 같다.
내가 잘한건 맞지만^^, 절대로 혼자서는 이런 성과는 절대로 낼 수 없을 거라고 생각한다.
같이 함께한 팀원들에게 너무너무 감사함이 크다.

https://www.kaggle.com/competitions/google-tunix-hackathon/writeups/new-writeup-1768107128907
G-RaR: Rubric-Based Reinforcement Learning for Structured Reasoning in Gemma | Kaggle
Training Gemma-2-2B for Explicit Reasoning with LoRA SFT and LLM-Judge-Based GRPO on TPU
www.kaggle.com
1. 부서 이동과 CUA
자세한 회사 이야기는 좀 줄이고 말하자면
캐글 대회 소식이 회사에 좀 알려지고 마침 모델 개발 담당하시던 분이 퇴사하면서 연구를 하는 팀으로 부서를 이동하고
한국어 성능을 보존한 채로 CUA 성능을 올리자라는 임무를 이어받아서 연구를 시작했다
서론에서 말한 많은 일의 시작이다.
연구는 잘 되지 않았다. GPU의 규모는 개인이 다루기에는 큰 규모라고 생각이 들지만 아무리 Qlora or lora로 학습을 한다고 해도 Agent RL을 해야 하는 입장에서 메모리의 압박과 시간 딜레이가 너무너무 컸다.
일반적인 단일턴에서의 RL만 수행해 본지라 Agent RL에 대해서 감잡는 시간과 Qwen3.5 397B의 osworld 점수 재현에서 가장 큰 애를 먹었다.
여차 저차 해서
최근 모델을 공개했다. (많은 좋아요 꼭 부탁드립니다.)

https://huggingface.co/mncai/Hunmin-397B-A17B-CUA
mncai/Hunmin-397B-A17B-CUA · Hugging Face
We’re on a journey to advance and democratize artificial intelligence through open source and open science.
huggingface.co
모델에 대한 설명은 일단.. 모델 카드에 있으니 생략하겠다.
2. 그래서.. 이제 뭐함?
2026에 하기로 한 영어, 수학, CS 공부 이제 진짜 시작한다.
그리고 논문은 회사에서.. 좀 하기 싫어도 해야 할 것 같다.
다이어트는 진행 중이다..
요새 가장 필요함을 느끼는 것은 수학이다. 수학은 날 한 단계 진화시켜 줄 것이라는 확신이 있다.
AI 기반으로 AI 수학 선생님 과정을 Codex plugin기반으로 만들어서 학습할 것이다. 이것에 대한 추가 포스팅은 있을 수도 있다.
회사에서 하는 프로젝트와 위에 한다고 한 것만 해도 남은 2026은 빡세다... 잘해보자!! 아자아자!!
3. 마무리
솔직히 AI 재밌나?
잘 모르겠다. 기술이 너무 빠르고 이거 지금 최선을 다하지 않으면
진짜 내 자리가 위태위태할지도 모르겠단 걱정이 항상 존재한다. 그러한 걱정은 스트레스로 다가와 아무 생각 없이 살고 싶다는 갈망을 만들어내긴 하지만.. 현재 밥 벌어먹을 수 있는 유일한 수단이다... 일단은 열심히 해보자
AI 관련해서는 GPT 6 astra라는 모델이 참 대단하는 생각이 든다.
CUA를 연구하면서 이런 식으로 이미지를 보고 다음 액션을 도출하고 다음 액션을 수행한다는 게.. 이게 CU를 하는 최선은 방법은 아닌 거 같다.
현재 CUA를 가장 대표하는 osworld bench가 이런 식이기에 이쪽으로 발전했다는 생각을 지울 수가 없어, 새로운 CUA 패러다임을 고민해자라는 생각을 마음 한 구석에 가지고 있었는데..
GPT 6 astra의 정확한 CUA 수행 메커니즘은 모르겠지만 수행 역량 자체를 보면 저 모델 자체가 새로운 패러다임을 가지고 있다고 생각한다. 벽을 느꼈다. 역시 OpenAI
그리고 회사는 정규직 정환이 되었다. 전환 축하금으로 부모님 용돈도 드릴 수 있어서 기쁘다.
'일지' 카테고리의 다른 글
| 2026 좀 이른 중간 결산 (0) | 2026.04.12 |
|---|---|
| 담백한 2026 계획 (0) | 2026.01.02 |
| 25.11.13 초심으로 가보자고 (0) | 2025.11.13 |
| 1년동안의 학부연구생 생활을 마치며 (0) | 2025.09.04 |