분류 전체보기

· 일지
- ai에 의존하며 살아가니 이렇게 한자 한자 작성하는게 낯설다. 뭔가 불안감과 반성을 느끼면서 2026 중간 결산을 진행해 보겠다. 근황과 새로운 공부 목표(해야할 것)을 정리하겠다. 일단 취업 성공!네이버 부트캠프의 연계를 통해서 Genon의 Genos Engineer 정규직 전환형 인턴으로 합격했다. 포지션에 대한 아쉬움은 존재한다. 아무래도 디폴트가 파견직이고 Genon의 상품인 Genos를 메인으로 다루는 잡이라 여러모로 고민이 생기는 포지션이다. 그외로 부수적인 임금, 복지는 나름 만족스럽다!취업은 확정되었지만... 그래도 도전뭔가 바로 취업이 되서 이게 나의 최고점인가..? 라는 의뭉이 있긴했다.(주변에서 바람을 넣은 것도 있고)다만 다른 회사를 막 지원하는 건 아니고 기존에 진행중이던 업스..
· 일지
취업내 생일이 돌아오기 전까지 월 세후 300 이상인 곳 취업하기 (못하면 걍 ai 접고 다른 일 알아본다는 마음 가짐)세후 300은.. 어느정도.. 조절 가능할지도? competition 대회에서 입상1등 아니여도 좋음, 규모있는 대회에서 입상 책을 다시 꾸준하게 읽기책을 꾸준하게 읽던 시절이 몸도 마음도 건강했던거 같다.꾸준하게 읽고자 노력한다면 이후에 운동도 하게 되고, 공부도 열심히 하게 될꺼 같다.한달에 책의 완독 수는 나의 건강지표 같다. -> 지금은 0 된지 좀 됐다.. 코테 마스터코테는 밑바닥까지 끝내자다시는 코테에 부담감 가지지 않을 정도로수학인생 퀘스트, 진행률이 2년 전에 멈춰있다. 천천히 꾸준히 다시 나아가자 논문 쓰기혼자 논문 쓰기 해보자 올해 딱 한편이 목표 여행올해는 봄에는 꽃..
https://arxiv.org/pdf/2507.17746 Abstract기존의 Rubrics 방식은 추론작업의 결과를 평가하는데 주로 사용됨 그러한 Rubrics 기준을 RL의 보상 함수로 사용하여 RLVR(검증 가능한 보상을 사용하는 강화학습)로 확장하는 방법인 RaR(Rubrics as Rewards)를 제안결과적으로 다른 베이스라인보다 HealthBench에서 최대 31%, GPQA-Diamond에서 7%의 개선을 달성 1. Introduction기존의 RLVR은 모델의 결과물이 검증이 가능한 수학과 및 코드와 같은 영역에서 효과적이였음 하지만 비정형적(언어적) 답변에 대해서는 이러한 RLVR을 적용하기에는 결과물이 쉽게 검증하기 어렵다는 문제가 발생이러한 어려움은 보상 모델을 사용하는 것이만 일..
https://arxiv.org/pdf/2201.11903 해당 논문이 처음 나왔을 때, "Elicits Reasoning"라는 주장에 논쟁이 있었다.해당 논문 이전에도 prompt engineering(few-shot prompt)이 모델의 성능을 향상 시킨다는 연구가 있었기에 결국 "engineering의 결과이지 이걸 모델이 이해를 바탕으로한 추론이라고 말할 수 있는가?"라는 맥락이였던 것 같다.현재에 들어서는 단순히 COT 기법을 넘어서 gpt-5, qwen3 등과 같은 추론 모델로 이어져, 추론 모델이 도출해낸 thinking이 과연 추론이 맞다 아니다로 이어져 오고 있다. 하지만 추론이 맞다는 의견이 지배적인거 같다. 다만 아직까지도 이해를 바탕으로 하는 인간 수준의 추론인지에 대해서는 논쟁..
· 일지
여러 꿈들과 현실에서 방황 중이다.ai로서 이름을 날리고 싶다는 꿈과 그냥 마냥 돈 잘벌고 효도도 하고 나의 가족들과 행복하게 사는 꿈 어찌보면 공통 분모는 존재하는 것 같지만 양립하기에는 간극은 존재 하는 것 같다. 효도도 때가 있다고 생각한다. 부모님 다 늙어서 뭐 해봤자 무슨 의미일까아무렴.. 효도하기에는 지금 시점이 가장 적절하지 않을까? 이러한 생각이 취업을 고민하게 되는 거 같다.대학원 생활을 한다면,... 부모님이 내가 뭐 얼마나 성과를 냈고 얼마나 잘하고 있는지 관심있게 보셔도 한계가 있을 것이다.시간이 없다. 부모님은 결국 취업을 해야 안심하고 그게 지금 내가 부모님께 드릴 수 있는 가장 큰 효도이지 않을까 싶다. 그래서 일단 취업을 하고 부모님에게 적어도 밥벌먹을 수 있음을 보여드려 안..
논문 링크 https://arxiv.org/pdf/2501.12948DeepSeek-R1 중국의 ai 기술력으로 미국을 따라잡았다는 뜨거운 감자로 그 당시에 굉장히 주목 받았던 모델이자 paper로 기억한다. h800이라는 gpu 인프라의 제한이 있는 환경에서 R1을 만들어 openAI o1과 맞먹는 성능을 보여주었고 이러한 규제 속에서도 만들어낸 R1은 단순한 성능과 오픈 소스로서 가치가 있을 뿐만 아니라 하드웨어적으로도 중국이 온몸 비틀기 중이라는 것을 결과물로 보여주며, 중국이 미국과 ai 패권을 다투는 경쟁상대라는 것을 여실히 보여주었다. DeepSeek-R1의 개요GRPO라는 강화학습을 중심으로 Deepseek-v3-base 모델을 RLM으로 발전시킴671B라는 커대한 크기의 MOE구조인 모델..
논문 링크https://arxiv.org/abs/2510.15511 인터넷 상에서 꽤 화제가 되는 논문(11월 4일 기준), Latent Vector에 대한 보안에 대한 논의가 이루어지는 것 같다. 핵심 주제1. 모델은 injective function(단사 함수) 임을 수학적으로 증명함2. SIPIT를 통해 latent vector가 원본 시퀀스로 복원될 수 있음을 실험적으로 보여줌3. 실험 결과를 근거로 latent vector 또한 보안의 대상으로 바라보아야 한다. Transformers are INJECTIVE증명 과정은 3가지의 절차로 이루어진다.모델을 구성하는 모든 연산은 수학적으로 "real-analytic function"라는 것을 증명모델을 무작위로 초기화 후 동작시 결과가 injecti..
네이버 부스트캠프 - ai Tech 자기소개서는 그래도 학부연구생동안의 경험을 토대로 작성하여 크게 어렵지 않았다.다만 코딩테스트 준비가 전형 안되어있어 벼락치기로 이것저것 몰아서 하는데 고생을 좀 했다. ( 그래도 10문제중 5솔은 한 듯하다. )여차저차 합격을 했고 창업동아리, 졸업 등 이거저것 마무리하니 바로 캠프 시작이더라 캠프를 시작하면서 몇가지 다짐,약속 그리고 목표이다. 캠프를 성실히 수행해 기업연계 인턴쉽에 성공하자.영어와 수학 공부를 하자창업동아리 논문 작성을 마무리하자혼자 스스로 논문 작성을 하자대회를 하나 수상하자코딩테스트 공부도 조금씩 하자 이 여섯 가지를 수료하는 2월에 다시 한번 되집어 보도록 하자그날이 부끄럽지 않도록 노력하겠다.
comoZ
'분류 전체보기' 카테고리의 글 목록