자율 루프로 AI가 어디까지 구현할 수 있는가?
완전한 자율 루프는 아닙니다.
그저 문서를 기반으로 `계획` 기능을 여러 단계에 걸쳐서 할 수 있도록 만들고,
설계 그 자체와 관련된 것은 제가 답변을 입력해야만 진행하도록 구성한 루프입니다.
워크 플로우 툴킷(CLI/MCP/SKILL.md)를 셋팅하고, 초기에 뭘 만들건지, 무엇이 목표인지 프롬포트로 지시했고, 임의 판단을 막았습니다.
그리고 의문이나 제약 같은게 발견되면 문서로 남겨두고, 질의/답변 항목을 남겨두라고 시켜두었습니다.
현재는, 뭘 더 만들어야 진짜 자율 루프를 만들 수 있을지 고민하고 있습니다.
(일단은, 이걸 돌려놓고 다른 걸 하면서 공부/연구 하고 있는데, 몇 시간째 자동으로 잘 굴러가고 있기는 합니다)
https://github.com/jay94ks/claude-native-workflow (CNW 워크 플로우 툴킷 CLI/MCP/SKILL.md + 도커 및 백엔드)
https://github.com/jay94ks/minicore (클로드가 CNW로 저와 질/답 하며 얘가 알아서 개발 하고 있는 운영체제)
아이디어나, 의견 있으신 분들 매우 환영합니다.
사용 방법은 리포에 함께 기록해두었습니다.
주의: 클로드 MAX 20x 기준으로 만든 SKILL.md이므로 그 외 요금제에서는 튜닝이 필요합니다.
추후에는 이걸 솔루션화 시켜보고 싶습니다.
그저 문서를 기반으로 `계획` 기능을 여러 단계에 걸쳐서 할 수 있도록 만들고,
설계 그 자체와 관련된 것은 제가 답변을 입력해야만 진행하도록 구성한 루프입니다.
워크 플로우 툴킷(CLI/MCP/SKILL.md)를 셋팅하고, 초기에 뭘 만들건지, 무엇이 목표인지 프롬포트로 지시했고, 임의 판단을 막았습니다.
그리고 의문이나 제약 같은게 발견되면 문서로 남겨두고, 질의/답변 항목을 남겨두라고 시켜두었습니다.
현재는, 뭘 더 만들어야 진짜 자율 루프를 만들 수 있을지 고민하고 있습니다.
(일단은, 이걸 돌려놓고 다른 걸 하면서 공부/연구 하고 있는데, 몇 시간째 자동으로 잘 굴러가고 있기는 합니다)
https://github.com/jay94ks/claude-native-workflow (CNW 워크 플로우 툴킷 CLI/MCP/SKILL.md + 도커 및 백엔드)
https://github.com/jay94ks/minicore (클로드가 CNW로 저와 질/답 하며 얘가 알아서 개발 하고 있는 운영체제)
아이디어나, 의견 있으신 분들 매우 환영합니다.
사용 방법은 리포에 함께 기록해두었습니다.
주의: 클로드 MAX 20x 기준으로 만든 SKILL.md이므로 그 외 요금제에서는 튜닝이 필요합니다.
추후에는 이걸 솔루션화 시켜보고 싶습니다.
총 1명이 반응했습니다
|
댓글을 작성하시려면 로그인이 필요합니다.
댓글 2개
AI가 계획을 세우고,
AI가 구현하고,
AI가 테스트하고,
실패하면 AI가 원인을 분석해서 다시 구현하도록 했습니다.
그리고 임의 판단이 필요한 경우에만 저에게 질문하도록 했습니다.
몇 시간 돌려본 결과, 현재까지 제가 담당하고 있는 업무는
“그래”
“그렇게 해”
“2번으로 가자”
- 정도입니다.
조금 더 발전하면 제가 프로젝트에서 제거될 것 같습니다.
현재 가장 시급한 과제는 자율 루프의 완성이 아니라,
제 역할을 하나라도 더 만들어 넣는 것이네요.
지금도 스스로 규정마저 고쳐요. 현재 자율 루프 구동 AI의 신뢰성 중 가장 해결하기 어려운 과제는
테스트를 자동으로 진행하는 것이 아니라, 해야 할 테스트 자체를 생략해버리는 거라 생각합니다.
설계 문제에서 AI가 스스로 결정한 커널은 minicore 리포의 concept 브랜치에 커밋되어 있는데,
설계상 오류가 너무 많아서 폐기하고, 설계 자체를 사람이 하게 만든 것입니다.
(완전히 설계 자체를 사람이 하는 것은 아니고 설계상 결정을 사람이 하고, 방향성을 지시하게끔 해두었습니다 ㅡ 불명확한 것 자체를 계속 질문하도록 만들었고, 설계자가 단답형이 아닌 주관식으로 쓰게끔 설계했습니다)
아마 사람의 역할이 "코드를 직접 짜는 설계자"에서 "기획 및 설계", 그리고 "지시/감독"으로 옮겨가고 있는것이 아닐까요?