2026년 LLM 동향 (현재까지)
요약
본 기사는 2026년에 발생한 LLM 트렌드를 분석하며, Claude Opus 4.5와 GPT-5.1 같은 모델의 출시를 다룹니다. 특히 코딩 에이전트(coding agents)가 등장하면서 기술적 한계를 시험하고 더 야심찬 프로젝트에 도전하는 방향으로 변화했음을 강조합니다.
핵심 포인트
- 2026년에는 Claude Opus 4.5와 GPT-5.1 같은 주요 모델이 출시됨.
- 모델 개선과 함께 코딩 에이전트가 핵심 트렌드로 부상함.
- 기술의 한계를 찾기 위해 더 야심차고 많은 프로젝트에 도전하는 추세임.
2026년 LLMs 동향 (현재까지)
2026년 9월 27일
지난 금요일, 저는 San Jose에서 열린 WeAreDevelopers World Congress North America의 폐막 기조연설을 했습니다. 지난 한 해 동안의 주요 트렌드들을 시간 순서대로 정리하여 2026년에 일어난 모든 것을 탐구했습니다. 영상은 YouTube에 올라와 있으며, 여기는 발표를 보조하는 제가 주석을 단 슬라이드와 노트입니다.
그리고 주석이 달린 프레젠테이션으로:


11월에는 두 가지 중요한 모델인 Claude Opus 4.5와 GPT-5.1이 출시되었습니다.
새로운 모델의 경우 보통 그랬듯이, 이들은 이전 모델들의 점진적인 개선이었습니다.
하지만 때때로 모델이 향상될 때, 제대로 작동하지 않던 무언가가 작동하기 시작하는 보이지 않는 선을 넘게 됩니다.
이 경우, 작동하기 시작한 것은 코딩 에이전트였습니다. Claude Code는 2025년 2월부터 존재해 왔고, Codex가 조금 더 오래되었습니다.
이 두 가지 새로운 모델들은 각각의 코딩 에이전트 하니스와 결합되면서
매년 새해 결심을 하는데, 기억하는 한 항상 똑같은 것이었습니다. 집중하기. 새로운 프로젝트는 적게 맡기. 이미 진행 중인 프로젝트에서 일을 끝내려고 노력하기.

올해는 그 방법이 효과가 없었기에 다른 방향으로 가보기로 했습니다.
이제 코딩 에이전트(coding agents)가 생겼으니, 무엇을 할 수 있는지 봅시다. 제가 하고 싶은 만큼 많은 새로운 프로젝트를 맡아보려고 합니다!
(연말에 이게 좋은 생각이었는지 나한테 물어봐도 됩니다. 지금 제가 처리해야 할 일이 엄청나게 많거든요.)
올해의 테마는 '더 야심차지 되기'였습니다. 왜냐하면 이 기술의 한계를 찾을 수 있는 유일한 방법은 작동하지 않을 때까지 계속 밀어붙이는 것이기 때문입니다.

또한 Oxide와 친구들(Oxide and friends) 팟캐스트에 출연하여 Bryan Cantrill 및 Adam Leventhal과 함께 내년(그리고 3년, 6년 후) 예측을 공유했습니다.
돌이켜보면, 제 LLM 예측은 상당히 야심이 부족했습니다.
저는 'LLM이 좋은 코드를 작성하는 것은 부인할 수 없게 될 것'이라고 말했는데, 지금쯤엔 그 단계에 도달한 것 같습니다.
저는 우리가 마침내 샌드박싱(sandboxing) 문제를 해결할 것이라고 예측했습니다. 이 컨퍼런스에서 진행된 277개 세션 중 약 40개가 샌드박싱이나 에이전트 보안(agent security)과 관련하여 다뤄졌으니, 적어도 여기에 많은 노력이 기울이고 있다는 것은 확실합니다!
저는 코딩 에이전트 보안에 대한 '챌린저 재앙(Challenger disaster)'을 예측했습니다. 올해 에이전트 보안 주변에는 분명히 엄청난 소음이 있었지만, 제가 정확하게 예측했던 재앙(코딩 에이전트가 해킹당하여 실제 경제적 피해를 야기하는 것)은 실제로 발생하지 않았습니다.
우리는 교황이 LLM의 경제적 영향에 대해 의견을 제시할 것이라는 농담성 예측도 했습니다.

또한 뉴질랜드의 카카포(Kākāpō) 앵무새가 올해 뛰어난 번식기를 가질 것이라고 예측했습니다.
이들은 비행하지 못하는 야행성 앵무새입니다. 생김새는 다소 투박하지만, 저는 아름답다고 생각하며, 연초에 전 세계적으로 이 앵무새는 단 236마리밖에 없었습니다.
Kākāpō은 Rimu 나무가 큰 결실기를 가질 때만 번식하는데, 지난 4년 동안 그런 일이 없었습니다... 하지만 올해는 Rimu 열매가 아주 좋아 보였습니다.
사진 제공: Kimberley Collins.

또한 그 팟캐스트에서 우리는
이것은 현존하는 소프트웨어 중 가장 분위기(vibe)가 느껴지는 작품입니다.

이것이 OpenClaw 혁명을 촉발했습니다. 이는 효과적으로 새로운 유형의 소프트웨어를 정의했습니다.
제가 정말 좋아하는 일반적인 용어가 있습니다. 저희는 이런 종류의 소프트웨어를 “클로(Claw)”라고 부릅니다. OpenClaw, NanoClaw, IronClaw, PicoClaw 등이 있죠...
오늘날에는 이것들이 “개인 에이전트(personal agents)” 또는 “범용 에이전트(general agents)”로 리브랜딩되고 있지만, 저는 여전히 그것들을 클로라고 생각하는 것을 좋아합니다.

베이 지역의 Apple 스토어에서는 너무 많은 사람들이 OpenClaw를 실행하기 위해 Mac Mini를 구매하면서 매진되었습니다!
Drew Breunig는 이것이 여러분의 OpenClaw가 디지털 애완동물과 같아서, 클로를 보관할 수 있는 아쿠아리움처럼 Mac mini를 구매하는 것이기 때문이라고 말했는데, 정말 즐거운 생각입니다.

또한 지난 1월에는 이런 웹사이트가 있었습니다.
이것은 AI 에이전트를 위한 소셜 네트워크인 MoltBook이었는데, 아이디어는 여러분의 클로를 보내 다른 모든 클로들과 대화하게 하는 것이었습니다. 왜냐하면 그렇게 해도 무슨 문제가 생길 수 있을까요?
웹사이트는 목요일에 출시되었습니다. 금요일에 폭발적인 인기를 끌었고, 월요일에는 뉴욕 타임즈에서 다루어졌습니다. 그리고 화요일까지는 슬롭(slop)과 스팸의 홍수에 휩쓸리면서 모두가 그것이 존재했다는 사실을 잊어버렸습니다.
한 달 후 Facebook/Meta가 이것을 인수했습니다.

그들은 소프트웨어 공장(Software Factories)과 에이전트적 순간(Agentic Moment)에 대해 글을 썼습니다. 저는 그들이 지난 10월에 시연을 직접 본 후, 그때 제 개인 노트를 올렸습니다.
Dan Shapiro는 이 접근 방식을 다크 팩토리(Dark Factory)라고 불렀는데, 공장이 충분히 자동화되면 전등을 끌 수 있다는 생각 때문입니다. 왜냐하면 무슨 일이 일어나고 있는지 볼 필요조차 없기 때문이죠.
StrongDM은 작년 7월부터 따라온 소프트웨어 개발에 대한 두 가지 규칙을 제시했습니다.

첫 번째는 코드는 인간이 작성해서는 안 된다는 것입니다.
여러분들이 작성하는 모든 코드는 코딩 에이전트(coding agent)를 거쳐야 합니다.
이것은 2월에는 급진적으로 들렸지만, 이 방에 있는 많은 분들이 오늘날 이미 그것을 살고 있다고 상상합니다.

두 번째 규칙은 코드는 인간이 검토해서는 안 된다는 것입니다.
당신은 코드를 읽어서는 안 됩니다!
이것은 올해의 상당 기간 동안 큰 주제로 남아 있었습니다. 이 행사에서 열린 많은 세션들은 코드 검토(code review)와 어떻게 하면 이것을 피할 수 있는지에 관한 것이었습니다.
제가 StrongDM에 대해 흥미롭게 생각한 점은, 그들이 우리보다 6개월 앞서 살고 있었으며, 코드를 읽는 것이 아니라 소프트웨어를 구축하는 것이 의미하는 바를 탐구해 왔다는 것입니다. 하지만 여전히 그 소프트웨어의 품질이 높다고 자신할 수 있게 해주는 방법 말입니다. 이러한 에이전트들로 그들의 작업을 검증하는 데 어떻게 도움을 줄 수 있을까요?
StrongDM은 보안 회사이며, 이 프로젝트에는 수십 년 경력의 사람들이 참여했습니다. 그들은 무엇이 가능하고 책임감 있는 범위의 가장자리들을 매우 깊이 탐구하고 있었습니다.
AI 자동 생성 콘텐츠
본 콘텐츠는 RSS: Simon Willison's Weblog의 원문을 AI가 자동으로 요약·번역·분석한 것입니다. 원 저작권은 원저작자에게 있으며, 정확한 내용은 반드시 원문을 확인해 주세요.
원문 바로가기