Kai 52 6
게시물 메뉴

9월 22일 하루에 모델 발표가 두 개나 있었죠.

오전에 Anthropic이 Opus 5.5를 내놓고, 몇 시간 뒤에는 OpenAI가 GPT-6 Sol이랑 Luna를 내놨습니다.

근데 둘 다 비슷한 얘기를 합니다.

더 좋아졌는데 더 싸졌다고.

처음엔 저도 그냥

“아 이제 얘네도 가격 경쟁 들어가는구나.”

딱 이 정도로 봤습니다.

저야 AI를 워낙 많이 쓰니까 싸지면 무조건 좋죠. ㅎㅎ

근데 발표 내용을 좀 보다 보니까 가격보다 다른 게 더 눈에 들어왔습니다.

작은 모델들이 자꾸 큰 모델을 따라잡습니다.

사실 요즘 직접 써봐도 그렇습니다

저는 개발하면서 GPT도 쓰고 Claude도 쓰고 Codex도 쓰고 이것저것 정말 많이 씁니다.

예전에는 좀 어려운 거 시킨다 싶으면 일단 제일 좋은 모델부터 찾았습니다.

비싸도 어쩔 수 없다고 생각했고요.

근데 요즘은 꼭 그렇지가 않습니다.

간단한 코드 수정이나 문서 정리, 로그 보고 문제 찾는 것 정도는 굳이 제일 비싼 모델까지 갈 필요가 없습니다.

아래 모델도 생각보다 너무 잘합니다.

그리고 몇 달 지나면 또 그 아래 모델이 올라옵니다.

이번 발표도 비슷합니다.

Anthropic은 Opus 5.5가 자기들 더 큰 모델인 Fable을 여러 벤치마크에서 앞섰다고 하고,

OpenAI도 Sol이 훨씬 적은 비용으로 Astra에 가까운 신뢰도를 낸다고 합니다.

결국 계속 이쪽으로 가는 것 같습니다.

어제 비싼 모델로 하던 일을 오늘은 싼 모델로 합니다.

만드는 사람 입장에서는 이게 꽤 큽니다

AI 서비스 만들다 보면 결국 토큰값을 안 볼 수가 없습니다.

저도 뭔가 만들다가

“이거 요청마다 두세 번씩 호출하면 돈 많이 나오겠는데?”

싶어서 구조를 바꾼 적이 꽤 있습니다.

검증 한 번 더 하면 좋겠는데 돈 들고,

다른 모델한테 한 번 더 물어보면 정확할 것 같은데 또 돈 들고,

에이전트가 알아서 몇 번 돌게 만들면 더 들고요.

결국 할 수 있는데 안 하는 겁니다.

근데 가격이 절반이 되면 이런 것들이 하나씩 가능해집니다.

한 번 물어볼 거 두 번 물어보고,

중요한 건 다른 모델한테 한 번 더 확인시키고,

실패하면 다른 모델로 넘기고.

저도 여러 LLM 계정을 묶어서 쓰려고 openllms를 만들면서 이런 생각을 많이 했습니다.

어떤 모델 하나만 죽어라 쓰는 것보다

이 일은 싼 모델, 이건 좋은 모델, 안 되면 다른 모델.

이런 식으로 쓰는 게 점점 자연스러워질 것 같습니다.

근데 한쪽에서는 오픈 모델도 계속 올라옵니다

재밌는 게 하루 전에는 Xiaomi가 MiMo-V2.6도 공개했습니다.

MIT 라이선스입니다.

그러니까 위에서는 OpenAI랑 Anthropic이 서로 가격을 내리고 있고,

아래에서는 직접 돌릴 수 있는 모델들이 계속 올라오고 있습니다.

개발자 입장에서는 그냥 좋습니다.

싸우세요.

저희는 골라 쓰겠습니다. ㅎㅎ

다만 규제 쪽은 좀 골치 아파질 것 같습니다

지금까지는 그래도 단순했습니다.

엄청 큰 모델은 엄청난 연산량이 필요하고, 그 정도 모델이면 위험한 능력도 있을 수 있으니 따로 관리하자.

대충 이런 접근이 가능했습니다.

근데 작은 모델이 큰 모델이 하던 걸 하기 시작하면 이야기가 달라집니다.

실제로 Anthropic도 Opus 5.5가 생물학이나 사이버 쪽에서 높은 능력을 보이니까 더 큰 모델과 비슷한 안전 제한을 걸었습니다.

그럼 앞으로는 모델 크기만 보고 판단하기가 점점 어려워지겠죠.

큰 놈이 위험한 게 아니라

작은 놈도 이제 그걸 할 수 있으니까요.

그래서 저는 이번 발표에서 가격보다 이게 더 재미있었습니다

반값?

당연히 좋습니다.

저처럼 하루 종일 AI 쓰는 사람한테는 아주 반가운 소식입니다. ㅋㅋ

근데 조금 멀리 보면 가격이 내려간다는 것보다

같은 수준의 지능을 얻는 비용이 계속 내려가고 있다는 것

이게 더 큰 변화인 것 같습니다.

개발한 지 오래되다 보니 비슷한 걸 몇 번 봤습니다.

서버가 싸지니까 예전에는 큰 회사나 만들던 서비스를 작은 팀도 만들었고,

스토리지가 싸지니까 예전에는 버리던 데이터까지 전부 저장하기 시작했습니다.

이번에는 지능이 싸지고 있습니다.

그래서 요즘은 새로운 거 생각할 때 가끔 반대로 생각해봅니다.

AI가 지금보다 10배 싸진다면?

그때 가서 뭘 만들지 고민하는 게 아니라,

10배 싸진다고 생각하고 지금 만들면 뭐가 달라질까.

요즘은 이쪽이 더 궁금합니다.