728x90

전체 글 1149

Claude Fable 5.1 출시: 가격, 성능, API 변경점 정리

Claude Fable 5.1이 2026년 9월 1일 공식 출시됐습니다. 한국 시간으로는 9월 2일 새벽 발표 소식이 전해졌습니다. 이번 업데이트의 핵심은 컨텍스트 확대나 입출력 단가 인하가 아닙니다. 100만 토큰 문맥과 입력 10달러, 출력 50달러는 Fable 5와 같습니다.달라진 부분은 장시간 에이전트 작업의 완성도, 캐시 읽기 가격, API 대화 제어입니다. 특히 캐시 읽기는 100만 토큰당 1달러에서 0.25달러로 내려갔습니다. 반면 기존 Fable 5 연동 코드를 그대로 바꾸면 오류가 날 수 있는 호환성 변경도 있습니다.Fable 5.1에서 실제로 달라진 점Claude Fable 5.1은 Anthropic의 일반 공개 모델 중 가장 높은 등급입니다. 같은 기반 모델인 Claude Mythos..

Gemini Omni 1.1 Flash 완전 정리: 4K AI 영상 생성과 API 활용법

AI 영상 생성에서 어려운 부분은 첫 장면을 만드는 일이 아닙니다. 같은 인물과 공간을 유지하면서 장면을 늘리고, 원하는 카메라 움직임으로 연결한 뒤, 최종 해상도까지 끌어올리는 과정이 더 어렵습니다.Google이 2026년 8월 27일 공개한 Gemini Omni 1.1 Flash는 이 후반 작업을 API로 묶은 영상 생성·편집 모델입니다. 모델 ID는 gemini-omni-1.1-flash이며, Gemini API에서 일반 제공(GA) 상태입니다. 핵심은 40초까지 가능한 장면 연장, 시작·끝 프레임 보간, 빠른 360p 초안, 4K 업스케일입니다.Gemini Omni 1.1 Flash 핵심 사양Gemini Omni 1.1 Flash는 텍스트·이미지·영상 입력을 받아 소리가 포함된 영상을 만들고, 대..

SDLC Kit 사용법: AI 코딩을 6단계 승인 흐름으로 바꾸기

SDLC Kit는 AI 코딩 에이전트가 요구를 확인하지 않은 채 구현부터 시작하는 문제를 줄이기 위해, 작업을 여섯 단계로 나누고 검토 가능한 파일과 승인 기록을 남기는 오픈소스 도구입니다.AI 코딩 에이전트에게 버그 하나를 맡겼는데, 잠시 뒤 수십 개 파일이 바뀌어 있는 경우가 있습니다. 테스트는 통과하지만 처음 요청과 다른 동작이 들어갔을 수도 있습니다. 더 곤란한 점은 어디서 판단이 틀렸는지 채팅 기록만으로 찾기 어렵다는 것입니다.SDLC Kit는 이 문제를 모델 성능으로 풀지 않습니다. 에이전트가 일하는 순서를 고정합니다. 의도, 명세, 계획, 구현, 출시, 유지보수마다 산출물 하나를 만들고, 중요한 경계에서는 사람이 승인해야 다음 단계로 넘어갑니다.2026년 8월 30일 확인 기준 최신 공개 버..

🧰 promptbox 완전 정리: AI 코딩 에이전트 도구를 복사 한 번으로 쓰는 카탈로그

promptbox는 AI 코딩 에이전트용 프롬프트·스킬·훅·설정·MCP·CLI 도구를 카드 UI로 모아두고, 원문을 복사해 그대로 붙여 쓰도록 만든 오픈소스 카탈로그 사이트입니다. Claude Code나 Codex를 며칠만 써 보면 비슷한 벽에 부딪힙니다. 좋은 스킬이나 훅이 있다는 이야기는 들었는데, 정작 그게 어느 깃허브 저장소에 있는지, 파일을 어디에 두어야 하는지, 내 에이전트가 그걸 언제 자동으로 불러오는지가 흩어져 있습니다. 결국 북마크만 늘고 실제로 설치한 도구는 두세 개에 그칩니다. promptbox는 이 문제를 "검색" 대신 "복사"로 풉니다. 카테고리에서 도구를 고르고, 상세 페이지에서 원문 복사 버튼을 누르고, 에이전트 폴더나 채팅창에 붙여 넣으면 끝입니다. 설치할 것도, 로그..

⚡ jcode 튜토리얼: 단축키부터 자동 개선 루프까지 실전 사용법

jcode 튜토리얼의 핵심은 기능 목록 암기가 아니라, 설치 → 모델 전환 → 개선 루프 → 멀티 에이전트로 이어지는 사용 순서를 몸에 붙이는 것입니다.터미널 코딩 에이전트를 깔아 놓고도 결국 "질문하고 답 받기"만 반복하는 경우가 많습니다. 도구가 부족해서가 아니라, 어떤 기능을 어떤 순서로 꺼내 써야 하는지 모르기 때문입니다. jcode는 Rust로 작성된 오픈소스 터미널 코딩 에이전트이고, 이미 결제 중인 Claude·ChatGPT·Gemini·Copilot 구독으로 로그인해 쓸 수 있습니다. 이 글은 설치 한 줄부터 시작해 단축키, 자동 개선 루프, 여러 에이전트 동시 운영, 설정 동기화까지 실제로 쓰는 순서대로 정리합니다. 2026년 8월 16일 기준 최신 릴리스인 v0.76.0에서 직접 확인한..

🐝 SwarmForge 완전 정리: 엉클 밥이 만든 tmux 멀티 에이전트

SwarmForge는 여러 AI 코딩 에이전트에게 각자의 작업 폴더와 터미널 창을 나눠 주고, 정해진 형식의 파일로만 일을 넘기게 만드는 tmux 기반 오케스트레이션 도구입니다.AI 코딩 에이전트를 두 개 이상 같은 저장소에 붙여 보면 모델 성능과 무관한 문제가 먼저 터집니다. 두 에이전트가 같은 파일을 동시에 고치고, 누가 무엇을 끝냈는지 알 수 없으며, "이제 네 차례"라는 신호가 사람 손을 거쳐야만 전달됩니다. SwarmForge는 이 충돌과 인수인계 문제를 겨냥한 도구입니다.만든 사람은 『클린 코드』의 저자 로버트 C. 마틴(GitHub 계정 unclebob)입니다. 저장소 소개 문구는 "여러 AI 에이전트를 조율하는 단순한 도구"이고, README는 "에이전트 무리를 신뢰할 수 있는 전문 소프트..

🐋 Orca, AI 코딩 에이전트를 병렬로 돌리는 오케스트레이터 정리

Orca는 Claude Code, Codex 같은 CLI 코딩 에이전트 여러 개를 한 화면에서 병렬로 실행하고, 각 결과를 비교해 가장 좋은 것만 골라 합치게 해 주는 MIT 오픈소스 데스크톱 앱입니다.AI 코딩 에이전트를 하나만 쓰는 시대는 생각보다 빨리 지나가고 있습니다. Claude Code로 계획을 세우고, Codex로 테스트를 짜고, 터미널 세 개를 오가며 결과를 비교해 본 경험이 있다면, 그 수작업을 한 창으로 모아 주는 도구가 바로 Orca입니다. 2026년 7월 GitHub 트렌딩 상위권을 꾸준히 지켰고, 이 글을 쓰는 시점(2026년 8월) 기준 스타가 4만 5천 개를 넘었습니다. 이 글에서는 Orca가 정확히 무엇인지, 어떤 기능이 실제로 쓸 만한지, 설치 방법과 함께 도입 전에 알아야..

🪡 Needle 2 완전 정리: 14MB로 도는 온디바이스 AI 파운데이션 모델

Needle 2는 Cactus Compute가 공개한 4,500만(45M) 파라미터 파운데이션 모델입니다. 모델 전체가 14MB 바이너리 하나에 들어가고, 세션 하나를 약 28MB 메모리로 실행합니다. 스마트폰, 웨어러블, 스마트홈 기기, 로봇처럼 자원이 빠듯한 하드웨어에서 네트워크 호출 없이 완전 오프라인으로 추론하는 것이 목표입니다.여기서 먼저 기대치를 조정해야 합니다. Needle 2는 범용 챗봇이 아닙니다. 저장소가 명시한 용도는 툴콜링(함수 호출), 디바이스 제어, 구조화 데이터 추출 세 가지입니다. "GPT를 14MB로 압축했다"가 아니라, 작은 기기에서 정해진 작업을 안정적으로 수행하는 특화 모델로 읽어야 정확합니다.Needle 2가 풀려는 문제온디바이스 AI의 병목은 늘 같습니다. 모델이 ..

🛡️ GLM-5.3 출시 총정리, 코딩 50% 향상과 사이버 보안 특화

GLM-5.3은 새 베이스 모델 없이 포스트 트레이닝만으로 코딩 성능을 50% 끌어올리고, 사이버 보안(취약점 탐지)에 특화한 Z.ai의 최신 모델입니다. 지금은 GLM Coding Plan에서 쓸 수 있고, 오픈 웨이트는 2주 뒤 공개 예정입니다.Z.ai(지푸 AI)가 2026년 8월 14일 GLM-5.3을 출시했습니다. 결론부터 말하면, 이번 버전의 핵심은 "코딩 에이전트 성능"과 "사이버 보안"이고, 커뮤니티가 기대하던 비전(이미지 이해) 기능은 이번에도 빠졌습니다. GLM-5.2가 나온 지 59일 만의 빠른 후속작인데, 흥미로운 점은 베이스 모델을 새로 만들지 않고 포스트 트레이닝(사전학습이 끝난 모델을 추가로 다듬는 후반 학습)만으로 이 향상을 얻었다고 밝힌 부분입니다. 이 글에서는 GLM-5...

Gemini 3.7 Flash 완전 정리 2026: 가격·성능·API 활용법과 도입 전 주의점

Gemini 3.7 Flash는 빠르고 저렴한 보조 모델에 머물던 Flash의 역할을 넓힌 모델입니다. Google은 2026년 8월 13일 이 모델을 정식 출시하고, 복잡한 코딩과 AI 에이전트 작업에 적합한 실무형 모델로 소개했습니다. 모델 ID는 gemini-3.7-flash이며 Gemini API에서 일반 제공(GA) 상태입니다.핵심은 속도만이 아닙니다. 이전 세대인 Gemini 3.6 Flash보다 코드 정확도, 도구 사용, 복잡한 문서 처리 성능이 개선됐습니다. 반면 출시 가격은 한시적으로 절반 수준으로 낮아졌습니다. API 모델을 고르는 개발자라면 성능과 비용을 함께 검토할 만한 변화입니다.Gemini 3.7 Flash 핵심 사양Gemini 3.7 Flash는 100만 토큰 문맥과 조절 가능..

728x90
반응형