
Qwen3-30B-A3B 로컬 실행: 원본·2507·Coder 선택과 메모리
같은 모델에서 사고 모드를 전환하려면 Qwen3-30B-A3B 원본이 유효합니다. Instruct-2507과 Thinking-2507은 모드가 고정되어 있고, Coder는 코딩용 별도 모델입니다. 로컬 실행에서는 이름뿐 아니라 양자화와 실제 컨텍스트 설정도 확인해야 합니다.

같은 모델에서 사고 모드를 전환하려면 Qwen3-30B-A3B 원본이 유효합니다. Instruct-2507과 Thinking-2507은 모드가 고정되어 있고, Coder는 코딩용 별도 모델입니다. 로컬 실행에서는 이름뿐 아니라 양자화와 실제 컨텍스트 설정도 확인해야 합니다.

role 미지원 오류는 실제 API가 받는 필드와 메시지 위치부터 맞춰야 합니다. Claude의 처음 지시는 최상위 system에, OpenAI의 지시는 해당 API가 지원하는 위치에 둡니다. 도구 호출 ID와 대화 기록을 보존한 뒤 지시 준수와 전체 작업까지 확인하세요.

Artlist에서 Nano Banana Pro를 쓰려면 AI Toolkit에서 모델과 해상도를 고른 뒤 생성 비용을 확인합니다. 현재 1K·2K는 이미지당 160크레딧이며, Unlimited는 가입한 플랜과 모델·설정에 따라 적용됩니다.

Responses API 이전은 모든 함수 호출을 앱에서 검증·실행하고, 원래 call_id로 결과를 반환한 뒤 최종 답변까지 받아야 끝납니다. Python 비동기 예제로 전체 루프를 먼저 오프라인에서 확인하고, 업무 결과가 불명확하면 재실행을 멈춥니다.

문서 한 개는 업로드로, 현재 저장소와 미커밋 변경은 해당 컴퓨터의 로컬 작업으로 처리합니다. ChatGPT Work의 로컬 연결 조건과 Codex·Claude Code의 읽기·수정·명령 실행 권한을 확인하세요.

다음 예약 실행에 꼭 필요한 사실은 작업 지시에 남겨야 합니다. 같은 채팅의 문맥을 이어 쓰는 작업과 독립 실행은 다르며, Memory·파일·연결 앱은 실행 방식과 권한에 따라 사용할 수 있는 범위가 달라집니다.

직접 API 키를 쓰려면 Claude Code를 실행할 터미널에 ANTHROPIC_API_KEY를 전달하고 대화형 승인 여부를 확인합니다. 설정이 적용되지 않으면 인증 방식, settings.json의 범위, 모델, 실행한 앱을 차례로 확인하세요.

PR과 이슈가 필요하면 GitHub, 버전별 문서가 필요하면 Context7, 브라우저 동작 확인은 Playwright, 운영 오류 조사는 Sentry가 첫 후보입니다. 이미 쓰는 도구로 충분한지 확인한 뒤, 필요한 서버 하나를 연결하고 실제 조회 결과까지 확인하세요.

Claude Code가 규칙을 잊었을 때는 새 세션에서도 빠지는지 먼저 확인합니다. Context7 오류는 메모리를 늘리는 대신 설치 방식, 인증과 실제 문서 조회 결과를 차례로 점검해야 합니다.

claude --dangerously-skip-permissions로 실행하면 bypassPermissions가 선택됩니다. 일반적인 도구 승인 요청은 생략하지만 명시적 ask 규칙과 일부 보호 절차는 남습니다. 편집 승인만 줄이려면 acceptEdits, 승인 없이 허용된 작업만 수행하려면 dontAsk를 먼저 검토하세요.

MCP 서버 수를 줄이기 전에 컨텍스트가 언제 늘어나는지 확인하세요. 도구 검색은 정의 로딩을 늦추고, 필터링과 분할 조회는 큰 반환값을 줄입니다. 정리한 뒤에도 같은 기록에 접근하고 필요한 작업을 끝낼 수 있어야 합니다.

OpenRouter 경유는 OpenRouter 키와 deepseek/deepseek-v4.1-flash를, DeepSeek 직접 연결은 DeepSeek 키와 deepseek-flash를 사용합니다. 두 경로의 설정, 모델 역할과 첫 오류 복구를 확인하세요.

개인용 상태 표시줄은 /statusline으로 만들 수 있습니다. 동작을 직접 관리하려면 statusLine에 스크립트 실행 명령을 지정합니다. 모델명·현재 폴더·Git 브랜치·컨텍스트 사용률·세션 비용 추정치를 표시하는 예제와 빈 화면의 확인 순서를 제공합니다.

Claude Code에서 Opus 4.7의 top_p deprecated 오류가 나면 실제 모델과 연결 경로부터 확인하세요. 최종 요청의 샘플링 항목만 제거하고 메시지·도구·출력 제한은 보존한 뒤, 같은 경로에서 원래 작업이 완료되는지 확인해야 합니다.

기존 앱이 사용자 인증과 내부 호출을 담당한다면 MCP 없이도 Claude를 사내 API에 연결할 수 있습니다. 도구는 업무별로 좁게 만들고, 인증된 사용자의 권한으로 실행한 결과를 정확한 호출 ID에 연결해 반환합니다.

OpenAI API 키로 쓰는 Codex CLI는 일반 입력·캐시 읽기·캐시 쓰기·출력을 각각 계산합니다. 모델 단가와 하루 요청 수를 대입해 예상 지출을 구한 뒤, 확인된 사용액과 남은 작업량으로 계속할지 결정하세요.

Codex 입력창에서 /goal 뒤에 달성할 결과를 적으면 현재 대화에 목표가 저장됩니다. 명령이 보이지 않으면 지원 버전과 features.goals 설정을 확인하세요. 목표를 수정하거나 잠시 멈출 수 있으며, 완료 여부는 변경 파일과 테스트 결과로 판단합니다.

Nano Banana Pro의 503은 Deadline expired라는 메시지를 동반할 수 있습니다. 같은 요청을 다시 보낼 수 있는지 확인하고, 횟수와 시간을 제한해 재시도하세요. 응답이 없었다면 중복 생성 전에 원래 작업의 결과부터 확인해야 합니다.

녹음 파일의 화자·단어 시각은 gemini-3.5-transcribe로, 말하는 동안 바뀌는 자막은 gemini-3.5-transcribe-live로 처리합니다. 자주 충돌하는 설정을 분리하고 확정 텍스트와 미완료 결과를 구별해 저장합니다.

Gemini 3 Pro Image의 Batch 요금은 같은 작업의 Standard 요금 대비 50%입니다. 다만 이미지 출력 단가가 최종 비용 전부는 아닙니다. 총비용 계산부터 JSONL 요청 작성, 이미지 저장, 실패 요청만 다시 처리하는 흐름까지 연결합니다.

2026년 10월 6일 기준 Claude Fable 5.5는 미발표, Gemini 4 Argon은 제한 공개, GPT-6.1 Astra는 출시 취소입니다. 지금 쓸 수 있는 건 Sol뿐입니다.

Grok Voice Agent API는 wss://api.x.ai/v1/realtime에서 양방향 음성 대화를 제공합니다. 서버에서는 API 키, 브라우저에서는 단기 토큰으로 인증합니다. WAV 파일을 전송하고 응답을 재생 가능한 파일로 저장하는 예제로 시작한 뒤 자동 발화 감지와 중단 처리를 연결할 수 있습니다.

Gemini Developer API의 현재 대체 모델은 Nano Banana 2.1입니다. Firebase에서는 지원 표를 별도로 확인하고, 모델 ID뿐 아니라 요청 설정과 이미지 저장 처리까지 옮겨야 합니다.

LLM 에이전트의 비용 상한은 다음 유료 요청 앞에서 검사해야 합니다. 이미 쓴 금액과 진행 중인 요청의 예약액을 함께 계산하고, 재시도와 하위 에이전트에도 같은 예산을 적용하는 구현을 설명합니다.