profile
작지만 알아야 할 모든 것
태그 목록
전체보기 (231)논문리뷰(111)AI트렌드(83)LLM(82)VLM(77)DocumentAI(65)OCR(47)멀티모달(25)rag(23)Anthropic(22)LLM API(19)OpenAI(18)AI에이전트(18)오픈웨이트(12)AITrend(11)벤치마크(10)GeminiAPI(8)AI(8)MOE(8)MCP(7)암묵지(7)에이전트(7)AIAgent(6)강화학습(6)AI규제(6)claudecode(6)AI보안(6)Claude(5)XAI(5)AI 트렌드(5)NLP(4)GPT-5.6(4)Nvidia(4)정보검색(4)AI 에이전트(4)Gemini(4)코딩에이전트(3)지식그래프(3)interpretability(3)로컬LLM(3)AgentSkills(3)LLM API 가격(3)문서파싱(3)음성AI(3)SmolDocling(2)오픈소스(2)mlops(2)온톨로지(2)ByteDance(2)AI코딩에이전트(2)MultimodalRAG(2)VisualReasoning(2)AI영상생성(2)LLM API 보안(2)AgentSkill(2)미스얼라인먼트(2)Fable5(2)DevDay 2026(2)Microsoft(2)에이전트보안(2)LLM API 비용(2)AI 코딩 에이전트 보안(2)AI거버넌스(2)EU AI Act(2)개발자(2)프롬프트캐싱(2)AI비용(2)프롬프트인젝션(2)LongContext(2)이미지생성(2)Grok 4.7(2)엔터프라이즈AI(2)구글(2)AI 코딩 도구(2)huggingface(2)구글AI(2)vLLM(2)GUI에이전트(2)KV캐시(2)MLLM(2)ReadingOrder(2)Retrieval(2)멀티에이전트(2)지식관리(2)지식베이스(2)API 비용(2)GPT-6 Astra(2)GRPO(2)추론최적화(2)deepseek-flash(2)Claude Code 취약점(2)파인튜닝(2)AI에이전트보안(2)사전학습(2)DeepSeek V4.1 Flash(1)지식편집(1)ThinkingMachines(1)Claude Code 사용량 제한(1)리걸테크(1)ioProducts(1)잠재추론(1)ZML(1)NOOA(1)'x402'(1)금융AI(1)prompt(1)Lean 4(1)메타AI(1)CISA KEV(1)Cerebras(1)PyTorch 2.13(1)커서 라우터(1)OCR4(1)Cursor 비용절감(1)재현성(1)GeminiOmni(1)토큰최적화(1)음성 에이전트 API(1)결제api(1)ARCAGI(1)공공AI(1)FuguUltra(1)codex(1)LLM가격(1)GPT 6 Sol(1)감정형AI(1)Gemini TTS 가격(1)알리바바(1)AgenticPayments(1)TogetherAI(1)Claude Sonnet 5.5(1)OpenAI ZDR(1)Agents API(1)셀프호스팅LLM(1)Codex 업데이트(1)agent(1)MOSSVL(1)oAuth(1)코드 유출(1)테이블데이터AI(1)로보틱스(1)DiffusionGemma(1)오픈모델(1)ChatGPT 크롬 확장(1)GLM-5.3-Flash(1)solar-mini4(1)VisualGrounding(1)Kimi K3(1)Kimi Code(1)화자분리(1)DeepSeek V4-Pro 가격(1)AI아키텍처(1)DeepSeek Harness(1)제미나이 3.7 플래시(1)인프라(1)임베딩(1)VDR(1)PyTorch(1)셀프호스팅(1)멀티모달 LLM(1)Visual_Instruction_Tuning(1)huggingface-cli(1)ModelRouter(1)tts api(1)음성인식 API(1)API비용(1)Zero Data Retention(1)OpenAI Codex(1)LiveTranslate(1)OpenAI Astra(1)KBVQA(1)FireRedOCR(1)ChatGPT Work(1)AnalyticsAPI(1)DiffusionLLM(1)스타트업투자(1)dsh(1)모델라우팅(1)jailbreak(1)OpenAI Agents API(1)ProjectPerception(1)구글딥마인드(1)Sign in with ChatGPT(1)Agentjacking(1)git config RCE(1)Kimi K2.8(1)grok(1)Claude Fable 5.1(1)Doubao(1)존점퍼(1)옴니모달(1)VLN(1)gpt-3.5-turbo-instruct(1)TableOCR(1)MHS(1)pxpipe(1)LLM Wiki(1)Gemini CLI 지원 종료(1)robustness(1)gemini-4-argon(1)Sora 2(1)추론모델(1)voice agent(1)TabPFN(1)pluginjson(1)HTR(1)프롬프트 캐싱(1)ComputerUse(1)AI 에이전트 보안(1)AAIF(1)Wan3.0(1)영상생성API(1)오픈소스AI(1)SiriGemini(1)selfhosted(1)중국AI(1)허깅페이스인수(1)AI 음성 복제(1)오픈소스 코딩 에이전트(1)TableParsing(1)gpt-live-1(1)AI 브라우저(1)FLUX API(1)샌드박스 격리(1)CVE-2026-72718(1)Claude Fable 5(1)Moonshot AI(1)FDE(1)프록시(1)Sakana Fugu(1)Fugu Max(1)코드실행(1)ContextEngineering(1)apple silicon(1)실시간번역(1)FlexAttention(1)AI반도체(1)업스테이지(1)데이터큐레이션(1)DNS 터널링(1)Codex rate limit(1)LLMD(1)OpenID Connect(1)MetaModelAPI(1)nanobanana(1)NotebookLM(1)이미지생성AI(1)Claude Code 주간 한도(1)gemma4(1)MCP 인증 우회(1)Muse Spark 1.2(1)Imagen4 종료(1)제미나이 4 아르곤(1)스파스어텐션(1)minimax(1)제로클릭 RCE(1)Cursor SpaceX 인수(1)Imagen 마이그레이션(1)API 마이그레이션(1)un(1)HumanAI협업(1)mistral(1)GB10(1)msa(1)A2A(1)Gemini 3.8 Flash(1)해석가능성(1)Asic(1)GLM 5.3 가격(1)HTTP402(1)Private Safety Processing(1)SenseNova(1)크런치베이스(1)LLM 라우팅(1)RCE(1)eve(1)뉴클라우드(1)Meituan(1)연구자동화(1)MoonshotAI(1)Gemini Live API 가격(1)Irregular(1)API 비용 최적화(1)딥시크(1)Holo3.1(1)LVLM(1)Gemini 3.5 Transcribe(1)DocVQA(1)컴플라이언스(1)오픈AI(1)개발자도구(1)AI조달(1)PaddleOCR(1)GPT 6 Luna(1)Gemini 3.8 Flash 가격(1)Claude Opus 5.5(1)Claude Opus 5(1)Videos API 종료(1)GraphRAG(1)데이터셋(1)Apple OpenAI 소송(1)LayoutAnalysis(1)navigation(1)Grok CLI(1)파운데이션모델(1)LLM추론서버(1)ModelContextProtocol(1)qwen(1)ColPali(1)Responses API(1)클로드(1)Upstage API(1)캘리브레이션(1)최적수송(1)OpenAI 음성 API(1)웨이퍼스케일(1)FLUX 3(1)MultimodalLLM(1)GPT-5.6 Sol(1)오케스트레이션(1)사이버보안(1)Fugu Ultra v2(1)FeatureEngineering(1)ClaudeSonnet5(1)Qwen API(1)GPT-6.1 Sol 가격(1)Claude API 요금(1)ImageAPI(1)머신러닝(1)LLM비용(1)AI 코딩(1)AI 게이트웨이 보안(1)RealtimeAPI(1)ChatGPT Plus(1)폴백(1)포스트트레이닝(1)claude-sonnet-5-5(1)재귀적 자기개선(1)TextDiffusion(1)Hugging Face 인수(1)memory(1)LLMOps(1)slackapi(1)kimi-for-coding(1)ray(1)모델 마이그레이션(1)Open Secure AI Alliance(1)Claude 워터마크(1)문서파이프라인(1)DNS리바인딩(1)gpt-realtime-2.1(1)LLM API 요금(1)프롬프트엔지니어링(1)Cursor Router(1)음성 에이전트(1)양자화(1)잠재공간(1)Claude 데이터 보존(1)openai API(1)speech-to-speech(1)mitmproxy(1)Gemini Notebook(1)OpenAI 학습 중단(1)Meta Business Agent(1)gemini-3.8-flash-tts(1)supabase(1)MAI(1)Claude Code 대안(1)Slack Code(1)SAP(1)MuseSpark(1)Gemini 4 Argon 가격(1)CJS(1)Vercel(1)이미지생성API(1)LLM인프라(1)클로드사이언스(1)메타 비즈니스 에이전트(1)mythos(1)앤스로픽(1)AI 코딩 에이전트(1)InContextLearning(1)OpenAI Cursor 종료(1)core.fsmonitor(1)Muse Code(1)Solar Mini 4(1)오픈소스LLM(1)DGX Spark 64GB(1)Opus 5 가격(1)Qwen3.8-Max(1)Embedding(1)Decisions API(1)Plugin4Shell(1)Black Forest Labs(1)Grok Voice(1)Cursor API key(1)MPS(1)GPT-5.6-Cyber(1)MuseGlimmer(1)gpt-6.1-sol(1)Gemini 3.8 Live(1)바이두(1)MCP스펙(1)DSA VLOSE(1)제미나이 3.6 플래시(1)Seedream(1)KDA(1)Inkling-Small(1)grok-voice-latest(1)LLM에이전트(1)ChainOfThought(1)리랭킹(1)GLM-5.2(1)Meta Model API(1)워크플로우(1)디지털서비스법(1)DGX Spark(1)OpenAI API deprecation(1)ModelHardwareStandard(1)ncp(1)ComputerUseAgent(1)websocket(1)AI인프라(1)문서검색(1)GPT-Live-1 가격(1)gemini-3.8-live-extended-thinking(1)프런티어모델(1)GitSpawn(1)RuleChef(1)Gemini 3.7 Flash(1)모델오케스트레이션(1)Stateless(1)온디바이스AI(1)SakanaAI(1)DEEPSEEK(1)LongCat(1)R-SWA(1)KimiK3(1)VC(1)토큰맥싱(1)Seed2.1(1)Nemotron3(1)LiteLLM 취약점(1)AI 수학(1)HPC(1)claude cowork(1)AgentPlugins(1)장문맥(1)DeepSeek API 가격(1)Codex harness(1)LLM_Agent(1)DataAgent(1)sentry(1)CVE-2026-59822(1)앤트로픽(1)thinking signature(1)ChatGPT EU 규제(1)지식증류(1)Agent2Agent(1)CVE-2025-62593(1)Daybreak(1)SynthID-Text(1)Realtime API(1)DeepSeek API 요금(1)AI R&D 자동화(1)제미나이 3.8 플래시(1)Codex 5시간 제한(1)영상생성AI(1)Gemini 3.7 Flash 가격(1)AI투자(1)Astra for Law(1)whatsapp business api(1)토큰압축(1)AI배포(1)코드채널(1)AI인프라보안(1)STT API(1)ChatGPT Atlas(1)비디오_이해(1)AgentMemory(1)WEBRTC(1)MicrosoftFrontier(1)코딩모델(1)PriorLabs(1)Computer_Vision(1)AI 텍스트 워터마크(1)
post-thumbnail

DGX Spark 64GB 클러스터링 조건 — 공식 문서로 본 100B 한도와 vLLM 실행 경로

엔비디아가 2026년 10월 2일 공개한 DGX Spark 64GB는 $4,999부터, 10월 23일 판매 시작이다. 단일 기기 100B 파라미터 한도와 ConnectX-7 2대 클러스터링 조건, vLLM 실행 명령을 공식 문서 기준으로 정리했다.

약 6시간 전
·
0개의 댓글
·

[논문리뷰] FocusVTC: Efficient and High-Performance Visual Text Compression with Adaptive Resolution (적응형 해상도 시각 텍스트 압축)

FocusVTC(arXiv:2609.36651) 리뷰. 저DPI로 훑고 근거 영역만 zoom_region으로 확대해 읽는 적응형 시각 텍스트 압축. RULER v1 2.9배 압축에 87.4점(Glyph 57.5), LongBench 56.40으로 텍스트 백본 상회.

약 17시간 전
·
0개의 댓글
·
post-thumbnail

Decisions API 정리 — gpt-6-luna로 분류·라우팅하기, 공식 문서는 아직 없다

OpenAI Decisions API가 2026년 9월 29일 DevDay 2026에서 제한 프리뷰로 공개됐다. gpt-6-luna 기반으로 분류·라우팅을 처리하는 API이며, 공식 문서와 가격이 아직 없는 현재 상태와 대체 경로를 정리했다.

어제
·
0개의 댓글
·

[논문리뷰] Context Language Models (컨텍스트를 파일처럼 다루는 LLM)

컨텍스트를 모델이 직접 편집하는 파일로 만든 Context Language Models(CLM) 리뷰. 파인튜닝 없이 BrowseComp-Plus 59.4%에 FLOPs 21.5% 절감, 9B는 RL로 47.6% 향상, SCR로 서빙 연산 35% 절감.

1일 전
·
0개의 댓글
·
post-thumbnail

Gemini 4 Argon 벤치마크 13/18 선두, 그런데 API 모델 ID가 아직 없다

구글이 2026년 9월 30일 공개한 Gemini 4 Argon은 출력 한도를 100만 토큰으로 늘렸고, 도입가는 입력 $2·출력 $10다. 다만 Gemini API 공식 문서에 모델 ID가 아직 없어 지금은 호출할 수 없다.

2일 전
·
0개의 댓글
·

[논문리뷰] Xiaomi-OCR-0 Technical Report (0.8B 통합 문서 파싱 VLM)

Xiaomi-OCR-0: 0.8B 단일 모델로 문서 파싱과 OCR 이해를 통합. 8개 전문가 합의 + 렌더링 검증 데이터 엔진과 Mix-RL로 Real5 95.24, OmniDocBench v1.6 96.83, OCR VQA 평균 83.2 달성.

3일 전
·
0개의 댓글
·
post-thumbnail

gpt-6.1-sol 도입 점검 — 캐시 입력 절반, Astra 대비 5분의 1 단가

GPT-6.1 Sol이 2026년 9월 29일 DevDay 2026에서 공개됐다. gpt-6.1-sol 가격은 입력 $2·출력 $10로 GPT-6 Sol과 같고 캐시 입력만 절반인 $0.10이며, GPT-6 Astra 대비 정확히 5분의 1 단가다.

3일 전
·
0개의 댓글
·

[논문리뷰] RenderRank: Learning to Rerank Text with Compressed Visual Tokens (텍스트를 이미지로 렌더링하는 리랭커)

RenderRank는 문서를 이미지로 렌더링해 시각 토큰으로 리랭킹한다. 2.1B 모델로 BEIR 평균 NDCG@10 55.96, 입력 토큰 16.5~35.5% 절감, 롱 도큐먼트 88.27에 처리량 1.70배.

4일 전
·
0개의 댓글
·
post-thumbnail

claude-sonnet-5-5 전환 가이드 — 단가는 그대로, 파괴적 변경 5가지

Claude Sonnet 5.5가 2026년 9월 28일 공개됐다. claude-sonnet-5-5 단가는 $2/$10로 Sonnet 5와 같지만 thinking·tool_choice 등 파괴적 변경 5가지가 있어 코드 수정이 필요하다. 전환 체크리스트까지 정리했다.

4일 전
·
0개의 댓글
·

[논문리뷰] WFM: Wiki Foundation Model for Complex Agentic Reasoning (LLM 위키 기반 에이전트 지식 모델)

Tencent Youtu Lab의 WFM 리뷰. 희소 트리플 대신 문서+링크(LLM Wiki)를 한 그래프에 담고, 어텐션 붕괴를 분산 정규화로 막았다. HotpotQA Recall@20 93.20, NCCL 통신 최적화로 학습 10.5배 가속.

5일 전
·
0개의 댓글
·
post-thumbnail

deepseek-flash 단가와 피크·오프피크 계산법 — DeepSeek API 가격 8월 인상 이후

DeepSeek API 가격은 2026년 8월 피크·오프피크 요금제 도입 이후 네 가지로 갈린다. deepseek-flash 단가와 피크 시간의 한국 시간 환산, 캐시 히트가 만드는 100배 차이, 매출 10억 달러 보도까지 공식 문서 기준으로 정리했다.

5일 전
·
0개의 댓글
·

[논문리뷰] Knowledge Pull Requests for Continual Document Authoring (KPR, 문서를 코드리뷰처럼 갱신하기)

영어 위키백과를 49개 언어판 지식으로 갱신하는 KPR 논문 리뷰. 문서를 claim 단위로 분해·필터링·라우팅해 리뷰 가능한 ChangeLog를 남긴다. 추가 정보 재현율 0.716→0.891, 원문 보존 97.3%, 7B 모델이 웹검색 프런티어 모델을 앞섰다.

6일 전
·
0개의 댓글
·
post-thumbnail

OpenAI DNS 샌드박스 탈출 보고서 정리 — 탐지 12분, 차단까지 2시간 32분

OpenAI 학습 중단의 배경인 DNS 샌드박스 탈출 사고를 정리했다. 에이전트는 DNS 위임으로 외부 챗봇에 질문 19건을 보냈고, 탐지는 약 12분, 차단은 2시간 32분이 걸렸다. 완화 조치와 에이전트 격리 점검 항목을 공개 자료 기준으로 짚는다.

6일 전
·
0개의 댓글
·

[논문리뷰] Diffusion Drafts, AR Verifies: Accelerating Document OCR with Self-Speculative Decoding (GravityOCR)

GravityOCR: 확산 병렬 드래프팅과 자기회귀 검증을 한 모델에 합친 문서 OCR 가속 기법. forward 1회당 평균 9.7토큰 커밋, 디코딩 3.94배·페이지 1.32배 가속, OmniDocBench Overall 95.16 유지.

7일 전
·
0개의 댓글
·
post-thumbnail

solar-mini4 API 전환 가이드 — 512K 컨텍스트에 solar-pro4의 3분의 1 단가

2026년 9월 22일 업스테이지 solar-mini4 정식 API가 열렸다. Solar Mini 4 가격은 100만 토큰당 입력 $0.10 / 출력 $0.40으로 solar-pro4의 3분의 1이다. 512K 컨텍스트와 reasoning_effort도 정리했다.

2026년 9월 26일
·
0개의 댓글
·

[논문리뷰] Document Retrieval-Aware Chunking (D-RAC): Universal Retrieval-Aware Ingestion of Enterprise Documents via PDF Normalization and Multimodal Markdown Conversion (기업 문서 RAG 청킹)

기업 문서 RAG 인제스천 파이프라인 D-RAC 리뷰. 모든 입력을 PDF로 정규화한 뒤 멀티모달 LLM 1회 변환, 청킹 LLM은 요소 ID만 출력. 236문서·795페이지를 71.7분 무오류 처리, 출력 토큰 95.7%·비용 최대 85.6% 절감.

2026년 9월 26일
·
0개의 댓글
·
post-thumbnail

gemini-3.8-flash-tts 적용하기 — 보이스 디자인, 2화자 대화, 오디오 출력 토큰 요금

구글이 2026년 9월 23일 Gemini 3.8 Flash TTS를 공개했다. gemini-3.8-flash-tts 호출 코드, 보이스 디자인과 음성 복제, 2화자 대화 설정, 2027년 2배가 되는 오디오 출력 요금을 정리했다.

2026년 9월 25일
·
0개의 댓글
·

[논문리뷰] EvoOntology: A Self-Evolving Ontology Layer for Data Agents (자기진화 온톨로지 레이어)

EvoOntology 논문 리뷰. 데이터 에이전트의 의미 공백을 MCP 온톨로지 레이어로 메우고, 실행 기록 기반 자기진화 루프로 DDR-Bench Traj-Wise 69.5→89.5(+20.0), BIRD EX 63.6→72.4를 달성했다.

2026년 9월 25일
·
0개의 댓글
·
post-thumbnail

grok-4.7 API 뜯어보기 — 200K 토큰 경계 요금과 reasoning effort 설정

Grok 4.7이 2026년 9월 21일 공개됐다. grok-4.7 가격은 100만 토큰당 입력 $2 / 출력 $6이지만 프롬프트가 200K 토큰을 넘으면 두 배가 된다. 500K 컨텍스트와 reasoning effort 설정, 공식 문서 기반 호출 예제까지 정리했다.

2026년 9월 24일
·
0개의 댓글
·

[논문리뷰] All-in-One Multilingual Scene Text Recognition with Script-aware Mixture-of-Experts (ScriptMoE)

단일 모델로 229개 언어를 읽는 다국어 OCR 연구. 문자체계별 Top-2 전문가 MoE 디코더로 TextMuSS-Bench 평균 82.06%를 달성하고, PP-OCRv5의 인식기 교체만으로 CC-OCR F1을 65.71%에서 80.89%로 끌어올렸다.

2026년 9월 24일
·
0개의 댓글
·