쌓인 기록에서 찾기
무엇을 찾으세요?
날짜를 몰라도 됩니다. 제목·Key Point·요약·태그를 한꺼번에 뒤집니다.
검색 범위부터 2026년 10월 3일 (토)까지1629건
2건 · "바운딩박스"조건 지우기 ×
001▲ 123 · 댓글 14바운딩박스로 이미지를 픽셀 단위로 수정하는 FLUX 3Black Forest Labs가 이미지 생성·편집 모델 FLUX 3 Image를 공개했다.AI · 머신러닝 · FLUX 3 Image
바운딩박스로 이미지를 픽셀 단위로 수정하는 FLUX 3

Key Point이미지 생성 모델이 바운딩박스 기반 정밀 편집을 지원함으로써 레이아웃 제어와 픽셀 단위 수정이 가능해지며, 디자인·마케팅·콘텐츠 제작 워크플로우가 근본적으로 달라질 수 있다.
핵심 요약
- Black Forest Labs가 이미지 생성·편집 모델 FLUX 3 Image를 공개했다.
- 사용자가 캔버스에 바운딩박스를 그려 각 영역을 정확히 지정하고, 글로벌 캡션으로 전체 구도를 설명하면 모델이 박스 내부를 렌더링한다.
- 최대 4K 해상도의 네이티브 렌더링을 지원하며, 텍스처·얼굴·색상 같은 세부 사항을 보존한다.
전체 요약 9문장 읽기 → 002▲ 23 · 댓글 1텍스트를 선택적으로 압축하는 FocusVTC, 긴 문맥 처리 속도 2.79배 향상대규모 언어모델의 장문맥 처리는 계산과 메모리 비용이 큰데, 시각 텍스트 압축(VTC)은 텍스트를 이미지로 렌더링해 입력 길이를 줄인다.AI · 머신러닝 · FocusVTC: Efficient and High-Performance Visual Text Compression with Adaptive Resolution
텍스트를 선택적으로 압축하는 FocusVTC, 긴 문맥 처리 속도 2.79배 향상

Key Point긴 문맥을 처리하는 LLM 서비스에서 입력 토큰 수를 2.9배 줄이면서도 성능을 높이고 추론 속도를 2.79배 가속하는 방법이 제시되었으므로, 비용과 속도가 중요한 실제 배포 환경에서 직접 적용할 가치가 있다.
핵심 요약
- 대규모 언어모델의 장문맥 처리는 계산과 메모리 비용이 큰데, 시각 텍스트 압축(VTC)은 텍스트를 이미지로 렌더링해 입력 길이를 줄인다.
- 기존 방식은 해상도를 고정하므로 저DPI는 토큰을 절약하지만 가독성을 잃고, 고DPI는 불필요한 내용에 토큰을 낭비하는 문제가 있다.
- FocusVTC는 적응형 해상도로 이 트레이드오프를 깨뜨렸고, 압축된 저DPI 전역 뷰와 선택적 영역 강화를 결합한다.
전체 요약 9문장 읽기 →