쌓인 기록에서 찾기
무엇을 찾으세요?
날짜를 몰라도 됩니다. 제목·Key Point·요약·태그를 한꺼번에 뒤집니다.
검색 범위부터 2026년 9월 11일 (금)까지270건
3건 · "vLLM"조건 지우기 ×
001당일 +262논문 검색·분석하는 오픈소스 AI 리서치 에이전트 공개Feynman은 자연어 질문으로 학술 논문을 검색·분석·평가할 수 있는 오픈소스 AI 리서치 에이전트다.AI · 머신러닝 · advaitpaliwal/feynman · TypeScript
논문 검색·분석하는 오픈소스 AI 리서치 에이전트 공개

Key Point학술 논문 검색과 분석을 자동화하려는 연구자, 데이터 과학자, AI 에이전트 개발자에게 필수 도구가 될 수 있는 오픈소스 플랫폼이 등장했습니다.
핵심 요약
- Feynman은 자연어 질문으로 학술 논문을 검색·분석·평가할 수 있는 오픈소스 AI 리서치 에이전트다.
- PaperRank 점수 매기기, DOI·arXiv·논문 제목으로 접근, 문헌 검토, 논문 대 코드베이스 감사 등 12개 이상의 슬래시 커맨드를 제공한다.
- 로컬 모델(LM Studio, Ollama, vLLM), 클라우드 프로바이더(OpenAI, OpenRouter, GitHub Copilot)를 지원하며, 스탠드얼론 설치 또는 npm으로 배포된다.
- Feynman 터미널은 프로젝트·세션 네비게이션, 실시간 대화, 화학 스케치·노트북·스프레드시트 미리보기, 클라우드 스토리지 연동 같은 웹 워크벤치를 포함한다.
- 논문 재현 계획, ML 레시피 생성, 실험 반복문, 연구 추적 등 심화 기능으로 확장 가능하며, 코덱스·클로드 에이전트를 위한 기술 스킬 라이브러리로도 설치할 수 있다.
002▲ 143 · 댓글 53vLLM이 AMD GPU에서 추측 디코딩 지원vLLM이 추측 디코딩(speculative decoding) 기능을 AMD Instinct MI300X·MI355X GPU와 ROCm에서 구현했다.AI · 머신러닝 · Speculative Decoding in vLLM on AMD GPUs
vLLM이 AMD GPU에서 추측 디코딩 지원

Key PointLLM 추론 성능 최적화를 위한 주요 기법이 AMD GPU에서 실제 구현되어, 장기 생성 작업의 처리량 개선 가능성을 보여준다.
핵심 요약
- vLLM이 추측 디코딩(speculative decoding) 기능을 AMD Instinct MI300X·MI355X GPU와 ROCm에서 구현했다.
- 추측 디코딩은 경량 드래프트 모듈이 여러 토큰을 먼저 제안하고 타겟 모델이 한 번에 검증하는 방식으로, 기존 자동회귀 디코딩보다 모델 통과 횟수를 줄인다.
- 표준 방식은 토큰 하나당 모델 실행 1회가 필요하지만, 추측 디코딩은 여러 드래프트 토큰이 검증을 통과하면 단일 모델 실행으로 여러 토큰을 커밋할 수 있다.
- Native MTP, Gemma 4 MTP, EAGLE-3, DFlash, DSpark 등 5가지 드래프팅 방식을 검토했으며, 방식·제안 길이·모델 종류·수용 동작 등에 따라 처리량 개선 효과가 달라진다.
- 드래프트 토큰이 거부되면 거부 지점 이후의 토큰들은 폐기되고 타겟 모델의 결과로 생성을 계속한다.
003▲ 15 · 댓글 3알리바바 Qwen 3.8 27B 공개, 로컬 모델 최고 성능Qwen3.8-27B-FP8은 오픈 가중치 모델로 HuggingFace Transformers, vLLM 등과 호환된다.AI · 머신러닝 · Qwen 3.8 27B is out: open weights, best local dense model yet
알리바바 Qwen 3.8 27B 공개, 로컬 모델 최고 성능

Key Point로컬에서 구동 가능한 고성능 오픈소스 모델로, Hacker News 커뮤니티에서 배포 용이성과 벤치마크 성과에 주목받고 있다.
핵심 요약
- Qwen3.8-27B-FP8은 오픈 가중치 모델로 HuggingFace Transformers, vLLM 등과 호환된다.
- 27B 매개변수 모델로 코딩, 에이전트 작업, 멀티모달 이해 능력을 갖추고 262K 네이티브 컨텍스트를 지원한다.
- 터미널 코딩 벤치마크 73.0점, SWE-bench Pro 61.7점 등 기존 모델을 능가하는 성능을 보인다.