28 Jul 2026
|
Paper Review
Weekly Papers
이번 글에서는 Visual prompt engineering for video models 논문의 핵심 포인트만 간단히 정리한다. 2026년 7월 28일(Arxiv), arXiv Geirhos, Robert, Li, Yuxuan, Wiedemer, Thaddäus, Kalibhat, Neha, Wang, Zi, Malek, Mani, Tafjord, Oyvind, Swersky, Kevin, Kim, Been, Jaini, Priyank. Google DeepMind 논문 링크 요약 이 논문은 비디오 모델의 시각 추론 성능을 높이기...
24 Jul 2026
|
Paper Review
Weekly Papers
이번 글에서는 StateAct: Program State, before Pixels, for Long-Horizon Computer-Use Agents 논문의 핵심 포인트만 간단히 정리한다. 2026년 7월 24일(Arxiv), arXiv Yang, Yan, Jian, Xiangru, Luo, Ziyang, Zhao, Zirui, Dai, Yutong, Shi, Ziji, Yan, Hanshu, Liew, Jun Hao, Savarese, Silvio, Li, Junnan. Salesforce AI Research 논문 링크 요약 StateAct는 장기 지평...
19 Mar 2025
|
Paper Review
Reasoning
이번 글에서는 Tree of Thoughts: Deliberate Problem Solving with Large Language Models 논문의 핵심 포인트만 간단히 정리한다. 2023년 5월(Arxiv), NeurIPS 2023 Shunyu Yao et al. Princeton University, Google DeepMind 논문 링크 Github 요약 Exploration, strategic lookahead 등이 필요한 복잡한 추론 문제를 풀기 위해 tree of thoughts (ToT) 방법을 제안한다. CoT를...
18 Mar 2025
|
Paper Review
LLM Evaluation
이번 글에서는 Judging LLM-as-a-Judge with MT-Bench and Chatbot Arena 논문의 핵심 포인트만 간단히 정리한다. 2023년 12월(Arxiv), NeurIPS 2023 Lianmin Zheng et al. UC Berkeley, UC San Diego, Carnegie Mellon University, Stanford, MBZUAI 논문 링크 Github Huggingface MT-Bench Chatbot Arena Chatbot Arena 요약 Chat assistant에 기반한 LLM 평가는 open-ended 특성상 평가...
17 Jan 2025
|
Paper Review
Domain Adaptation
이번 글에서는 AdaptLLM: Adapting-large-language-models-to-domains-via-reading-comprehension 논문의 핵심 포인트만 간단히 정리한다. 2023년 7월(Arxiv), ICLR 2024 Daixuan Cheng, Shaohan Huang B & Furu Wei. Microsoft Research,Beijing Institute for General Artificial Intelligence (BIGAI) 논문 링크 Github Huggingface 요약 Domain-specific corpora에서 pre-training 하는 것은 모델이 해당 domain에 대한 지식을 학습할 수 있도록 해 주지만, 반대로...