#LLM
관련 뉴스 84건
-
IT
업스테이지, 에이전트 특화 AI 모델 솔라 오픈2 공개
업스테이지가 자체 개발한 오픈웨이트 거대언어모델인 '솔라 오픈2'를 공개했습니다. 이 모델은 독자 인공지능 파운데이션 모델 프로젝트의 일환으로, 모델 가중치를 허깅페이스에 공개했습니다. 솔라 오픈2는 이전 모델보다 추론 능력이 향상되었습니다.
-
IT
LLM을 집에서 비트토렌트 방식으로 실행하는 기술 공개
Petals는 가정에서 LLM을 실행할 수 있도록 지원하는 기술에 관한 내용입니다. 이 기술은 비트토렌트 스타일로 작동합니다. 해당 기사는 Petals에 대한 정보를 담고 있습니다.
-
IT
아동의 LLM 챗봇 상호작용에서 의인화 현상 연구 발표
아동들은 대규모 언어 모델(LLM) 챗봇과 상호작용할 때 의인화 경향을 보인다. 이는 아동들의 상호작용에서 관찰되었다.
-
IT
LLM 사용 전 고려해야 할 여섯 가지 질문들
LLM을 추가하기 전에 고려해야 할 여섯 가지 질문이 제시되었다. 이 글은 LLM 사용에 앞서 숙고할 사항들을 다루고 있다. 이는 LLM 도입에 대한 사전 검토의 필요성을 시사한다.
-
IT
MUD를 이용한 LLM 평가 가능성 연구 결과 발표
연구진은 MUD(텍스트 게임)를 사용하여 LLM을 평가할 수 있는지에 대해 탐구하고 있다. 이들은 1970년대에서 유래한 텍스트 게임이 LLM 평가에 사용될 수 있는지에 대한 연구를 진행했다. 현재 관련 연구가 진행 중이다.
-
IT
Codeberg, LLM 외부 추출 금지를 위한 이용 약관 확장 작업 진행
Codeberg는 대규모 언어 모델(LLM)의 외부 추출을 금지하기 위한 이용 약관(ToU)을 확장하는 작업을 진행하고 있습니다. 이 변경 사항은 LLM 관련 사용에 대한 규제를 강화하는 것을 목적으로 합니다. 해당 내용은 Codeberg의 이슈에서 …
-
IT
제이엘케이 인텔 GPU 검증으로 LLM 경쟁력 입증
제이엘케이에서 인텔 GPU를 검증하여 LLM 경쟁력을 입증했다. 이는 해당 기술의 성능을 확인하는 과정이다. 이 결과는 관련 분야에 중요한 의미를 가진다.
-
미국
OpenAI는 오픈 가중치 모델에 대해 우려하며 미국도 같은 고민을 해야 한다
OpenAI는 오픈 가중치 모델에 대해 두려움을 가지고 있다. 중국산 오픈 가중치 LLM 금지 논의는 인공지능을 비즈니스로 전환하는 어려움을 보여준다.
-
IT
중국 AI 모델 키미 K3가 미국 선두 모델에 근접한 성능을 보이며 AI 경쟁을 심화시킨다
중국의 AI 스타트업 문샷AI가 개발한 대규모 언어 모델인 키미 K3가 미국 반도체 수출 규제에도 불구하고 높은 성능을 보였다. 이 모델은 2조 8천억 개의 매개변수를 가진 오픈웨이트 모델이다. 키미 K3는 오픈AI의 GPT-5와 같은 수준의 성능을 …
-
중국
알리바바, Qwen3.8 공개하며 앤트로픽의 Fable 5에 뒤진 것으로 평가\n
알리바바는 Qwen3.8을 공개했으며, 이는 Anthropic의 Fable 5보다 성능이 뒤처진다고 주장했습니다. 이 기사는 알리바바 모델과 경쟁 모델 간의 성능 비교에 관한 내용을 다루고 있습니다.
-
IT
Qwen3.8 모델 곧 오픈 웨이트로 공개 예정
Qwen3.8 모델이 곧 오픈 웨이트로 출시될 예정입니다. 이 정보는 알리바바 Qwen 관련 트윗을 통해 공개되었습니다. 해당 게시물은 하이라이트에서 논의되고 있습니다.
-
IT
중국 AI 모델 키미 K3가 제한된 자원으로 미국 선두 모델에 근접한 성능을 보였다
중국 스타트업 문샷AI의 대규모언어모델인 키미 K3가 글로벌 AI 산업에서 주목받고 있다. 이 모델은 제한된 자원으로 미국 선두 모델에 준하는 성능을 달성했다는 평가를 받는다. 이는 하드웨어 우위가 지속될 수 있는 여지를 제공한다.
-
IT
LLM 통합 다변수 미적분 과정 공개
LLM이 통합된 다변수 미적분학 강좌가 제공된다. 이 정보는 특정 웹사이트와 하이라이트닷컴에 댓글로 공유되었다. 해당 게시물은 23개의 점수를 받았다.
-
IT
LLM 프롬프트 주입을 막는 설명 가능한 게이트 ReasonGate 공개
ReasonGate는 대규모 언어 모델(LLM)에 프롬프트 주입을 차단하는 설명 가능한 게이트를 제공합니다. 이 프로젝트는 GitHub에서 공개되었으며, 관련 논의는 하이데일(Hacker News)에서 이루어졌습니다.
-
IT
머신러닝으로 생성된 텍스트를 구별하는 방법 연구
고전적인 머신러닝 기법을 사용하여 대규모 언어 모델(LLM)이 생성한 텍스트를 감지하는 방법이 논의되었다. 이 연구는 LLM 생성 텍스트를 식별하기 위한 분류 모델의 적용 가능성을 탐구한다. 해당 내용은 관련 커뮤니티에서 논의되고 있다.
-
IT
LLM 비평가들의 주장과 실제 사용 경험 간의 관계를 논한다
LLM 비평가들의 주장에 동의하며, 필자 역시 LLM을 사용하고 있음을 언급합니다. 이는 LLM에 대한 비판과 실제 사용 경험 사이의 관계를 시사합니다.
-
IT
LLM의 컴퓨터 구조 논문 심층 이해 능력 연구 발표
대규모 언어 모델(LLM)이 컴퓨터 구조 관련 논문을 깊이 있게 이해할 수 있는지에 대한 연구가 발표되었다. 이 연구는 LLM의 기술적 이해 능력을 평가하는 데 초점을 맞추고 있다. 해당 연구는 arXiv에 게시되었다.
-
IT
애플 인텔리전스, 중국 규제 통과로 출시 임박
중국 사이버공간관리국이 애플의 생성형 인공지능 서비스인 애플 인텔리전스를 중국 내 아이폰에서 사용할 수 있도록 등록했습니다. 이 등록으로 애플 인텔리전스의 중국 출시가 본격화될 것으로 예상됩니다. 중국은 대규모 언어모델과 생성형 AI 서비스를 일반 대…
-
IT
LLM과 MikroTik 네트워크 연동 방법 논의
이 기사는 LLM(거대 언어 모델)과 MikroTik 네트워크를 연동하는 방법에 대해 다룬다. 이는 LLM을 위한 네트워킹 환경 구축에 관한 내용이다. 해당 정보는 기술 블로그와 하이라이트(Hacker News) 댓글에서 논의되었다.
-
IT
무라티스 싱킹 머신 오픈 가중치 975B 파라미터 LLM 공개
Murati가 오픈 가중치 975B 파라미터를 가진 대규모 언어 모델을 출시했습니다. 이 모델은 Thinking Machines에서 공개되었습니다. 해당 기사에 대한 댓글 수는 18개입니다.