#LLM

관련 뉴스 84건

  1. 중국

    지푸 AI가 앤트로픽과 경쟁하며 GLM-5.2를 에이전트로 전환했다

    지푸 AI가 앤트로픽과의 경쟁 속에서 GLM-5.2를 에이전트로 전환하는 새로운 도구를 개발했습니다. 이는 AI 모델의 활용 방식을 변화시키는 움직임입니다. 이 기술은 AI 분야의 경쟁 구도를 심화시키고 있습니다.

  2. IT

    다음 AI 요약 베타 출시 검색 결과 자동 정리 기능 제공

    다음이 자체 언어모델 '솔라'를 기반으로 검색 결과를 자동 요약해주는 'AI 요약' 베타 서비스를 출시했습니다. 이 서비스는 LLM이 웹 문서를 분석하여 검색 결과에 대한 종합적인 답변과 근거를 제공합니다. 사용자가 검색창에 키워드를 입력하면 핵심 요…

  3. IT

    AI 장기 투자 수익률은 인간과 동일하다는 연구 결과 발표

    LLM 기반 AI 트레이딩이 장기 투자에서 인간의 매수 후 보유 전략과 동일한 수익률을 보였다는 연구 결과가 발표되었다. 이는 AI가 장기 투자 전략에서도 인간의 전략과 차이가 없음을 시사한다. 해당 연구는 AI와 인간 투자 전략 간의 유사성을 보여준…

  4. IT

    다음이 AI 요약 서비스를 출시하고 업스테이지 솔라를 최초 적용했다

    포털 다음이 인공지능(AI)이 검색 결과를 정리해주는 'AI 요약' 서비스를 출시했습니다. 이 서비스는 업스테이지의 거대언어모델 '솔라'를 처음 적용한 사례입니다. 다음은 연내 대화형 AI 검색으로 확대할 계획입니다.

  5. 사회

    지푸AI 인간처럼 성장하는 로봇 모델 발표로 주목받으며 주가 상승

    지푸AI는 LLM에서 에이전트, 나아가 피지컬AI로 확장하는 세계관을 바탕으로 가치를 평가받고 있습니다. 이 회사의 주가는 22일에 시가총액 1조 홍콩달러를 넘어섰습니다. 지푸AI와 중국 인민대학 간의 협력이 언급되었습니다.

  6. IT

    업스테이지 다음에 검색 결과 자동 요약 기능 도입해 AI 포털 발전 시동

    업스테이지가 포털 '다음'에 검색 결과 자동 요약 기능을 도입했습니다. 이는 자체 거대언어모델인 '솔라'를 기반으로 웹 문서를 분석하고 검색 결과에 대한 답변을 정리하는 서비스입니다. 이로써 AI 포털로서의 발전을 본격화합니다.

  7. IT

    Leanstral 1.5 모델 정보 공개 및 상세 내용은 Mistral AI 문서에서 확인 가능

    Leanstral 1.5 모델에 대한 정보가 제공되었습니다. 해당 모델의 상세 정보는 Mistral AI 문서에서 확인할 수 있습니다. 관련 댓글은 Hacker News에서 찾아볼 수 있습니다.

  8. IT

    AI 브라우저 공격이 시스템 안전성에 새로운 위협을 제기하다

    새로운 공격은 AI 브라우저가 나쁜 아이디어인 또 다른 이유를 제시한다. LLM에게 잘못된 정보를 제공하면 금지된 지침을 따르게 할 수 있다. 이는 AI 시스템의 안전성과 제어에 대한 문제를 시사한다.

  9. IT

    단어는 의식의 부산물이며 LLM에는 역방향으로 작용한다

    단어는 의식의 부산물이며, 이는 LLM에게는 역방향으로 작용한다. 이 글은 단어와 의식의 관계에 대해 논하고 있다.

  10. IT

    마이크로 에이전트 협업으로 프론티어 모델 성능을 뛰어넘다

    마이크로 에이전트는 모델 API 내 협업을 통해 프론티어 모델의 능력을 능가할 수 있습니다. 이는 모델들이 협력하여 더 높은 성능을 달성하는 방식을 의미합니다. 이 기술은 모델 간의 상호작용을 통해 새로운 수준의 추론 능력을 가능하게 합니다.

  11. IT

    Bash4LLM은 추가 설치 없이 터미널에서 LLM API를 쉽게 사용할 수 있게 한다

    Bash4LLM은 LLM API와 상호작용하기 위한 경량의 의존성 없는 Bash 래퍼입니다. 이 도구는 Python이나 Node와 같은 추가 런타임 설치 없이 작동하도록 설계되었습니다. 이는 터미널 환경에서 LLM 사용을 단순화하는 것을 목표로 합니다…

  12. IT

    거울 테스트 통과 여부에 대한 LLM 능력 평가 논의 중

    LLM이 거울 테스트를 통과하는지에 대한 논의가 이루어지고 있습니다. 이 주제는 LLM의 능력에 대한 평가와 관련이 있습니다. 해당 기사는 관련 토론을 포함하고 있습니다.

  13. IT

    Ornith-1.0, 에이전트 코딩을 위한 자체 지지 LLM 개발

    Ornith-1.0은 에이전트 코딩을 위해 설계된 자체 지지 대규모 언어 모델입니다. 이 모델은 특정 작업 수행에 필요한 지식을 내재화하고 있습니다. 이는 에이전트 시스템의 코딩 능력을 향상시키는 것을 목표로 합니다.

  14. IT

    Wayfinder 라우터 로컬 및 호스팅된 LLM 간 쿼리 결정론적 라우팅 기술 제시

    Wayfinder 라우터는 로컬 및 호스팅된 LLM 간의 쿼리를 결정론적으로 라우팅하는 방법을 제시합니다. 이 기술은 LLM 간의 상호작용을 효율적으로 관리하는 데 중점을 둡니다. 이는 GitHub 저장소와 하이라이트에서 논의되고 있습니다.

  15. IT

    오픈 가중치와 클로즈드 소스 LLM 간의 차이점 분석

    오픈 가중치 LLM과 클로즈드 소스 LLM 사이에는 격차가 존재합니다. 이는 두 모델 유형 간의 차이를 다루는 주제입니다. 이 기사는 해당 격차에 대해 논의하고 있습니다.

  16. 홍콩

    거대 언어 모델 도입으로 중국 법조계 변호사들의 영향에 대한 우려 제기

    거대 언어 모델이 중국 법조계에 진입하면서 일부 변호사들이 손해를 볼 수 있다는 우려가 제기되고 있습니다. 베이징대학교와 제휴된 데이터베이스를 활용하여 법령 검색 및 계약 자동 생성이 가능한 LLM 도구가 출시되었습니다. 이는 법률 서비스 분야에 새로…

  17. IT

    LLM 코드 스타일과 비용 고려가 중요해지고 있다

    LLM의 코드 스타일과 토큰 비용에 대한 정보를 알게 되었다. 이는 LLM 사용 시 고려해야 할 중요한 사항이다. 해당 내용은 관련 커뮤니티에서 논의되고 있다.

  18. IT

    OpenAI와 Broadcom, LLM 추론용 칩 개발로 실리콘 경쟁 가열

    OpenAI와 Broadcom이 대규모 언어 모델(LLM) 추론용 칩을 발표했습니다. 이는 수요 증가에 따른 실리콘 분야의 경쟁 심화를 반영합니다. 현재 실리콘 경쟁이 치열한 상황입니다.

  19. IT

    OpenAI와 Broadcom, LLM 구동 위한 최적화 추론 칩 공개

    OpenAI와 Broadcom이 LLM 최적화를 위한 추론 칩을 공개했습니다. 이 칩은 대규모 언어 모델의 효율적인 구동에 중점을 둡니다. 이는 AI 연산 가속화 분야에서 중요한 진전을 의미합니다.

  20. IT

    Qwen-AgentWorld 일반 에이전트 기능 향상을 위한 언어 세계 모델 제안

    Qwen-AgentWorld는 일반 에이전트를 위한 언어 세계 모델을 제안합니다. 이는 에이전트의 기능을 향상시키기 위해 설계되었습니다. 이 연구는 관련 논문으로 발표되었습니다.