智谱, GLM-5.3-FlashX 출시…최대 200 tokens/s
智谱가 국산 칩 10만 장 기반의 최대 200 tokens/s 추론 속도를 내세운 GLM-5.3-FlashX를 출시했다. API와 체험센터 운영도 시작했다.
강이안 기자智谱가 국산 칩 10만 장 기반의 최대 200 tokens/s 추론 속도를 내세운 GLM-5.3-FlashX를 출시했다. API와 체험센터 운영도 시작했다.
강이안 기자유엔과 구글이 유엔 산하 기관의 통계를 AI 에이전트가 자연어로 조회할 수 있는 플랫폼을 공개했다. 2027년까지 유엔 시스템 통계 데이터 세트의 80%를 통합하는 것이 목표다.
김미래 기자LLM 워터마크가 일부 오픈 웨이트 모델의 유해 요청 거부와 AI 에이전트 도구 호출에 영향을 줄 수 있다는 연구 결과가 나왔다. 다만 클로드 모델에 같은 현상이 나타나는지는 검증되지 않았다.
김하린 기자블록체인캐피털은 AI 투자 열풍이 과거 암호화폐 시장의 추종 투자와 과잉 기대를 반복할 수 있다고 분석했다. 모델이 표준화되면 하드웨어와 애플리케이션 계층으로 가치가 옮겨갈 가능성이 제시됐다.
강이안 기자AI 모델의 성능 경쟁이 빨라지는 가운데 안전 기준과 평가 결과를 누가 검증할지를 둘러싼 논쟁이 커지고 있다. 센티언트 랩스와 NIST는 독립적인 평가와 검증 인프라가 필요하다고 지적했다.
이도현 기자엔비디아가 러스트로 GPU 커널을 작성할 수 있는 cuda-oxide와 cutile-rs를 공개했다. 두 프로젝트 모두 초기 단계로 상용 환경 적용에는 한계가 있다.
정민석 기자오픈AI가 윈도용 ChatGPT 앱에 현재 사용 중인 애플리케이션 화면과 텍스트를 대화 맥락으로 전달하는 Appshots 기능을 추가했다. 오류 분석과 디자인 검토, 문서·일정 관련 작업 등에 활용할 수 있다.
최윤서 기자앤트로픽 내부 플랫폼에서 약 3만개의 AI 에이전트가 연구·엔지니어링 작업을 수행하고 있다. 회사는 2026년 7월 13~20일 측정한 AI 연구·개발 연산량의 약 6%를 안전 작업에 배정했다고 밝혔다.
이준한 기자
데스크 토큰포스트 기자
데스크 토큰포스트 기자