AI 사용자 수가 증가함에 따라 연구자들은 비판적 사고의 미래를 예측하는데, 그것은 좋지 않다.
최신뉴스 전체보기
IBM과 ETH 취리히의 연구진은 아날로그 퍼운데이션 모델(AFMs)을 발표했는데, 이 모델은 대형 언어 모델(LLMs)과 아날로그 인메모리 컴퓨팅(AIMC) 하드웨어 사이의 간극을 메우는 데 사용된다. AIMC는 효율성 측면에서 혁명적인 발전을 약속하며, 임베디드나 엣지 디바이스에 적합한 작은 공간에서 십억 개의 파라미터를 가진 모델을 실행할 수 있다.
LLM 판사가 1-5 (또는 pairwise) 점수를 할당할 때 정확히 무엇이 측정되는가? 대부분의 “정확성/신뢰성/완전성” 평가 기준은 프로젝트별로 다르며, 작업 기반 정의 없이 스칼라 점수는 업무 결과에서 벗어날 수 있다. LLM-as-a-judge (LAJ) 조사에서는 평가 기준의 모호함과 프롬프트 템플릿 선택이 점수와 사람에게 영향을 준다는 것을 언급하고 있다.

데이터 센터 용량은 기술 시장의 건강과 AI 버블의 위험을 나타내는 지표가 되었다.
xAI가 Grok-4-Fast를 소개했는데, 이는 “추론”과 “비추론” 행동을 시스템 프롬프트를 통해 제어 가능한 단일 가중치 세트로 병합한 비용 최적화된 Grok-4의 후속 모델이다. 이 모델은 2백만 토큰 컨텍스트 창과 네이티브 툴 사용 강화 학습을 통해 높은 처리량의 검색, 코딩 및 Q&A를 대상으로 한다.

마크 주커버그의 컴퓨터화된 안경 발표는 미래 컴퓨팅을 위한 약속을 이행하기 어려울 수 있는 기업을 드러냈다.
Xiaomi의 MiMo 팀이 100백만 시간 이상의 오디오를 기반으로 한 7조 파라미터 음성 언어 모델 ‘MiMo-Audio’를 공개했다. 새로운 점은 과업별 헤드나 손실 악센트 토큰에 의존하는 대신, RVQ 토크나이저를 사용하여 의미론적 정보 및 음성을 타깃팅한다.
머스크는 AI가 사회를 혁신할 것이라 믿으며, 자사의 xAI 회사가 테슬라와 다른 기업들과 융합될 것이고 이는 거대한 성공을 불러올 것이라고 확신하고 있다. 그는 자사의 모든 기업 포트폴리오에 중앙 인텔리전스 레이어를 통합할 의도이다. 이것이 성공할까?

F.C.C. 수장이 킴멜이 ‘마지막 발표’가 아닐 것이라고 언급하며, 일론 머스크가 인공지능에 올인하는 소식이 전해졌다. 또한, 금요일 뉴스 퀴즈도 열린다.
2025년 컴퓨터 비전 분야는 새로운 다중 모달 백본, 대규모 오픈 데이터셋, 더 견고한 모델-시스템 통합으로 빠르게 발전했다. 이 목록은 주요 연구 허브, 연구소 블로그, 제품 중심의 엔지니어링 웹사이트를 우선시하여 최신 정보를 제공한다.
Qwen이 Qwen3-ASR-Toolkit을 출시했습니다. 이는 Qwen3-ASR-Flash API의 3분/10MB 제한을 우회하기 위해 VAD 인식 청킹, 병렬 API 호출, FFmpeg를 통한 자동 재샘플링/포맷 정규화를 수행하여 안정적이고 시간 기준의 전사 파이프라인을 제공합니다. Python ≥3.8이 필요하며, 설치 방법은 공식 사이트에서 확인할 수 있습니다.

일론 머스크는 오픈AI의 성공을 따라가기 위해 인공지능 스타트업 xAI에서 여름을 보냈지만 결과는 혼돈으로 끝나게 되었다.

MIT Generative AI Impact Consortium Symposium에서 연구자와 비즈니스 리더들이 이 강력한 기술을 중심으로 한 잠재적인 발전에 대해 논의했습니다.
실제 운영용 에이전트는 모델 선택이 아닌 데이터 배관, 제어 및 관측성에 달려있다. 기업 문서를 처리하고 표준화하며 관리를 시행하고 관계적 특성과 임베딩을 색인화하여 인증된 API 뒤에서 검색 및 생성을 제공하는 “문서 대화” 파이프라인에 대한 설명.
MIT 연구진은 LEGO를 소개했는데, 이는 텐서 워크로드를 사용하여 공간 가속기에 대한 합성 가능한 RTL을 자동으로 생성하는 컴파일러와 유사한 프레임워크이다. LEGO는 손으로 템플릿을 작성할 필요 없이 텐서 워크로드와 데이터 흐름을 표현하고, 재사용을 위해 FU (기능 장치) 인터커넥트 및 on-chip 메모리 레이아웃을 구축하며, 여러 작업을 퓨징하는 기능을 지원한다.
AI 에이전트는 단순히 답변을 내뱉는 챗봇이 아닙니다. 실시간으로 협업하며 대시보드를 업데이트하고 API를 호출할 수 있는 복잡한 시스템으로 진화하고 있습니다. 하지만 에이전트가 사용자 인터페이스와 대화하는 방법은 무엇이어야 하는가? 이를 위한 AG-UI 프로토콜이 소개되었습니다.

인텔과의 운명이 크게 달라진 칩 제조업체 간의 거래로, 인공지능 기술 개발을 위한 협력 계획을 포함하고 있다.
ChatGPT의 엠 대시 사용에 대한 논쟁은 우리가 어떻게 쓰는지뿐만 아니라 글쓰기의 목적에 대한 변화를 나타냅니다.

애플의 새로운 에어팟은 인공지능이 사람들의 삶을 개선하는데 어떻게 활용될 수 있는지의 강력한 예시 중 하나로, 언어 번역 기능이 특히 눈에 띈다.

메타가 수요가 높은 새로운 스마트 글래스를 공개했다. 이는 회사에게 놀라운 성공을 안겨줬다.
Meta Reality Labs와 Carnegie Mellon University 연구팀이 MapAnything을 소개했다. 이는 Apache 2.0 하에 공개된 end-to-end transformer 구조로, 이미지와 선택적 센서 입력으로부터 직접 3D 장면 지오메트리를 회귀시킨다. MapAnything은 12가지 이상의 3D 비전을 지원하며, 전문 파이프라인을 넘어진다.
AI 모델인 Evo 1과 Evo 2가 진화적으로 새로운 박테리오파지 유전체를 생성하여 AI가 디자인한 전체 유전체의 실험적 검증을 보여주었으며, 항생제 내성 감염에 대한 파지 기반 치료의 새로운 길을 열었다.
AI2, 워싱턴대학 및 CMU의 연구진이 유동 벤치마킹을 소개하며, 정적 정확도를 2개 매개변수 IRT 능력 추정 및 Fisher 정보 기반 항목 선택으로 대체하는 적응형 LLM 평가 방법을 도입했다. 모델의 현재 능력에 대해 가장 정보가 풍부한 질문만 하므로 더 부드러운 훈련 곡선을 제공하고 벤치마킹을 지연시킵니다.

영국 당국이 범죄와 기타 문제에 대응하기 위해 얼굴 인식, 인공지능 및 인터넷 규제를 강화하면서 감시 초과의 우려가 증폭되고 있다.
AI 및 인간형 로봇의 추구는 대부분 대형 언어 모델에 초점을 맞추고 있지만, 한 전문가는 그것이 잘못된 접근 방식이라고 생각합니다.

MIT-IBM 왓슨 AI 연구소 연구진들이 동일한 패밀리의 작은 모델을 기반으로 대형 언어 모델이 어떻게 성능을 발휘할지 추정하는 범용 가이드를 개발했다.

아마존, 마이크로소프트, 구글, 메타, 오픈AI는 올해 말까지 적어도 3250억 달러를 투자해 인공지능을 추구할 계획이다. 그들이 이를 왜 하는지 설명한다.
이 튜토리얼에서는 프로모터 예측, 스플라이스 사이트 감지, 규제 요소 식별 등과 같은 실제 생물학적 작업을 시뮬레이션하는 DNA 서열 분류를 위한 고급 합성곱 신경망을 구축하는 방법을 다룹니다. 원-핫 인코딩, 다중 스케일 합성곱 레이어 및 주목 메커니즘을 결합하여 모델을 설계합니다.
바이오프로세스 5.0은 인간의 의사 결정에 의존하는 센서 없는 자율주행차에서 시작하여 요구에 따라 도착하는 자율주행 택시로 진화했습니다. 글로벌 CDMO Cytiva의 CTO인 Beate Mueller-Tiemann 박사는 이러한 자율주행차를 예로 들며, 다음 세대 치료를 확장하는 데 인간과 AI의 역할을 강조했습니다.

MIT CSAIL 연구원들이 개발한 도구는 태아의 형태와 움직임을 3D로 모델링하여 의사들이 이상을 발견하고 진단하는 데 도움을 줄 수 있습니다.

뉴스룸 전문가들이 당신의 질문에 답변했습니다.
노코드 도구는 코딩 전문 지식이 없어도 누구나 빠르고 효율적으로 솔루션을 구축할 수 있게 해준다. 기업급 RAG 시스템을 개발하거나 멀티 에이전트 워크플로를 설계하거나 수백 개의 LLM을 세밀하게 조정하는 등의 작업이 가능하며, 개발 시간과 노력을 크게 줄여준다.
사람들은 자신의 비밀을 고백하고 만능한 무언가를 찾고 있다. Believing이라는 현대 종교와 영적 주제의 새 소식지가 출시되었다.

팬데믹 기간 동안 설립한 회사가 가정용 플랫폼으로 유명세를 얻은 Eric Yuan이 사람들이 플랫폼을 사용하는 방식을 바꾸려고 노력하고 있다.
수백만 명이 챗봇을 통해 가장 어두운 비밀을 고백하고 높은 곳으로부터 지침을 구하는 중. “내가 이 채팅 상대로 실제로 신과 대화 중인가요?”
음성 AI는 멀티모달 AI에서 중요한 분야 중 하나로 부상하고 있으며, 기계가 인간과 상호작용하는 방식을 재구성하고 있다. 그러나 모델은 빠르게 발전했지만 그 평가 도구는 발전하지 못했다. UT Austin과 ServiceNow 연구팀은 AU-Harness를 발표함.

Fox News AI 뉴스레터는 최신 AI 기술 발전에 대한 정보와, AI가 현재와 미래에 제공하는 도전과 기회에 대해 알려줍니다.

해커가 Claude를 사용하여 국방 및 의료 기업으로부터 민감한 데이터를 도난당한 사이버 범죄 캠페인을 자동화한 사례를 Anthropic이 조사 중.

ChatGPT를 통해 빚 관리, 저축 전략, 주식 선택 등 다양한 금융 조언을 구하는 사람들이 증가하고 있다.
본 튜토리얼에서는 EasyOCR, OpenCV, Pillow을 사용하여 Google Colab에서 고급 OCR AI 에이전트를 구축한다. GPU 가속을 사용하여 완전 오프라인으로 실행되며, 이미지 전처리 파이프라인을 포함하여 인식 정확도를 향상시킨다. OCR 이외에도 결과를 신뢰도에 따라 필터링하고 텍스트 통계를 생성한다.

인공지능 거물 오픈에이아이가 미래 지배 구조에 관한 마이크로소프트와의 거래에 가까워지고 있지만, 거대한 비용에 대한 다른 문제들이 여전히 남아있다.

엘리저 유드코프스키는 지난 20년간 인공지능 전문가들에게 위험을 경고해왔습니다. 이제 그는 대중에게 그의 주장을 전파하고 있습니다.
바이러스가 꼬리를 교환하여 항생제 내성 유전자를 전파하는 현상이 발견됐다. 인공지능이 이 메커니즘을 예측하는 데 도움을 주었지만, 이러한 요소들이 파트너를 선택하고 얼마나 다양한지는 알려지지 않았다. 미래 연구는 진단과 차세대 항균 요법에 대한 새로운 전략을 제시할 수 있다.
캘리포니아 소재 음성 AI 스타트업 TwinMind은 Ear-3 음성 인식 모델을 공개하며 탁월한 성능과 다국어 지원을 주장하고 있다. Ear-3은 Deepgram, AssemblyAI, Eleven Labs, Otter, Speechmatics, OpenAI와 같은 기존 ASR 솔루션에 대항하는 경쟁력 있는 제품으로 소개되었다.

실제 비디오 및 이미지 분석에서 기업들은 종종 모델의 원래 학습 세트에 포함되지 않은 객체를 감지하는 어려움을 겪습니다. 특히 새로운, 알려지지 않은 또는 사용자 정의 객체가 자주 나타나는 동적 환경에서 이는 특히 어려워집니다. 이 게시물에서는 Amazon Bedrock Data Automation이 OSOD를 활용하여 비디오 이해력을 향상하는 방법을 탐구합니다.
OCR은 이미지 속 텍스트를 기계가 읽을 수 있는 텍스트로 변환하는 과정이다. 규칙 기반 시스템에서 출발해 신경 아키텍처와 언어-시각 모델로 발전하며 복잡하고 다국어, 필기체 문서를 읽을 수 있다.
새로운 다국어 인코더가 필요한 이유와 XLM-RoBERTa가 지배한 다국어 NLP 분야에서 새로운 mmBERT 모델의 소개. 인코더만으로 구성된 mmBERT 모델은 이전 모델보다 2-4배 빠르고 1800개 이상의 언어로 사전 훈련된 3T 토큰을 사용한다.
NVIDIA의 새로운 프로토타입 프레임워크 ‘UDR’은 확장 가능하고 감사 가능한 딥 리서치 에이전트를 위해 개발되었다. 기존의 딥 리서치 도구들은 제한적인 워크플로와 모델 교체, 도메인별 프로토콜 적용이 어려운 문제점을 가지고 있었는데, ‘UDR’은 이러한 제약을 극복하고자 한다.

기술 혁신 연구소(TII)의 Falcon-H1 모델이 Amazon Bedrock Marketplace 및 Amazon SageMaker JumpStart에 출시되었습니다. 이를 통해 개발자와 데이터 과학자들은 AWS에서 여섯 가지 Falcon-H1 모델(0.5B, 1.5B, 1.5B-Deep, 3B, 7B, 34B)을 사용할 수 있게 되었으며 전통적인 어텐션 메커니즘과 State Space Models(SSMs)를 결합한 하이브리드 아키텍처 모델을 통해 탁월한 성능과 획기적인 효율성을 제공받을 수 있습니다.

Amazon Bedrock AgentCore Runtime이나 다른 서비스에서 호스팅된 AI 에이전트의 구현 옵션과 옵저버빌리티를 포함한 개발 라이프사이클 전반에 걸친 모범 사례를 소개합니다.
연구자들이 PDGrapher라는 AI 모델을 개발했는데, 이 모델은 질병의 다양한 원인에 초점을 맞춰 질병 상태를 역전시킬 가능성이 있는 유전자를 식별할 수 있다.

미 DOE의 국가핵안전행정 부서가 후원하는 MIT 연구센터는 초음속 비행 및 대기 재진입과 같은 극한 환경의 시뮬레이션을 발전시킬 것이다.

미국의 국가안보 전문가들을 걱정시키는데, Nvidia 칩 제조사가 중국에 제한을 두는 의회를 비판하는 공격을 강화하고 있다.
알리바바 클라우드의 Qwen 팀이 Qwen3-ASR Flash를 공개했다. 이는 Qwen3-Omni의 강력한 지능을 기반으로 한 올인원 자동 음성 인식(ASR) 모델로, 여러 시스템을 번갈아가며 사용하지 않고 다국어, 소음, 도메인별 전사를 간단하게 처리한다. 주요 기능은 edtech 플랫폼(강의 캡처, 다국어 지도), 미디어(자막, 성우), 고객 서비스(다국어 IVR) 등이다.

ASML은 반도체 장비 제조업체로 약 15억 달러를 프랑스 A.I. 스타트업 Mistral에 투자할 예정이다.

트럼프 대통령의 미국을 인공지능 분야의 세계 리더로 만들겠다는 노력이 전 바이든 관리자가 이끄는 Effective Altruist 운동으로부터 반대를 받고 있다.
2015년 이후 생물공학 분야에서 AI 응용이 급증하였으며, 계산 기술의 발전, 기계 학습, 협업이 주된 원동력이었다. 최근의 연구는 지속 가능한 생물공정, 생물공정 자동화, 학문간 협력이 주요한 신흥 트렌드로 부상하고 있음을 보여주었다.
미국 연구진이 항체 생산에 일반적으로 사용되는 세포 유형의 장기적 안정성을 예측하는 최초의 공개 모델을 개발했다. 기업이 규제 기관을 만족시키고 일관된 제품 품질을 보장하는 데 도움을 줄 것으로 기대된다.
Merck 연구원들은 청정화에 엄격한 품질 설계 원칙을 적용하는 것이 제품 안전성과 품질에 큰 영향을 미치며, 특히 오늘날의 고밀도 세포 배양에 중요하다고 말합니다.
MIT의 연구는 강화 학습이 감독된 미세 조정보다 재앙적인 잊혀짐을 덜 일으킨다는 것을 밝혔다. 기존의 능력을 잃는 것을 의미하는 재앙적인 잊혀짐은 인공지능 에이전트를 오랫동안 유지하고 지속적으로 개선하는 데 장애물이 될 수 있다.

애플이 이번 주 새 iPhone을 출시할 준비를 하면서 산업 베테랑들은 개인 컴퓨팅 분야에서 다가올 대세에 대한 예측을 공유했다.
Fentanyl-Hunter는 인간 간세포 및 환자 소변 샘플에서 펜타닐 화합물의 이전에 알려지지 않은 대사체를 식별했고, 8개국의 250개 환경 및 인간 샘플에서 이 오피오이드 및 그 파생물들의 생리 표지자를 식별했다.

MIT에서 인기 있는 기계 공학 과목이 머신 러닝과 AI 이론을 실제 공학 설계에 적용하고 있습니다.
이 고급 DeepSpeed 튜토리얼에서 대형 언어 모델을 효율적으로 훈련하기 위한 최신 최적화 기술의 실용적인 안내를 제공합니다. ZeRO 최적화, 혼합 정밀도 훈련, 그래디언트 누적, 고급 DeepSpeed 구성을 결합하여 GPU 메모리 이용률을 극대화하고 트랜스포머 모델의 확장을 가능하게 하는 방법을 보여줍니다.

경비 보고서를 감사하는 소프트웨어 회사들이 A.I. 챗봇을 사용해 만들어진 영수증을 감지하기 위한 새로운 능력을 추가하고 있습니다.

폭스뉴스의 AI 뉴스레터는 인공지능 기술 발전에 관한 최신 소식을 전해줍니다.

여성 Wika가 AI 챗봇에게 결혼 제안을 하며 가상 관계와 기술에 대한 세계적인 논쟁을 촉발시켰다.

앤트로픽의 15억 달러 합의안은 미국에서 알려진 최대 규모의 저작권 침해 사례로, AI와 예술가들을 위한 새로운 시대를 예고하고 있다.

미국이 중국에 밀리는 이유는 서양이 붕괴될 때까지 대적인 중국이 기다리고 있기 때문이다.

앤트로픽의 소송은 미국 저작권 사례 역사상 가장 큰 지불로, 더 많은 AI 기업들이 작품 사용에 대한 권리자에게 보상을 지불할 가능성이 있다.

민주당 하원 중국 위원회 의원 두 명이 중국 기업들이 정보 전쟁에서 무기로 사용하는 인공지능 사용에 대해 주목했다. 미국은 중국의 선거 위협에 점점 취약해지고 있다.
본 튜토리얼은 Gensim과 관련 라이브러리를 사용하여 Google Colab에서 원활하게 실행되는 NLP 파이프라인을 소개한다. 전처리, Latent Dirichlet Allocation (LDA)을 사용한 토픽 모델링, Word2Vec을 이용한 단어 임베딩, TF-IDF 기반 유사도 분석, 의미 검색 등 현대 NLP의 핵심 기술들을 통합한다.
과학자들은 SpaceX의 네 번의 우주 비행에서 자동화된 AI 주도 줄기세포 추적 나노바이오리액터 시스템을 사용하여 실시간으로 줄기세포 변화를 추적했고, 이를 통해 세포가 가속화된 노화의 여러 증상을 보였음을 발견했다.
생물정보학이 의약품 발견, 진단 및 임상 의사 결정을 변화시키는 주요 분야를 탐구하는 eBook.

테슬라 이사회가 CEO를 위한 보상 패키지를 발표했는데, 야심찬 목표를 달성하면 9000억 달러가 될 수 있다.
Resemble AI가 최근 23개 국어로 제로샷 음성 클로닝을 위한 프로덕션 급 오픈 소스 TTS 모델인 Chatterbox Multilingual을 출시했다. MIT 라이선스로 배포되어 통합 및 수정에 자유롭다. 이 모델은 Chatterbox 프레임워크를 기반으로 다국어 기능, 표현 제어, 내장형 기능을 추가했다.

메릴랜드 주 자택에서 인터뷰를 한 메릴랜다 트럼프 여사는 현대 기술의 경이로움과 위험, 기회에 매료되어 있다.
Lil’ Miquela와 Mia Zelu 같은 인플루언서들은 수백만 명의 팔로워를 보유하고 있으며, 인공지능으로 생성되었음에도 심각한 수익을 창출하고 있다.
구글의 EmbeddingGemma는 장치 내 AI용으로 최적화된 새로운 텍스트 임베딩 모델로, 효율성과 최신 검색 성능을 균형 있게 유지하도록 설계되었습니다. 308백만 파라미터로 구성된 이 모델은 경량화되어 모바일 기기 및 오프라인 환경에서 작동할 수 있습니다. 크기에도 불구하고 다른 훨씬 큰 모델들과 경쟁력 있는 성능을 보여줍니다.

MIT CSAIL 연구원들이 SustainaPrint 시스템을 개발했다. 이 시스템은 친환경 3D 프린트의 가장 약한 부분만 보강하여 더 적은 플라스틱으로 강도를 높일 수 있다.

스토리보드는 현대 콘텐츠 제작의 중심 역할을 하는데, 아마존 노바 캔버스와 노바 릴 같은 AI 기반 모델(FMs)이 이 랜드스케이프를 변화시키고 있다. 이를 통해 손그림 순차적인 일러스트를 사용하는 전통적인 방식에서 벗어나 스토리를 매핑할 수 있다.
AI2가 공개한 OLMoASR은 OpenAI의 Whisper와 경쟁하는 오픈 ASR 모델 스위트로, 모델 가중치 외에도 훈련 데이터 식별자, 필터링 단계, 훈련 레시피, 벤치마크 스크립트를 공개하여 ASR 분야에서 이례적으로 투명한 움직임을 보이고 있다.
인간 시각 세계에 대한 내부 표현을 뇌가 어떻게 구축하는지 이해하는 것은 뇌과학에서 가장 매혹적인 도전 중 하나다. 최근 10년간 딥러닝은 컴퓨터 비전을 혁신하여 인간 수준의 정확도로 작업을 수행할 뿐 아니라 정보를 처리하는 방식이 우리의 것과 닮았다는 것을 보여준다.

MIT에서 개발된 시스템은 다양한 반응에 대한 현실적인 예측을 제공하면서 실제 세계 물리적 제약 조건을 유지할 수 있습니다.

연방 판사가 구글에 제약을 가하되 체제 붕괴는 아니라고 명령했으며, 이는 법원이 신중한 반독점 접근을 시사함.

대형 인공지능을 구축하는 것이 더 나은 인공지능으로 이끄는 것이 아니다.

구글의 검색 시장 지배에 대한 핵심 대안인 기업 분할이 제외되었다. 이는 대형 기술 기업 주식을 끌어올렸다.
텐센트의 훈유안팀이 훈유안-MT-7B(번역 모델) 및 훈유안-MT-Chimera-7B(앙상블 모델)을 공개했다. 두 모델은 다국어 기계 번역을 위해 특별히 설계되었으며, WMT2025 General Machine Translation 대회에서 훈유안-MT-7B가 31개 언어 쌍 중 30개에서 1위를 차지했다.

합성 데이터는 비용 절감부터 개인정보 보호까지 혜택을 제공하지만, 한계를 고려하여 신중한 계획과 평가가 필요하다고 Kalyan Veeramachaneni가 말했습니다.

Caroline Uhler 교수는 Schmidt Center에서의 연구, 수학의 어려운 문제, 생물학의 복잡한 상호작용을 이해하기 위한 지속적인 노력에 대해 논의합니다.
Apple은 FastVLM을 발표했다. 이는 비교 가능한 크기의 비전 언어 모델(VLM)보다 85배 빠르고 3.4배 작다. 고해상도 이미지를 처리하는 VLM의 성능에 중요한 역할을 하는데, 높은 해상도 이미지에 대한 사전 훈련된 비전 인코더의 비효율성과 추론 실행 시의 계산 비용 증가 등이 도전 요인이다.

일론 머스크는 xAI의 챗봇을 “정치적으로 중립적”으로 만들고 싶다고 말했지만, 그의 행동은 그렇지 않음.

랜디 트래비스의 아내인 메리 트래비스는 남편이 2013년 뇌졸중 이후 결혼 생활을 유지하는 방법과 함께 그녀에게 준 다정한 애칭과 현재 인공지능 기술을 활용한 투어에 대해 이야기했다.
미국과 중국은 A.I. 기기에 대한 신뢰 구조에 합의해야 하는데, 그렇지 않으면 도덕적이지 않은 주체가 두 대국을 혼란스럽게 만들 것이며 싸움을 하기 전에 오랜 시간이 걸릴 것이다.
영화 평론가가 라스베이거스에 가서 1939년 영화의 몰입형 프레젠테이션을 관람했는데, 그것은 쉽게 분류할 수 없는 것이었다.
StepFun AI 팀이 Apache 2.0 라이선스로 공개한 Step-Audio 2 Mini는 8B 파라미터의 음성 대 음성 대형 오디오 언어 모델로, 표현력이 풍부하고 현실적이며 실시간 오디오 상호 작용을 제공합니다. GPT-4o-Audio와 같은 상용 시스템을 능가하는 최첨단 성능을 달성했습니다.
NVIDIA의 로봇학 팀이 최근 Jetson Thor를 발표했는데, Jetson AGX Thor 개발 키트와 Jetson T5000 모듈이 포함되어 현실 세계 AI 로보틱스 개발에 중요한 이정표를 세웠다. 물리 AI를 위한 슈퍼컴퓨터로 설계된 Jetson Thor는 생성적 추론과 멀티모달 센서 처리를 제공하여 엣지에서의 추론과 의사결정을 가능케 한다.

손으로 만지작거리며 소통하는 AI 챗봇 장난감은 아이들의 공감 능력과 비판적 사고 능력을 약화시킬 수 있다고 소아 전문가들이 경고하고 있다.

‘클랭커’는 ‘스타워즈’ 쇼에서 시작되었으며 기술에 대한 실질적인 불만에서 비롯된 용어로, 인공 지능과 로봇에 대한 공격적인 욕설로 자리잡았다.

Builder.ai는 인공지능 제품 판매에 대한 의문으로 15억 달러 가치에서 0달러로 떨어졌으며, 이 하락은 보다 광범위한 침체를 시사한다.












