BanglaVeilGuard는 6가지 형태의 Bangla에 걸쳐 안전 격차를 테스트합니다.
새로운 문서에서는 표준, 로마자 표기, 코드 혼합, 노이즈 및 방언 형식에서 방글라 언어 모델을 테스트하도록 설계된 벤치마크이자 경량 프롬프트 가드인 BanglaVeilGuard를 소개합니다. 저자는 평가에서 공격 성공률이 급격히 낮다고 보고했지만 경비원이 일부 양성을 과도하게 거부한다는 사실도 발견했습니다.
매일 업데이트됨1797 검증된 이야기들
비영리 교육팀이 명료한 영어로 설명한 제품 출시, 정책 변화, 안전 연구, 산업 움직임에 대한 출처 검증된 AI 보도를 제공합니다.
모든 기사는 가장 강력한 증거와 연결됩니다: 원가 자료가 있을 경우 그렇고, 그 외에는 명확히 출처가 명확히 기재된 보도입니다.
무슨 일이 일어났는지, 왜 중요한지, 무엇을 보아야 하는지 등을 전문 용어 없이 설명합니다.
신호가 얇을 때는 피드를 채우기보다는 아무것도 발행하지 않습니다.
과대광고를 쫓지 않고 AI를 이해해야 하는 사람들을 위한 최신 소스 확인 AI 스토리입니다.
새로운 문서에서는 표준, 로마자 표기, 코드 혼합, 노이즈 및 방언 형식에서 방글라 언어 모델을 테스트하도록 설계된 벤치마크이자 경량 프롬프트 가드인 BanglaVeilGuard를 소개합니다. 저자는 평가에서 공격 성공률이 급격히 낮다고 보고했지만 경비원이 일부 양성을 과도하게 거부한다는 사실도 발견했습니다.
Cloudflare 경영진은 조선비즈에 자사 네트워크의 AI 에이전트 트래픽이 전년 대비 1,700% 이상 증가했다고 전하며 기업들에게 액세스 제어를 강화하고 MCP 연결을 관리하며 포스트 양자 암호화에 대비할 것을 촉구했습니다. 트래픽 수치, 방법론 및 보안 테스트 결과는 독립적이지 않았습니다…
Technology.org는 영국과 우크라이나가 국방-AI 파트너십을 체결하여 영국 연구원들이 우크라이나의 Avengers AI Labs 및 전장 데이터 플랫폼에 액세스할 수 있도록 했다고 보고했습니다. 보고서에 따르면 첫 번째 프로젝트는 군사 시설 감지 및 드론용 저전력 칩에 초점을 맞출 것이라고 합니다.
조선비즈는 한국이 주요 공공 서비스를 AI와 통합하고 다국어 재난 정보를 제공하며 부처별 시스템을 구축하고 모든 공무원을 대상으로 AI 교육을 의무화할 계획이라고 보도했습니다.
새로운 arXiv 벤치마크는 다양한 지침, 분자 표현 및 8가지 작업 범주에 걸쳐 화학 중심의 대규모 언어 모델을 평가하여 상당한 즉각적인 민감도, 표현 의존성 및 고르지 못한 성능을 보고합니다.
American Bazaar는 Kita가 대출 기관을 위한 AI 기반 신용 평가를 확대하기 위해 BoxGroup과 Y Combinator가 주도하는 450만 달러의 시드 라운드를 모금했다고 보고했습니다. 회사는 자사의 기술이 여러 시장에서 사용되고 있으며 1억 3천만 달러 이상의 대출 금액을 처리했다고 밝혔지만 이러한 운영상의 청구는…
사전 인쇄에서는 언어 모델 파이프라인이 저하된 입력을 처리할 때 중간 증거를 계속 사용할 수 있는지 테스트하기 위한 척도인 증거 상태 신뢰성을 소개합니다. GLM-5.2를 사용한 통제된 평가에서는 단계 성공이 감소하는 동안 파서 유효 출력이 지속되었습니다.
새로운 arXiv 연구에서는 11개 안전 데이터 세트에서 53개 언어 모델을 평가하고 모델 강도가 피해 범주에 따라 크게 달라지는 반면 대화 안전은 아직 해결되지 않은 것으로 보고했습니다.
사우스 차이나 모닝 포스트(South China Morning Post)는 샤오미가 수익 감소와 부품 비용 상승에도 불구하고 스마트폰 AI, 대형 언어 모델 가속 및 자율 주행을 위한 새로운 Xring 칩을 공개했다고 보도했습니다.
ToSCA는 전략적 선택과 토큰 수준 응답 생성을 분리하는 계층적 강화 학습 프레임워크를 제안합니다. 저자는 일상 및 정서적 지원 대화의 여러 기준에 비해 향상된 전략 선택 및 응답 품질을 보고합니다.
Fortune은 Ramp의 결제 프로세서 데이터를 인용하여 Claude Fable 5가 출시 후 2개월 동안 Anthropic 모델에 대한 기업 지출의 11%를 차지했다고 보고했지만 그 점유율은 이후 정체되었습니다. 보고서에 따르면 이 패턴은 첨단 AI 기업이 가격에 대해 더욱 공격적으로 경쟁하도록 압력을 가할 수 있지만 Ramp는…
arXiv 연구에서는 언어 모델 시스템이 이전에 생성한 문서를 검색할 때 실패 패턴을 입력할 수 있다고 보고합니다. 저자의 시뮬레이션에서는 1,528번의 실행 중 79.6%가 논문에서 "RAG 붕괴"라고 부르는 것으로 끝났습니다.
매주 한 번씩 유용한 브리핑을 듣습니다
이번 주의 검증된 AI 뉴스, 원본 데이터, 유용한 도구, 학습 추천, 그리고 새로운 AI 일자리를 받아보세요.
AI 전문가를 고용하거나 유용한 AI 제품을 출시하는 것? 배우고 행동하기 위해 이곳에 온 사람들 앞에 그것을 보여주세요.
AI 공고를 올리세요 AI 도구를 제출하세요