ハルシネーション

【2026年最新】速く・型付きで判断するAI「Jev」×論文8選|「LLMの判断は遅いし、自信の数字も当てにならない」を解く AIニュース

【2026年最新】速く・型付きで判断するAI「Jev」×論文8選|「LLMの判断は遅いし、自信の数字も当てにならない」を解く

問い合わせの振り分け、書類からの項目の抜き出し、不審なアクセスかどうかの判定。こうした「選択肢の中から1つを選ぶ」判断をLLMに任せたいと考えたとき、つまずきがちなのが速さと扱いやすさです。LLMは文章を1語ずつ書き出すので、返事が来るまで...
【2026年最新】医療・臨床現場のオンデバイスAI×論文4選|「患者データを院外に出せない」を解く AIニュース

【2026年最新】医療・臨床現場のオンデバイスAI×論文4選|「患者データを院外に出せない」を解く

診察中の会話の記録、カンファレンスの議事録、カルテの略語の読み解き。医療現場にも、生成AIに任せたい作業はたくさんあります。一方で、患者の診療情報は最も機微な個人情報の一つです。外部のクラウドへ送ること自体を院内の規程で認めていない、という...
【週刊論文ウォッチ 9/21〜9/27】コーディングエージェントの続報と、今週の新語「音響グラウンディング」 AIエージェント

【週刊論文ウォッチ 9/21〜9/27】コーディングエージェントの続報と、今週の新語「音響グラウンディング」

毎週、arXiv の cs.SE(ソフトウェア工学)・cs.CR(セキュリティ)・cs.CL(自然言語処理)に投稿された論文をすべて読み、2 つの観点で拾います。1 つは、月次の「急上昇ワード」で取り上げたテーマのその後。もう 1 つは、こ...
【2026年最新】ハルシネーションの検出と抑制×論文4選|「分からないのに自信満々で答える」を解く AIニュース

【2026年最新】ハルシネーションの検出と抑制×論文4選|「分からないのに自信満々で答える」を解く

LLMが、もっともらしいけれど誤った内容を生成してしまう「ハルシネーション」。社内文書などの根拠を検索して渡すRAGは有力な対策ですが、根拠となる資料が存在しない質問や、資料に答えが書かれていない場面では、AIが推測で答えてしまう問題が残り...
【2026年最新】RAG(検索拡張生成)の実務×論文4選|「検索が外れる」「もっともらしい嘘」「評価できない」を解く AIニュース

【2026年最新】RAG(検索拡張生成)の実務×論文4選|「検索が外れる」「もっともらしい嘘」「評価できない」を解く

社内文書やマニュアルをAIに読ませて答えさせる「RAG(Retrieval-Augmented Generation:検索拡張生成)」は、企業のAI活用で広く使われる構成の一つです。RAGとは、質問に関係する文書をまず検索し、その内容を根拠...
AIへの「丸投げ」はもう終わり?最新論文4選で読み解く「AIエージェント実用化」の最前線 AIニュース

AIへの「丸投げ」はもう終わり?最新論文4選で読み解く「AIエージェント実用化」の最前線

「AIが自分で実験して、論文まで書いてくれたら最高なのに…」そんなSF映画のような話が、実はもう現実になり始めています!2024年に話題になった「The AI Scientist」をはじめ、AIが自律的に研究を進める「AutoResearc...