ニュース・知財情報

知的財産をめぐる動向と、
実務の視点。

知的財産実務、AI技術、海外での権利保護、IPLEXの最新情報を、日本語でご覧いただけます。

336 記事・最新情報

62 件

AI・ソフトウェア

TROLL論文解説:PPOクリッピングを超え、トークン単位の信頼領域でLLM強化学習を安定化

大規模言語モデルの推論能力を強化するために、報酬ベースの強化学習を適用するケースが急速に増加しています。 現時点ではよく表示される方法は、PPO型方策の最適化です。 GRPO、Dr.GRPO、GSPO、およびREINFORCE++などのアドバンテージ推定や正規化方法を改善する方法でも、一度に方策をあまり変更しないでください。

記事を読む
AI・ソフトウェア

論文解説:「Agentic Reasoning for Large Language Models」

最近は人工知能の分野において最もよく聞かれた用語の1つがAIエージェントです。 しかし、エージェントが何であるかを説明しようとすると、スコープは非常に広いです。 一部の人々は、エージェントの検索機能でチャットボットを呼び出しますが、他の人は、計画を立て、エージェントとして様々なツールを実行するためのシステムだけを参照してください。 そして最近、私は思い出しました...

記事を読む
AI・ソフトウェア

対話が長くなるとLLMはなぜ文脈を見失うのか

ChatGPTのような会話AIを使うと不思議な瞬間があります。 当初はかなり正確に続くモデルは、条件が1つずつ加えられるように間違った方向に行きます。 時々、あなたはあなたが正しいことについて再び間違いを犯し、あなたが最初で行った仮定に保たれているとき。 会話記録が残っているにもかかわらず、重要な条件を逃したような感じです...

記事を読む
AI・ソフトウェア

AgentGym-RL論文解説:複数ターンの強化学習による長期タスク対応AIエージェントの学習

問題の性質は、AIエージェントが「正しい回答を試す」ではなく、「あなたが望む情報を見つけるためにウェブサイトをナビゲートするために、必要なボタンを押して、それが失敗した場合、パスを修正する」とは完全に異なります。 これは、単一の応答で終わらないが、むしろ複数の行動、観察、および判断を含むためです。 このプロセス中に、エージェントは間違ったボタンを押します...

記事を読む

技術と知的財産の次の一歩を、IPLEXと。