DiffusionGemma: 拡散言語モデルの仕組み

大規模言語モデル(LLM)をチャットボットや対話型エージェントとして、単発かつ低同時接続で動かす場面では、生成速度が伸びずにもどかしさを感じることがあります。この種のワークロードでは、モデルの重みや会話履歴のキャッシュを […]

YOLOv14: 魚眼・ゲーム画像・空撮・360°パノラマに強い物体検出器の設計

監視カメラや車載カメラの多くは魚眼レンズや広角レンズを採用しており、ドローンや360度カメラの映像を解析する場面も珍しくなくなっています。加えて、ゲーム実況やeスポーツ分析の現場では、実写ではなくゲームエンジンがレンダリ […]

Mental World Modeling: 心の状態をシミュレートするAI

AIエージェントが自律的に計画し行動する場面が増えるにつれ、次に世界がどう変化するかを予測する「世界モデル(World Model)」への関心が高まっています。しかし、従来の世界モデルは物体の位置や形状、動きといった物理 […]

RESOURCE2SKILL: チュートリアルからAIエージェントのスキルへ

LLMエージェントに求められる役割は、質問に答えることから、スライド作成やスプレッドシート編集、3Dシーンの構築、CAD設計、音楽制作まで、実際にソフトウェアを操作して成果物を仕上げることへと広がっています。こうしたタス […]

SkillSight:AIエージェントのスキル検索精度を劇的に向上させる

エージェントが利用できるスキル(ツールやAPI、手順書などのドキュメント)は、SRA-Benchで約26,000件、SkillBench-Suppでは約77,000件におよびます。これほど大規模になると、膨大な選択肢から […]

Phantom Guardrails: 存在しない問題を修正するAIエージェント

近年、LLMベースのエージェントにおいて、自らのプロンプトやガードレールを修正し自己改善を進める「自動ハーネス最適化 (Automated Harness Optimization)」の導入が進んでいます。しかし、「観察 […]

Harness Handbook: AIエージェント進化のための「振る舞い中心」のコード管理

現代のAIエージェントの能力は、基盤モデル単体の性能だけで決まるわけではありません。プロンプトの構築、状態の管理、そしてツールの呼び出しなどを統制する「ハーネス(Harness)」と呼ばれる実行基盤が重要な役割を担ってい […]

ResearchStudio-Reel: 論文からポスター、動画、ブログへ

研究論文の執筆後、ポスターや動画、ブログ記事を作成する作業に負担を感じたことはありませんか?このような研究発表の「ラストマイル」を自動化するシステムには、これまで3つの大きな課題がありました。 1つ目は成果物ごとに独立し […]

宇宙物理学×深層学習:基礎アーキテクチャからAIエージェントまでを概観する

現代の天文学は、Vera C. Rubin天文台やRoman宇宙望遠鏡などに代表される次世代の観測サーベイの稼働により、かつてない規模のデータ主導型科学へと急激に移行しています。こうした膨大なデータを前にして、従来の解析 […]