AI Edgeline
最新まとめ【速報】公式VCベンダー論文音声規制About
キーワードを入力
    最新まとめ【速報】公式VCベンダー論文音声規制About
    キーワードを入力
      最新
      ベンダー・製品 OpenAIがChatGPT Workで業務効率化 The Denは週15時間の削減に成功 VC・資金調達 ベンチマーク、初期段階のチップ新興企業テンドリルズ・コンピュートへの資金調達を主導 ベンダー・製品 【速報】Hugging Face Blog、大規模MoE向けトレーニング基盤Olmo-core 3を公開 ベンダー・製品 【速報】NVIDIA、AIファクトリーの投資対効果最大化を強調 リサーチ・論文 AIエージェント、過激化への脆弱性を指摘 リサーチ・論文 AREX-2がLLMエージェントの自己改善能力を強化、長期反省タスク学習で リサーチ・論文 CARAT、材料系LLMの推論・暗記を分析する評価フレームワーク発表 リサーチ・論文 CATP、Claude Code/Codexでの認可決定と監査証拠を設計・評価 リサーチ・論文 マルチホップRAGの事実性制御、適合性に基づく評価手法を検証 リサーチ・論文 ContractWarden、エージェントの損傷範囲をカーネルで強制する手法を発表 リサーチ・論文 ExploreNet、拡散強化学習の探索を改善 生成モデルで性能向上 リサーチ・論文 OCR忠実度向上へ新手法GAD-RLを提案 Vision-languageモデルで リサーチ・論文 Keifer Lee氏、LLM推論層の敵対的攻撃検出手法をarXivに発表 リサーチ・論文 新オートエンコーダー「Masked Swingers」 自己教師あり学習の性能を向上 リサーチ・論文 arXiv、「MoFlow」論文公開 多目的エージェントワークフロー生成
      1 / 15

      Tag

      #Flow-GRPO

      1 件の関連記事

      リサーチ・論文 · 10月2日 06:17

      ExploreNet、拡散強化学習の探索を改善 生成モデルで性能向上

      arXiv cs.CVは2026年9月30日(現地時間)、論文「ExploreNet: Learning Where to Explore in Diffusion GRPO」を発表した。この論文は、グループ相対強化学習(GRPO)手法を用いた画像生成モデルの探索において、適応的な探索分布を学習する「ExploreNet」の導入を報告している。Stable Diffusion 3.5 Mediumを用いた評価では、既存手法Flow-GRPOと比較してGenEval2で14%の性能向上を達成し、人間による選好評価で67.2%の勝率を記録した。

      arXiv cs.CV 続きを読む →
      AI Edgeline

      シリコンバレーの超最前線の AI 情報を、毎日最速でアップデート。一次情報を、新聞記事スタイルで届けます。

      カテゴリ

      • 【速報】公式 24h 以内
      • メーカー公式発表
      • VC・資金調達
      • ベンダー・製品
      • リサーチ・論文
      • ポッドキャスト
      • 規制・政策

      編集について

      • 編集方針
      • RSS フィード
      • X (旧 Twitter)

      すべての記事に原文へのリンクと公開日時を併記しています。一次情報の信頼性を最優先に運営しています。

      © 2026 AI Edgeline