课题基金 / 基金详情

Methoden des Reinforcement Lernens in realen, verteilten, kooperierenden Systemen

Methoden des Reinforcement Lernens in realen, verteilten, kooperierenden Systemen
真实分布式协作系统中的强化学习方法
批准号:
5318734
负责人:
Professor Dr. Martin Riedmiller
金额:
$0.0万
依托单位:
依托单位国家:
德国
项目类别:
Priority Programmes
财政年份:
2001
资助国家:
德国
项目状态:
已结题
起止时间:
2000-12-31 至 2007-12-31

项目摘要

项目成果

Professor Dr. Martin Riedmiller的其他基金

相似基金

相关文献

中文摘要
翻译
[3]机器人系统研究与发展。Der Antrag weist dabei zwei Schwerpunkte auf: 1。die Entwicklung von schnellen Lernalgorithmen f<e:1> r die Individualfähigkeiten eines realen Roboters。他们存在于士兵理论中;allerdings benötigen die heutgen algorithm eine um mehrere Größenordnung zu hoh Anzahl and Trainingserfahrungen。Nach heutiger Einschätzung kann dieser aufand nur - durchine组合verschiener方法(仿真,具体相关的erfaiener,活动的leren) aufin praktisch vertretares masß reduziert werden。Der 2。协同多智能体系统中的机器人团队研究。它们的存在是基于lernalgorithm的zur Zeit和punktuwell理论基础。[1] [1] [1] [1] [1] [1] [1] [1] [1] [1] [1] [1] [1] [1]基于混沌混沌的混沌混沌群的混沌混沌算法。“卡尔斯鲁厄头脑风暴者”(Karlsruhe brainstorers)团队(dem amtierenden Vizeweltmeister)团队(durchgefhrt werden)。
英文摘要
Inhalt des Antrags ist die Konzeption und Weiterentwicklung von Reinforcement Lernverfahren zur Steuerung von realen, verteilten Robotersystemen. Der Antrag weist dabei zwei Schwerpunkte auf: 1. die Entwicklung von schnellen Lernalgorithmen für die Individualfähigkeiten eines realen Roboters. Hier existiert ein solider theoretischer Unterbau; allerdings benötigen die heutigen Algorithmen eine um mehrere Größenordnung zu hohe Anzahl an Trainingserfahrungen. Nach heutiger Einschätzung kann dieser Aufwand nur durch eine Kombination verschiedener Methoden (Simulation, Speicherung relevanter Erfahrungen, aktives Lernen) auf ein praktisch vertretbares Maß reduziert werden. Der 2. Schwerpunkt des Antrags liegt in der Konzeption von Lernverfahren zur verteilten Steuerung eines Teams von Robotern in kooperativen Multi-Agenten-Systemen. Hier existieren zur Zeit nur punktuell theoretisch fundierte Lernalgorithmen. Im Zusammenhang mit der Gesamtausrichtung des Schwerpunkts fehlen insbesondere Lernalgorithmen für verteilte, unabhängige, kooperierende Lerner in stochastischer Umgebung. Basierend auf Vorarbeiten unserer Gruppe sollen solche Algorithmen erarbeitet werden. Die Validierung der entwickelten Konzepte soll zum einen durch das Erlernen zentraler Fähigkeiten eines realen Roboters zum anderen durch die Umsetzung in unserem Simulationsklasseteam "Karlsruhe Brainstormers" (dem amtierenden Vizeweltmeister) durchgeführt werden.
期刊论文(0)
专著(0)
科研奖励(0)
会议论文
Mobile Manipulation in natürlichen Umgebungen - "TidyUpRobot"
  • 批准号:
    188951940
  • 项目类别:
    Research Grants
  • 资助金额:
    $0.0万
  • 财政年份:
    2011
  • 负责人:
    Professor Dr. Martin Riedmiller
  • 依托单位:
Design einer Standardplattform (Hard- und Software) für die RoboCup Middle-Size Liga im Rahmen eines Open-Source Projektes
  • 批准号:
    68707621
  • 项目类别:
    Research Grants (Transfer Project)
  • 资助金额:
    $0.0万
  • 财政年份:
    2008
  • 负责人:
    Professor Dr. Martin Riedmiller
  • 依托单位:
Lernalgorithmen für kooperative Multi-Agenten Systeme
  • 批准号:
    5446214
  • 项目类别:
    Research Grants
  • 资助金额:
    $0.0万
  • 财政年份:
    2005
  • 负责人:
    Professor Dr. Martin Riedmiller
  • 依托单位:
国内基金
海外基金
基于碱性DES辅助杜仲胶提取过程中杜仲胶解离机制的研究
  • 批准号:
    2026JJ80731
  • 项目类别:
    省市级项目
  • 资助金额:
    --
  • 批准年份:
    2026
  • 负责人:
    龚卫华
  • 依托单位:
石榴皮DES提取物智能响应微胶囊的构建、保鲜功效与食品安全性评价研究
  • 批准号:
    2026JJ80861
  • 项目类别:
    省市级项目
  • 资助金额:
    --
  • 批准年份:
    2026
  • 负责人:
    李雅丽
  • 依托单位:
DES真空蚀刻装置的升级改造及制造工艺优化
  • 批准号:
  • 项目类别:
    省市级项目
  • 资助金额:
    --
  • 批准年份:
    2026
  • 负责人:
    李微
  • 依托单位:
DES影响下RXFP2 参与小鼠睾丸引带细胞增殖迁移的信号通路研究
  • 批准号:
    2025JJ80600
  • 项目类别:
    省市级项目
  • 资助金额:
    --
  • 批准年份:
    2025
  • 负责人:
    唐水平
  • 依托单位: