
11 - 50 Mitarbeiter
Gegründet 2022
🤖 Künstliche Intelligenz
☁️ SaaS
Artificial Intelligence • Research • SaaS
METR ist eine Forschungsorganisation, die sich auf die Bewertung und das Verständnis der Fähigkeiten und Risiken von fortschrittlichen KI-Systemen konzentriert. Sie entwickeln und führen Tests durch, um die Leistung von KI, insbesondere in autonomen Fähigkeiten und in der KI-Forschung und -Entwicklung, zu messen. Durch die Zusammenarbeit mit führenden KI-Unternehmen wie Anthropic und OpenAI zielt METR darauf ab, unabhängige Bewertungen zu verbessern, um die aufkommenden Risiken fortschrittlicher KI-Technologien umfassend zu managen.
🔥 vor wenigen Sekunden
🗣️🇺🇸🇬🇧 Englisch erforderlich
Verbessern Sie Ihre Chancen auf ein Vorstellungsgespräch, indem Sie Ihre Lebenslauf-Bewertung vor der Bewerbung überprüfen.

11 - 50 Mitarbeiter
Gegründet 2022
🤖 Künstliche Intelligenz
☁️ SaaS
Artificial Intelligence • Research • SaaS
METR ist eine Forschungsorganisation, die sich auf die Bewertung und das Verständnis der Fähigkeiten und Risiken von fortschrittlichen KI-Systemen konzentriert. Sie entwickeln und führen Tests durch, um die Leistung von KI, insbesondere in autonomen Fähigkeiten und in der KI-Forschung und -Entwicklung, zu messen. Durch die Zusammenarbeit mit führenden KI-Unternehmen wie Anthropic und OpenAI zielt METR darauf ab, unabhängige Bewertungen zu verbessern, um die aufkommenden Risiken fortschrittlicher KI-Technologien umfassend zu managen.
• Entwickeln schwieriger, neuartiger Aufgaben für KI-Modelle, die auch bei zunehmendem Zeithorizont der Modelle anspruchsvoll bleiben • Durchführung von Qualitätssicherung für bestehende Aufgaben, Überprüfung der Lösbarkeit und Sicherstellung, dass Modelle nur die notwendigen Informationen erhalten • Erstellung von Baseline-Aufgaben in Fachbereichen, wenn dies hilfreich ist • Bewertung von Aufgabenabschlüssen durch KI-Systeme oder menschliche Baselines • Verbesserung der Infrastruktur und der Workflows für die Aufgabenentwicklung • Mitarbeit an Evaluierungen führender KI-Systeme zur Unterstützung der METR‑Time‑Horizons-Methodik
• Mehrjährige Erfahrung in der Arbeit an komplexen Software-Engineering-Projekten und Codebasen • Erfahrung im Aufbau anspruchsvoller, idealerweise agentenbasierter KI-Evaluationen • Erfahrung mit Evaluierungen wie RE-Bench, HCAST, SWE-bench Verified, Cybench oder GPQA • Idealerweise Erfahrung mit dem Inspect-Framework • Hohe Detailgenauigkeit, einschließlich des Erkennens von Fehlspezifikationen und Mehrdeutigkeiten • Vertrautheit mit der METR-Infrastruktur, einschließlich Hawk, ist von Vorteil • Vertrautheit mit der Methodik hinter METRs Time‑Horizons-Arbeit ist von Vorteil • Verfügbarkeit von 20–40 Stunden pro Woche • Mindestens 1 Stunde Überschneidung mit dem Arbeitstag in der Pacific Coast Time (Pazifische Küstenzeit)
• Flexible Arbeitszeitgestaltung nach eigener Vereinbarung • Remote-Arbeit weltweit • Flexible Arbeitszeit von 20–40 Stunden pro Woche • Personen, die mehr als 80 Stunden beitragen, werden in der finalen Forschungsarbeit anerkannt (auf Wunsch)
Jetzt Bewerben🕒 vor 1 Monat
Vor‑Ort‑Ingenieur bei Vozy, der KI‑Sprachagenten bereitstellt und für Kundenvorfälle optimiert. Zusammenarbeit mit Kunden und Verwaltung von KI‑Integrationen in einem dynamischen Umfeld.
🌏 Überall auf der Welt
💰 €1.000.000 Debt Financing im 2022-10
⏳ Vertrag
🟡 Mittelstufe
🟠 Senior
👷🏻♀️ Ingenieur
🗣️🇪🇸 Spanisch erforderlich
🕒 vor 8 Monaten
Besatzungsmitglied für Columbia Shipmanagements im Offshore-Bereich expandierende Flotte als 2. Ingenieur auf Kabelverlegeschiffen. Arbeiten Sie mit multikulturellen Teams zusammen und halten Sie Sicherheitsstandards ein.
🗣️🇺🇸🇬🇧 Englisch erforderlich