Artwork

Inhalt bereitgestellt von Michael Berk. Alle Podcast-Inhalte, einschließlich Episoden, Grafiken und Podcast-Beschreibungen, werden direkt von Michael Berk oder seinem Podcast-Plattformpartner hochgeladen und bereitgestellt. Wenn Sie glauben, dass jemand Ihr urheberrechtlich geschütztes Werk ohne Ihre Erlaubnis nutzt, können Sie dem hier beschriebenen Verfahren folgen https://de.player.fm/legal.
Player FM - Podcast-App
Gehen Sie mit der App Player FM offline!

Beyond Benchmarks: How GPT-5 and OSS Are Redefining AI Evaluation (E.16)

31:13
 
Teilen
 

Manage episode 500266350 series 3646654
Inhalt bereitgestellt von Michael Berk. Alle Podcast-Inhalte, einschließlich Episoden, Grafiken und Podcast-Beschreibungen, werden direkt von Michael Berk oder seinem Podcast-Plattformpartner hochgeladen und bereitgestellt. Wenn Sie glauben, dass jemand Ihr urheberrechtlich geschütztes Werk ohne Ihre Erlaubnis nutzt, können Sie dem hier beschriebenen Verfahren folgen https://de.player.fm/legal.

In this episode of Free Form AI, Michael and Ben unpack the GPT-5 release, with a focus on what really matters: fewer hallucinations, smarter reasoning and why traditional benchmarks may no longer cut it.

Tune in as we explore open-source OSS, agentic systems and the growing challenge of evaluating models that might already be outsmarting us.

  continue reading

22 Episoden

Artwork
iconTeilen
 
Manage episode 500266350 series 3646654
Inhalt bereitgestellt von Michael Berk. Alle Podcast-Inhalte, einschließlich Episoden, Grafiken und Podcast-Beschreibungen, werden direkt von Michael Berk oder seinem Podcast-Plattformpartner hochgeladen und bereitgestellt. Wenn Sie glauben, dass jemand Ihr urheberrechtlich geschütztes Werk ohne Ihre Erlaubnis nutzt, können Sie dem hier beschriebenen Verfahren folgen https://de.player.fm/legal.

In this episode of Free Form AI, Michael and Ben unpack the GPT-5 release, with a focus on what really matters: fewer hallucinations, smarter reasoning and why traditional benchmarks may no longer cut it.

Tune in as we explore open-source OSS, agentic systems and the growing challenge of evaluating models that might already be outsmarting us.

  continue reading

22 Episoden

All episodes

×
 
Loading …

Willkommen auf Player FM!

Player FM scannt gerade das Web nach Podcasts mit hoher Qualität, die du genießen kannst. Es ist die beste Podcast-App und funktioniert auf Android, iPhone und im Web. Melde dich an, um Abos geräteübergreifend zu synchronisieren.

 

Kurzanleitung

Hören Sie sich diese Show an, während Sie die Gegend erkunden
Abspielen