<?xml version="1.0" encoding="UTF-8"?>
<rss version="2.0" xmlns:atom="http://www.w3.org/2005/Atom">
  <channel>
    <title>The Minutes of Dylan Patel on training data</title>
    <link>https://minutesof.com/dylan-patel/on/training-data/</link>
    <description>Everything Dylan Patel has said on training data: 2 verbatim quotes between February 2025 and September 2025, each with a timestamp and a link to the…</description>
    <language>en</language>
    <lastBuildDate>Sun, 30 Aug 2026 16:22:24 +0000</lastBuildDate>
    <atom:link href="https://minutesof.com/dylan-patel/on/training-data/feed.xml" rel="self" type="application/rss+xml" />
    <item>
      <title>Patel notes YouTube holds unique video data that gives Google training advantage despite scraping restrictions</title>
      <link>https://minutesof.com/q/dd59c5bc-0967-4aab-8e50-e1bfb22888a9/</link>
      <guid isPermaLink="true">https://minutesof.com/q/dd59c5bc-0967-4aab-8e50-e1bfb22888a9/</guid>
      <description>“I don&#x27;t know what ungodly percentage of video is only on available on YouTube. And sure, you can scrape YouTube, blah blah blah.” — David Ondrej</description>
      <pubDate>Thu, 18 Sep 2025 16:14:25 +0000</pubDate>
      <category>training data</category>
    </item>
    <item>
      <title>Patel asserts data quality is the primary determinant of model quality, not just compute or architecture.</title>
      <link>https://minutesof.com/q/b3b4b1a2-1ca3-4201-b3c0-cf7ef1ef9a7d/</link>
      <guid isPermaLink="true">https://minutesof.com/q/b3b4b1a2-1ca3-4201-b3c0-cf7ef1ef9a7d/</guid>
      <description>“the data processing, data filtering, data quality is the number one determinant of the model quality, and then a lot of the training code is the determinant on how long it takes to train and how fast your experimentation is.” — Lex Fridman</description>
      <pubDate>Mon, 03 Feb 2025 00:12:13 +0000</pubDate>
      <category>training data</category>
    </item>
  </channel>
</rss>
