דפי אינטרנט רגילים מכילים קוד תצוגה, רכיבי תפריט, קישורים צדדיים ופרסומות שתופסים נפח עצום ומזהמים את הקלט של מודלי שפה. כשאתם מנסים להזין דף אינטרנט שלם לתוך סוכן בינה מלאכותית, המידע העודף הזה מבזבז טוקנים ופוגע בדיוק התשובות. הוא פותר את הבעיה הזו בכך שהוא מרנדר את האתר בעצמו, ממתין לטעינת כל הרכיבים הדינמיים, ומחזיר טקסט נקי בפורמט Markdown או קובץ JSON מובנה. על פי הנתונים שלהם, החילוץ הממוקד חוסך 93% מכמות הטוקנים ביחס לקריאת הקוד המקורי של העמוד.
הוא יושב בתשתית הפיתוח שלכם ומציע ספריות רשמיות לשפות Python ו-Node.js, לצד הפעלה משורת הפקודה או חיבור ישיר לסוכנים דרך פרוטוקול MCP. בנוסף לשאיבת עמוד בודד, תמצאו בו מנוע חיפוש פנימי שמחזיר ישירות את התוכן המלא של תוצאות החיפוש, מיפוי קישורים מלא של שמות דומיין, וסריקה רוחבית מתוזמנת. הוא תומך גם בפעולות אינטראקטיביות מתקדמות, שמאפשרות לדפדפן האוטומטי להקליד טקסט בתיבות חיפוש, ללחוץ על כפתורים כדי לחשוף מידע מוסתר, לגלול בעמוד ולחלץ טקסט מתוך קובצי מסמכים כמו PDF ו-docx.
כמה זה עולה ואיפה המלכוד
מסלול החינם מספק 1,000 קרדיטים לחודש ללא צורך בהזנת כרטיס אשראי, אך הוא מוגבל לעשר בקשות בדקה ולשני דפדפנים מקבילים בלבד. לדעתי, זה שווה את זה רק לבדיקות מקומיות קצרות, כי בפרויקט חי המכסה תיגמר תוך דקות ספורות. דף בסיסי צורך קרדיט בודד, חיפוש גובה 2 קרדיטים לכל עשר תוצאות, וחילוץ בפורמט JSON גוזל תוספת של 4 קרדיטים לכל עמוד שנשאר. מנוע הבדיקות הרציף Monitor דורש 7 קרדיטים לכל בדיקה. אם העמוד יחזיר שגיאת 404 או 403, תשלמו קרדיט מלא על הניסיון.
הם גובים כסף על שגיאות.
המסלולים בתשלום מתחילים מתוכנית Hobby שמחירה 19 דולר לחודש, או 16 דולר לחודש בתשלום שנתי, ומעניקה 5,000 קרדיטים. לרוב הצוותים שמחזיקים שירות פעיל, המסלול המעשי הוא Standard, שעולה 83 דולר לחודש בתשלום שנתי וכולל 100,000 קרדיטים יחד עם 25 דפדפנים מקבילים וקצב של 500 בקשות בדקה. משם המחיר מטפס ל-333 דולר לחודש במסלול Growth, ומגיע עד 599 דולר לחודש בתוכנית Scale שמציעה מיליון קרדיטים. רכישת תוספת קרדיטים אפשרית בחבילות של 5 דולר, אך צבירת יתרות מחודש לחודש קיימת רק במסלול Scale ומעלה.
יכולות מרכזיות
- חילוץ תוכן ל-Markdown ול-JSON
- סריקה ומיפוי של אתרים
- חיפוש ברשת עם תוכן מלא
- הפעלת לחיצות הקלדה וגלילה
- חילוץ מידע מקובצי מסמכים
התאמה מעשית ובריחה מנעילה
הוא מיועד במפורש לחברות תוכנה ולמפתחים שבונים סוכנים עצמאיים או מערכות איסוף מידע, ולא רוצים להתעסק עם תחזוקת דפדפני Puppeteer שקרסו, מעקפי חסימות או ניהול שרתי פרוקסי. לא הייתי משתמש בזה לפרילנסר שרק צריך לגרד נתונים פעם בחודש, וזה בהחלט לא מתאים לעסק קטן בלי מהנדסי תוכנה שיודעים להשתמש בספריות קוד. הקוד פתוח לחלוטין וניתן להריץ אותו עצמאית. הפרויקט מפורסם ב-GitHub עם מעל 181,000 כוכבים, כך שאם העלויות יטפסו או שהספק ייסגר, תוכלו להעביר את כל התשתית לשרתים משלכם.
זה דורש מתכנת צמוד.
בנוגע לשוק הישראלי, הממשק והתיעוד כתובים כולם באנגלית, החיוב מתבצע בדולרים בלבד, ואין לחברה שום תמיכה מקומית. בחומרים שלהם אין אזכור של עברית או יישור מימין לשמאל, ולכן מומלץ לבדוק היטב כיצד סדר הטקסט נשמר במעבר לקובץ Markdown לפני שמסתמכים עליו. ארגונים ישראליים שכפופים להוראות אבטחה מחמירות חייבים לשים לב שמדיניות של מחיקת מידע מלאה מיד לאחר ביצוע השאיבה, הגבלת כתובות IP וחיבור SSO זמינים אך ורק בתוכנית Enterprise יקרה בתפירה אישית.
כל עובדה בעמוד נקראה מהאתר של Firecrawl בתאריך שרשום למעלה. מחירים ומגבלות משתנים; לפני שמשלמים, בודקים בעמוד המחירון שלהם. מצאתם טעות? כתבו.