<?xml version="1.0" encoding="UTF-8"?><rss xmlns:dc="http://purl.org/dc/elements/1.1/" xmlns:content="http://purl.org/rss/1.0/modules/content/" xmlns:atom="http://www.w3.org/2005/Atom" version="2.0"><channel><title><![CDATA[אימון מודל GPT]]></title><description><![CDATA[<p dir="auto">רציתי להתייעץ לגבי שימוש בGPT כנציג תמיכה למערכת שלי.<br />
יש לי נציגי תמיכה אנושיים שנותנים מענה ללקוחות בטלפון, אבל רציתי לעשות שלוחה מיוחדת שאפשר לשוחח עם נציג תמיכה וירטואלי מבוסס על GPT.</p>
<p dir="auto">אז זה כבר מוכן וברוך השם עובד נהדר, רק אני מתלבט אם הדרך שבחרתי היא חכמה.<br />
במקום לאמן המודל fine tuning, הכנתי מסמך של 3 עמודים, ובו המון הסברים על המערכת, ובכל פעם שמישהו שואל שאלה, אני שולח בAPI התחלה כזו<br />
you are a support agent ונותן לו את כל המסמך הנל, ואומר לו לענות על השאלה של הלקוח לפי ההקדמה הזו.<br />
אז אמנם זה עולה מעט יותר מן הסתם, כי המסמך הזה הוא בערך 2000 טוקנים, אבל זה כסף קטן ונותן מענה טוב.</p>
<p dir="auto">הבעייה היא, אחרי כמה שאלות.<br />
אם המשתמש ממשיך את השיחה ושואל שאלות נוספות, פתאום הנציג הוירטואלי מסכים לדבר על נושאים שלא ממן הענין, למרות שמסמך כתבתי לו שהוא צריך לסרב בעדינות לדבר על כל נושא אחר.</p>
<p dir="auto">ואני חושש שאולי אחרי שיש לו כבר כל כך הרבה מידע (גם המסמך שלי וגם שלבי השיחה הקודמים), זה כבר משכיח ממנו קצת את הכללים שמסרתי לו.</p>
<p dir="auto">מאידך גיסא, המודל טורבו הזול, לא ניתן לאימון, והמודל davinci הוא הרבה יותר יקר, כך שלכאורה גם אם אחסוך על ידי האימון שלא צריך לשלוח כל פעם את הכל, אבל אפסיד כי המחיר הוא פי עשר.</p>
<p dir="auto">אשמח לשמוע את חוות דעתכם על הענין</p>
]]></description><link>https://tchumim.com/topic/14877/אימון-מודל-gpt</link><generator>RSS for Node</generator><lastBuildDate>Mon, 17 Aug 2026 16:56:16 GMT</lastBuildDate><atom:link href="https://tchumim.com/topic/14877.rss" rel="self" type="application/rss+xml"/><pubDate>Thu, 30 Mar 2023 16:28:49 GMT</pubDate><ttl>60</ttl><item><title><![CDATA[Reply to אימון מודל GPT on Fri, 31 Mar 2023 06:49:09 GMT]]></title><description><![CDATA[<p dir="auto">מצרף מספר מקורות שפגשתי בעבר<br />
<a href="https://github.com/hwchase17/langchain" target="_blank" rel="noopener noreferrer nofollow ugc">https://github.com/hwchase17/langchain</a><br />
<a href="https://github.com/emptycrown/llama-hub" target="_blank" rel="noopener noreferrer nofollow ugc">https://github.com/emptycrown/llama-hub</a><br />
<a href="https://github.com/jerryjliu/llama_index" target="_blank" rel="noopener noreferrer nofollow ugc">https://github.com/jerryjliu/llama_index</a></p>
]]></description><link>https://tchumim.com/post/151705</link><guid isPermaLink="true">https://tchumim.com/post/151705</guid><dc:creator><![CDATA[aaron]]></dc:creator><pubDate>Fri, 31 Mar 2023 06:49:09 GMT</pubDate></item><item><title><![CDATA[Reply to אימון מודל GPT on Fri, 31 Mar 2023 06:33:10 GMT]]></title><description><![CDATA[<p dir="auto"><a class="plugin-mentions-user plugin-mentions-a" href="/user/%D7%A9%D7%95%D7%90%D7%A3">@<bdi>שואף</bdi></a><br />
למה שעשית קורים in-context training, ולדעתי משתמשים בזה יותר ויותר.<br />
למשל הצורה שבה בינג מכניס מידע מהאינטרנט לתוך התשובות שלו.</p>
<p dir="auto">לגבי השאלה שלך, הייתי מנסה להגביל את כמות השלבים בשיחה שאתה מעביר לGPT, וכמובן עוד כיונונים להוראות שלך.<br />
למשל לסרב בעדינות יכול גם להיתפס כ"אל תסרב לחלוטין", במקום ל"תסרב לחלוטין, תנסח בלשון עדינה"</p>
]]></description><link>https://tchumim.com/post/151704</link><guid isPermaLink="true">https://tchumim.com/post/151704</guid><dc:creator><![CDATA[aaron]]></dc:creator><pubDate>Fri, 31 Mar 2023 06:33:10 GMT</pubDate></item></channel></rss>