بهتازگی، مؤسسه فناوریهای هوش مصنوعی آلن (Ai2) ابزار جدیدی به نام OLMoTrace را معرفی کرده است که میتواند انقلابی در درک خروجیهای مدلهای زبانی بزرگ (LLM) ایجاد کند. این ابزار امکان ردیابی خروجیهای مدلهای زبان را به ورودیهای آموزشی مربوطه فراهم میآورد و به یکی از بزرگترین چالشهای پذیرش هوش مصنوعی در صنعت، یعنی عدم شفافیت در فرآیندهای تصمیمگیری سیستمهای هوش مصنوعی، پاسخ میدهد.
OLMoTrace، که مخفف Open Language Model است، به کاربران این امکان را میدهد که خروجیهای مدل زبانی را به دادههای آموزشی اصلی مرتبط سازند. این ابزار بهصورت متنباز در دسترس بوده و کاربران میتوانند آن را در وبسایت Ai2 Playground آزمایش کنند. با استفاده از این فناوری، کاربر میتواند نقاط تطابق بین خروجیهای مدل و دادههای آموزشی چند میلیارد توکنی را بررسی کند و ارتباطات مستقیم بین آنها را مشاهده نماید.
جیچنگ لیو، محقق Ai2، در این باره بیان کرد: “هدف ما کمک به کاربران برای فهمیدن دلیلی است که مدلهای زبانی پاسخهای خاصی را تولید میکنند.” برخلاف شیوههای موجود که به نمرات اطمینانسنجی یا تولید بهکمک بازیابی (RAG) تمرکز دارند، OLMoTrace بهدنبال ارائه نگاهی مستقیم به رابطه بین خروجیهای مدل و دادههای آموزشی است.
از مزایای خاص OLMoTrace این است که با شناسایی توالیهای متنی طولانی و منحصر به فرد در خروجیهای مدل، آنها را با اسناد خاص در پایگاه دادههای آموزشی تطابق میدهد. هنگامی که تطابقی یافت میشود، OLMoTrace متن مرتبط را هایلایت کرده و لینکهایی به منابع اصلی را ارائه میدهد؛ به این ترتیب، کاربران میتوانند ببینند که مدل چگونه و از کجا دانش خود را کسب کرده است.
ویژگیهای OLMoTrace، نیاز به تخصص عمیق در معماری شبکههای عصبی را کاهش میدهد و برای شرکتهایی که در صنایع تحت مقررات مانند سلامت، مالی و خدمات حقوقی فعالیت میکنند، مزایای قابل توجهی فراهم میآورد. این ابزار به تیمهای هوش مصنوعی اجازه میدهد تا فرآیندهای آموزشی خود را بهبهترین شکل ممکن بهبود بخشند و در نتیجه اعتماد بیشتری ایجاد کنند.
OLMoTrace بهعنوان یک ابزار متنباز تحت مجوز Apache 2.0 در دسترس است و هر سازمانی که دسترسی به دادههای آموزشی یک مدل داشته باشد، میتواند قابلیتهای مشابهی را پیادهسازی کند. بهطور خلاصه، این ابزار نوآورانه میتواند به عنوان یک گام اساسی به سوی سیستمهای هوش مصنوعی مسئولیتپذیرتر در صنایع مختلف استفاده شود و شفافیت و قابلیت اطمینان بیشتری را به کاربر ارائه دهد.
