بهترین روش استفاده از هوش مصنوعی برای ترجمه متن‌های فارسی
هوش مصنوعی

بهترین روش استفاده از هوش مصنوعی برای ترجمه متن‌های فارسی

  • 12 مرداد 1405
  • |
  • زمان مطالعه: [rt_reading_time]
  • |
  • 5 بازدید

استفاده درست از هوش مصنوعی برای ترجمه متن‌های فارسی به این معنا نیست که متن را یکجا در ابزار وارد کنیم و اولین خروجی را نسخه نهایی بدانیم. نتیجه قابل‌اعتماد زمانی به دست می‌آید که ترجمه را به یک فرایند چندمرحله‌ای تبدیل کنیم: ابتدا جهت ترجمه، مخاطب، کاربرد متن و سطح حساسیت را مشخص کنیم؛ سپس متن مبدأ را پاک‌سازی و واژه‌های ثابت را تعیین کنیم؛ بعد یک دستور روشن بنویسیم، متن‌های بلند را با حفظ زمینه به بخش‌های منطقی تقسیم کنیم و در پایان، خروجی را با متن اصلی مقایسه و ویرایش کنیم.

این موضوع برای فارسی اهمیت بیشتری دارد، چون ابزار باید علاوه بر انتقال معنا، با تفاوت‌های ساختاری زبان‌ها، حذف رایج فاعل در فارسی، اصطلاح‌ها، لحن رسمی و محاوره‌ای، نیم‌فاصله، نشانه‌گذاری، نام‌های خاص و شکل اعداد کنار بیاید. متنی که روان به نظر می‌رسد ممکن است یک قید، منفی، شرط، نام یا اصطلاح را نادرست منتقل کرده باشد. بنابراین روانی فقط یکی از معیارهای کیفیت است و هرگز جای تطبیق با مبدأ را نمی‌گیرد.

در این راهنما، «متن فارسی» هم متن فارسی به‌عنوان مبدأ و هم فارسی به‌عنوان زبان مقصد را دربر می‌گیرد. برای ترجمه از فارسی، باید ابهام‌ها و ارجاع ضمیرها را تا حد ممکن روشن کنیم. برای ترجمه به فارسی نیز باید از ابزار بخواهیم خروجی را به فارسی معیار ایران، متناسب با مخاطب و بدون ساختار ترجمه‌زده تولید کند. روش پیشنهادی این مقاله برای متن‌های عمومی، دانشگاهی، فنی، بازاریابی و سازمانی قابل استفاده است؛ با این تفاوت که هرچه پیامد خطا بیشتر باشد، بازبینی باید دقیق‌تر و تخصصی‌تر شود.

هدف این نیست که یک پرامپت جادویی پیدا کنیم. هدف، ساختن یک گردش‌کار تکرارپذیر است که بتوان کیفیت آن را سنجید، اشتباه‌ها را پیدا کرد و نسخه بعدی را بهتر ساخت. اگر این فرایند را درست اجرا کنید، هوش مصنوعی می‌تواند زمان تولید پیش‌نویس را کم کند؛ اما تصمیم نهایی درباره معنا، لحن و مناسب‌بودن متن برای انتشار همچنان باید آگاهانه گرفته شود.

روش پیشنهادی در یک نگاه

بهترین روش، یک زنجیره شش‌مرحله‌ای است: تعریف پروژه، آماده‌سازی متن، تنظیم دستور ترجمه، ترجمه مرحله‌ای، کنترل یکدستی و بازبینی نهایی. ارزش این زنجیره در آن است که خطا را فقط در پایان جست‌وجو نمی‌کنیم؛ از همان ابتدا ورودی و محدودیت‌ها را طوری می‌چینیم که احتمال حذف معنا، تغییر اصطلاح و نوسان لحن کمتر شود. هر مرحله یک خروجی قابل‌کنترل دارد و اگر ترجمه ضعیف باشد، می‌توان دقیق‌تر فهمید مشکل از متن مبدأ، دستور، تقسیم‌بندی یا ارزیابی بوده است. این نگاه همچنین اجازه می‌دهد شدت کنترل را با حساسیت متن هماهنگ کنیم و برای همه پروژه‌ها نسخه یکسانی نپیچیم.

روش پیشنهادی در یک نگاه

فرایند عملی را می‌توان این‌گونه اجرا کرد:

  1. هدف و جهت ترجمه را تعیین کنید. روشن کنید ترجمه از فارسی است یا به فارسی، مخاطب چه کسی است و متن کجا منتشر می‌شود.
  2. متن مبدأ را آماده کنید. غلط‌های تایپی، جمله‌های ناقص، ارجاع‌های مبهم و قالب‌بندی‌های مزاحم را اصلاح کنید.
  3. واژه‌ها و محدودیت‌ها را قفل کنید. نام برند، اصطلاح تخصصی، عدد، واحد، متغیر و عبارتی را که نباید ترجمه شود جدا بنویسید.
  4. دستور ترجمه را دقیق کنید. زبان مبدأ و مقصد، لحن، سطح آزادی، مخاطب و قالب خروجی را توضیح دهید.
  5. متن بلند را مرحله‌ای ترجمه کنید. بخش‌ها را بر اساس معنا جدا کنید و زمینه مشترک را در هر مرحله نگه دارید.
  6. خروجی را با مبدأ تطبیق دهید. معنا، کامل‌بودن، اصطلاحات، نام‌ها، اعداد، لحن و نگارش فارسی را جداگانه بررسی کنید.

این روش با تفاوت ترجمه با هوش مصنوعی و ترجمه ماشینی نیز سازگار است. ابزار هوشمند می‌تواند دستور و زمینه بیشتری دریافت کند، اما آزادی بیشتر آن ممکن است به بازنویسی بیش از حد یا افزودن جزئیات منجر شود. به همین دلیل، دستور روشن و بازبینی مبدأمحور دو ستون اصلی فرایند هستند. برای آشنایی دقیق‌تر با مرز این دو رویکرد، مقاله ترجمه با هوش مصنوعی چیست و چه تفاوتی با ترجمه ماشینی دارد؟ مکمل خوبی برای این بحث است.

آماده‌سازی متن فارسی و تعریف پروژه پیش از ترجمه

کیفیت خروجی هوش مصنوعی از کیفیت ورودی جدا نیست. پیش از ترجمه باید یک شرح کوتاه از پروژه بسازید که زبان‌ها، مخاطب، کاربرد نهایی، لحن، حوزه تخصصی و پیامد احتمالی خطا را مشخص کند. هم‌زمان، متن فارسی را از نظر غلط تایپی، جمله ناقص، فاصله‌گذاری، ارجاع ضمیر و نشانه‌های قالب‌بندی پاک‌سازی کنید. این آماده‌سازی به‌ویژه هنگام ترجمه از فارسی مهم است، چون فاعل یا مرجع ضمیر ممکن است در متن روشن نباشد و مدل ناچار شود آن را حدس بزند.

آماده‌سازی متن فارسی و تعریف پروژه پیش از ترجمه

در شرح پروژه، دست‌کم به این پرسش‌ها پاسخ دهید:

در این رابطه بخوانید
چطور کیفیت ترجمه AI را قبل از انتشار ارزیابی کنیم؟

زبان مبدأ و مقصد دقیقاً چیست؟

مخاطب متخصص است یا عمومی؟

متن برای وب‌سایت، مقاله، قرارداد، راهنما، شبکه اجتماعی یا استفاده داخلی آماده می‌شود؟

لحن باید رسمی، ساده، دانشگاهی، فنی یا دوستانه باشد؟

آیا ترجمه باید بسیار وفادار باشد یا بازآفرینی کنترل‌شده نیز مجاز است؟

کدام نام‌ها، اصطلاح‌ها، اعداد، واحدها یا متغیرها نباید تغییر کنند؟

اگر فارسی زبان مبدأ است، جمله‌های بسیار بلند را پیش از ترجمه سبک کنید، اما معنای آن‌ها را عوض نکنید. مرجع ضمیرهایی مانند «او»، «آن» و «این موضوع» را روشن کنید. در متن‌های فنی، عنوان جدول‌ها، زیرنویس شکل‌ها، کدها و متغیرها را از نثر عادی جدا کنید. همچنین شکل‌های متفاوت «ی» و «ک» را یکدست کنید تا جست‌وجو و کنترل اصطلاح‌ها دقیق‌تر شود.

اگر فارسی زبان مقصد است، از ابتدا مشخص کنید منظور فارسی معیار ایران است. این توضیح مانع همه خطاها نمی‌شود، اما احتمال استفاده از واژگان نامتناسب با بازار هدف یا ساختارهای بیگانه را کم می‌کند. برای محتوای وب، بهتر است درباره شیوه نوشتن اعداد، نیم‌فاصله، نشانه‌گذاری و ترجمه یا حفظ نام محصولات نیز تصمیم بگیرید. اگر سازمان یا برند راهنمای نگارش دارد، خلاصه قواعد مرتبط را همراه متن بدهید؛ ارسال یک راهنمای بلند و نامرتبط می‌تواند تمرکز مدل را کم کند.

نوشتن پرامپت مناسب برای ترجمه فارسی

پرامپت خوب باید مرز کار را روشن کند، نه اینکه با توضیح‌های طولانی و پراکنده مدل را گیج کند. یک دستور مؤثر معمولاً هفت جزء دارد: نقش کار، زبان‌ها، مخاطب، لحن، سطح وفاداری، واژه‌های ثابت و شیوه برخورد با ابهام. مهم‌ترین جمله در بسیاری از پروژه‌ها این است که مدل هیچ اطلاعاتی اضافه یا حذف نکند و هر بخش مبهم را به‌جای حدس قطعی علامت‌گذاری کند. بهتر است قالب خروجی نیز مشخص باشد تا عنوان‌ها، بندها، فهرست‌ها و متغیرهای متن حفظ شوند.

نوشتن پرامپت مناسب برای ترجمه فارسی

یک الگوی ساده و قابل‌تنظیم برای ترجمه به فارسی چنین است:

«متن زیر را از [زبان مبدأ] به فارسی معیار ایران ترجمه کن. مخاطب [نوع مخاطب] است و متن برای [کاربرد] استفاده می‌شود. لحن [نوع لحن] باشد. معنا، سطح قطعیت، منفی‌ها، شرط‌ها، نام‌ها، اعداد و واحدها را دقیق حفظ کن. هیچ اطلاعاتی اضافه یا حذف نکن. [اصطلاح مبدأ] را همیشه [معادل تأییدشده] ترجمه کن و [نام/متغیر] را بدون تغییر نگه دار. ساختار عنوان‌ها و فهرست‌ها حفظ شود. اگر جمله‌ای مبهم است، ترجمه محتمل را بنویس و ابهام را جداگانه اعلام کن.»

برای ترجمه از فارسی نیز همین الگو را با زبان مقصد و ویژگی‌های آن تنظیم کنید. اگر متن برای مخاطب عمومی است، می‌توان از مدل خواست جمله‌های مقصد طبیعی و روشن باشند، اما «ساده‌نویسی» نباید به حذف جزئیات یا کاهش دقت تبدیل شود. در متن بازاریابی، میزان آزادی بازآفرینی را صریح بنویسید. در متن دانشگاهی و فنی، وفاداری، حفظ ارجاع‌ها و ثبات اصطلاح‌ها را مقدم قرار دهید.

نمونه ترجمه تأییدشده می‌تواند از چند صفت کلی مفیدتر باشد. به‌جای اینکه فقط بنویسید «حرفه‌ای ترجمه کن»، یک یا دو بند کوتاه از سبک مطلوب بدهید و توضیح دهید چه چیزی در آن مهم است. نمونه نباید موضوع متفاوت یا واژگان متناقض داشته باشد. اگر می‌خواهید دستور خود را دقیق‌تر کنید، اصول بنیادین نوشتن پرامپت برای ترجمه نمونه‌ها و خطاهای رایج این کار را توضیح می‌دهد.

مدیریت متن‌های بلند، بافت و واژه‌نامه

ترجمه یک متن بلند را نباید به قطعه‌های تصادفی و مستقل تبدیل کرد. بخش‌بندی باید بر اساس مرز معنایی انجام شود: عنوان و بخش وابسته، یک صحنه کامل، یک زیرموضوع یا چند پاراگراف مرتبط کنار هم بمانند. همراه هر بخش، خلاصه‌ای ثابت از مخاطب، لحن، حوزه و اصطلاح‌های مصوب ارسال کنید. پس از ترجمه چند بخش، معادل‌های انتخاب‌شده را یکجا کنترل کنید تا واژه یا نام واحد در فصل‌های مختلف با شکل‌های متفاوت ظاهر نشود. هدف این است که هر قطعه به‌اندازه کافی کوچک و قابل‌کنترل باشد، اما ارتباط آن با کل سند از بین نرود.

مدیریت متن‌های بلند، بافت و واژه‌نامه

برای متن‌های طولانی، سه دارایی کوچک بسازید:

در این رابطه بخوانید
ترجمه با هوش مصنوعی چیست و چه تفاوتی با ترجمه ماشینی دارد؟

خلاصه زمینه

در چند جمله موضوع سند، مخاطب، هدف و رابطه این بخش با بخش‌های قبلی را توضیح دهید. این خلاصه باید ثابت و کوتاه باشد. جزئیات جدید هر بخش را جدا اضافه کنید.

واژه‌نامه پروژه

واژه‌نامه را دست‌کم با چهار ستون ذهنی تنظیم کنید: اصطلاح مبدأ، معادل تأییدشده، شکل‌های ممنوع و توضیح کاربرد. نام اشخاص، سازمان‌ها، محصولات، مخفف‌ها و عباراتی که نباید ترجمه شوند نیز در همین فهرست قرار می‌گیرند. واژه‌نامه باید نسخه‌دار باشد؛ هر اصلاحی که در بازبینی تأیید می‌شود، برای بخش‌های بعدی نیز اعمال شود.

نمونه سبک

یک نمونه کوتاه از ترجمه پذیرفته‌شده نگه دارید. این نمونه به مدل نشان می‌دهد طول جمله، میزان رسمی‌بودن، شیوه خطاب و انتخاب واژه‌ها چگونه باشد. برای پروژه‌ای که چند نوع محتوا دارد، یک نمونه برای هر نوع متن کافی است؛ انباشتن نمونه‌های زیاد و متناقض نتیجه را ناپایدار می‌کند.

هنگام تقسیم متن، شماره بخش‌ها و ترتیب آن‌ها را حفظ کنید. اگر ابزار امکان مدیریت پروژه و ویرایش بندبه‌بند دارد، از همان ساختار برای جلوگیری از کپی‌کاری و گم‌شدن نسخه‌ها استفاده کنید. صفحه راهنمای کاریز شیوه ساخت پروژه، انتخاب تنظیمات، مشاهده ترجمه پاراگراف‌به‌پاراگراف، ویرایش و دریافت خروجی را نشان می‌دهد. برای ساخت یک سبک تکرارپذیر در پروژه‌های چندبخشی نیز راهنمای ساخت سبک ترجمه اختصاصی با پرامپت‌های هوشمند می‌تواند به یکدست‌کردن تصمیم‌های زبانی کمک کند.

بازبینی ترجمه و تشخیص نیاز به مترجم متخصص

بازبینی باید از معنا شروع شود، نه از زیباترکردن جمله‌ها. ابتدا هر بخش مقصد را با مبدأ مقایسه کنید و ببینید آیا همه ادعاها، قیدها، منفی‌ها، شرط‌ها و رابطه‌های علت و معلولی حفظ شده‌اند. سپس نام‌ها، عددها، تاریخ‌ها، واحدها، ارجاع‌ها و اصطلاح‌های تخصصی را جدا کنترل کنید. در مرحله بعد نوبت لحن، روانی و نگارش فارسی است. جداکردن این لایه‌ها باعث می‌شود ویرایش زبانی، خطای معنایی را پنهان نکند. نتیجه بازبینی نیز باید ثبت شود تا معادل‌های تأییدشده و خطاهای پرتکرار در بخش‌های بعدی دوباره تکرار نشوند.

بازبینی ترجمه و تشخیص نیاز به مترجم متخصص

برای کنترل نهایی، این شش محور را به‌ترتیب بررسی کنید:

  1. دقت معنایی: آیا پیام، رابطه‌ها و سطح قطعیت متن اصلی حفظ شده است؟
  2. کامل‌بودن: آیا جمله، بند، قید یا هشدار مهمی حذف یا بی‌دلیل اضافه نشده است؟
  3. اصطلاحات و نام‌ها: آیا معادل‌ها، نام اشخاص و برندها در سراسر سند یکدست‌اند؟
  4. اعداد و قالب: آیا عدد، واحد، تاریخ، متغیر، لینک و ساختار جدول یا فهرست سالم مانده است؟
  5. لحن و طبیعی‌بودن: آیا متن مقصد برای مخاطب واقعی طبیعی است و بوی ترجمه تحت‌اللفظی نمی‌دهد؟
  6. آمادگی انتشار: آیا متن با کاربرد نهایی، محدودیت‌های حقوقی یا حرفه‌ای و راهنمای نگارش پروژه سازگار است؟

سطح بازبینی باید با پیامد خطا تناسب داشته باشد. برای یادداشت داخلی کم‌ریسک ممکن است نمونه‌گیری هدفمند کافی باشد. برای محتوای عمومیِ قابل انتشار، بهتر است کل متن یک بار با مبدأ تطبیق داده شود. در متن حقوقی، پزشکی، مالی، ایمنی، دانشگاهی حساس یا محتوایی که بر تصمیم مهم اثر می‌گذارد، خروجی هوش مصنوعی باید پیش‌نویس باشد و مترجم یا متخصص حوزه آن را کامل بازبینی کند.

همچنین پیش از واردکردن متن محرمانه، باید سیاست نگهداری و استفاده از داده، مجوز سازمان و سطح حساسیت سند بررسی شود. نام ابزار یا کیفیت ظاهری خروجی، جای این تصمیم را نمی‌گیرد. راهنمای ارزیابی کیفیت ترجمه هوش مصنوعی پیش از انتشار روش دقیق‌تری برای نمونه‌گیری، امتیازدهی خطاها و تعیین نیاز به بازبین ارائه می‌کند.

در این رابطه بخوانید
۵ معیار ضروری برای ارزیابی ترجمه ماشینی

اگر می‌خواهید این فرایند را در محیطی انجام دهید که متن را بخش‌بندی می‌کند، امکان ویرایش هر قسمت را می‌دهد و تنظیمات ترجمه را کنار پروژه نگه می‌دارد، می‌توانید یک پروژه ترجمه در کاریز شروع کنید. بهترین نتیجه زمانی به دست می‌آید که قبل از شروع، شرح پروژه، واژه‌نامه و نمونه سبک خود را آماده کرده باشید و ترجمه هر بخش را پیش از تأیید نهایی بررسی کنید.

جمع‌بندی

بهترین استفاده از هوش مصنوعی برای ترجمه متن‌های فارسی، سپردن کامل تصمیم به ابزار نیست؛ ساختن یک فرایند قابل‌کنترل است. متن را آماده کنید، هدف و مخاطب را روشن بنویسید، اصطلاح‌ها را قفل کنید، پرامپت را کوتاه و دقیق بسازید، متن بلند را با حفظ زمینه ترجمه کنید و خروجی را لایه‌به‌لایه با مبدأ بسنجید. این روش هم سرعت تولید پیش‌نویس را بالا می‌برد و هم امکان پیدا کردن منشأ خطا را فراهم می‌کند. در چنین سیستمی، کیفیت نتیجه به یک پاسخ اتفاقی وابسته نیست و با ثبت اصلاحات می‌توان اجرای بعدی را دقیق‌تر کرد.

جمع‌بندی

برای پروژه‌های کم‌ریسک، ممکن است بازبینی محدود و نمونه‌گیری کافی باشد؛ اما هرچه متن تخصصی‌تر، عمومی‌تر یا حساس‌تر شود، نقش بازبین انسانی پررنگ‌تر است. واژه‌نامه و نمونه سبک نیز دارایی‌های یک‌بارمصرف نیستند. آن‌ها را پس از هر پروژه اصلاح کنید تا ترجمه‌های بعدی یکدست‌تر شوند.

یک قاعده ساده می‌تواند تصمیم نهایی را روشن کند: هوش مصنوعی را برای سرعت، پیشنهاد و ساخت پیش‌نویس به کار بگیرید؛ اما صحت معنا، تناسب فرهنگی، لحن و آمادگی انتشار را با کنترل انسانی تأیید کنید. کیفیت پایدار از انتخاب یک مدل خاص نمی‌آید؛ از گردش‌کار درست، ورودی روشن و بازبینی متناسب با ریسک به دست می‌آید.

سؤالات متداول

پرسش‌های زیر به تصمیم‌های رایجی مربوط‌اند که هنگام ترجمه متن فارسی با هوش مصنوعی پیش می‌آیند. پاسخ مناسب به نوع متن، جهت ترجمه، مخاطب و پیامد خطا بستگی دارد.

بهترین پرامپت برای ترجمه فارسی چیست؟

پرامپت واحدی برای همه متن‌ها وجود ندارد. یک دستور خوب باید زبان مبدأ و مقصد، فارسی معیار ایران، مخاطب، لحن، کاربرد، سطح وفاداری، اصطلاح‌های ثابت، عناصر غیرقابل‌تغییر و شیوه برخورد با ابهام را مشخص کند. کوتاهی و وضوح از طول زیاد مهم‌تر است.

آیا بهتر است متن فارسی را یکجا ترجمه کنیم؟

برای متن کوتاه، ترجمه یکجا می‌تواند مفید باشد. متن بلند را بر اساس مرزهای معنایی تقسیم کنید و همراه هر بخش، خلاصه زمینه، واژه‌نامه و نمونه سبک ثابت را نگه دارید. تقسیم تصادفی ممکن است انسجام، ارجاع ضمیرها و ثبات اصطلاح‌ها را خراب کند.

چگونه بفهمیم ترجمه هوش مصنوعی درست است؟

خروجی را با متن مبدأ مقایسه کنید و دقت معنا، کامل‌بودن، منفی‌ها و شرط‌ها، نام‌ها، اعداد، واحدها، اصطلاح‌ها، لحن و ساختار را جداگانه بسنجید. روان‌بودن متن مقصد به‌تنهایی نشانه درستی ترجمه نیست.

آیا هوش مصنوعی نیم‌فاصله و نگارش فارسی را درست رعایت می‌کند؟

گاهی بله، اما این رفتار در همه ابزارها و متن‌ها ثابت نیست. در دستور خود فارسی معیار ایران و رعایت نیم‌فاصله و نشانه‌گذاری را ذکر کنید، سپس خروجی را با جست‌وجو و بازخوانی نهایی کنترل کنید. یکدست‌کردن «ی» و «ک» نیز برای انتشار و جست‌وجو مفید است.

چه متن‌هایی حتماً به بازبینی متخصص نیاز دارند؟

متن‌های حقوقی، پزشکی، مالی، ایمنی، دانشگاهی حساس، قراردادها، دستورالعمل‌های اثرگذار و هر محتوایی که خطای آن می‌تواند زیان مهمی ایجاد کند باید به‌طور کامل توسط مترجم یا متخصص حوزه بررسی شود. در این موارد، ترجمه هوش مصنوعی را نسخه نهایی تلقی نکنید.

برای حفظ اصطلاحات تخصصی چه کنیم؟

پیش از ترجمه یک واژه‌نامه شامل اصطلاح مبدأ، معادل تأییدشده، شکل‌های ممنوع و توضیح کاربرد بسازید. همان نسخه را در تمام بخش‌ها استفاده کنید و پس از پایان، اصطلاح‌ها را در کل سند به‌صورت یکجا جست‌وجو و کنترل کنید.

به مطالب ما علاقه مند شدید؟

در خبرنامه ترنسیس عضو شوید تا شما را از آخرین اخبار و مقالات خود باخبر کنیم

0 دیدگاه [ در این بحث شرکت کنید ]