استخراج
Node A — مسئله و پیشینه
مشکل فنی، رویکردهای قبلی، ضعفها و نزدیکترین هنر شناختهشده را از متن افشا استخراج میکند.
توضیح کامل
این گره با شناسه ثابت بخش A (NODE_A) روی متن کامل افشا اجرا میشود. اجرای کلی از تابع اجرای استخراج (run_extraction) به تابع استخراج موازی بخشبندیشده (extract_patent_context_sectioned) میرسد؛ هر گره با اجراکننده گره بخش (run_section_node) و استخراجگر LLM ساختاریافته (LangChainSectionExtractorLLM) پر میشود. پرسشهای مصاحبه دستگاه (DEVICE_INTERVIEW_QUESTIONS) با شماره Q01 تا Q05 به مسیرهای فیلد (field_paths) زیر مشکل و پیشینه (problem_and_background) نگاشت میشوند. مقدار ساختگی مجاز نیست؛ شکاف باید با شدت (severity) ثبت شود.
از نظر کیفیت به دنبال چه هستیم؟
جملات مفهومی؛ هر شناسه با نام فارسی و سپس نام انگلیسی در پرانتز.
- مشکل فنی باید مشخص و مکانیزممحور باشد؛ فیلد مشکل فنی (technical_problem) نباید فقط شعار تجاری عمومی باشد
- رویکردهای پیشین (prior_approaches) و ضعفهای پیشین (prior_weaknesses) باید به متن افشا قابل استناد باشند
- نزدیکترین هنر شناختهشده (closest_known_art) فقط وقتی پر شود که واقعاً در افشا آمده باشد
- هیچ مقدار ساختگی بدون علامت مفقود یا استنتاجشده (missing / inferred) پذیرفته نشود
چطور مطمئن میشویم رسیدهایم؟
نشانه رسیدن: توضیح فارسی و سپس متغیر، تابع یا کد انگلیسی در پرانتز.
- مسیرهای زیر مشکل و پیشینه (problem_and_background.*) در زمینه اختراع (InventionContext) پر یا با شکاف صریح باشند
- برای مقادیر پرشده، ردیابی منبع (provenance) یا اتصال به متن افشا وجود داشته باشد
- اگر شدت شکاف BLOCKING / HIGH / MEDIUM / LOW باشد، در مسیر ناهمزمان رویداد نیاز به سؤال (questions_required) بیاید نه تکمیل خاموش (completed)
- سناریوهای پروتکل پذیرش استخراج (ATP extract) و تستهای استخراج پاس شوند
توابع و نقاط ورود
هر مورد: توضیح فارسی و سپس نام انگلیسی در پرانتز.
- تابع نقطه ورود HTTP/CLI استخراج (run_extraction)
- تابع استخراج موازی بخشبندیشده (extract_patent_context_sectioned)
- تابع اجرای DAG موازی شش گره (run_sectioned_parallel)
- تابع اجرای یک گره با retry (run_section_node)
- تابع ساخت محتوای کاربر برای گره (build_section_user_content)
- تابع بارگذاری پرامپت سیستم گره (load_node_system_prompt)
متغیرها، فیلدها و تنظیمات
هر مورد: توضیح فارسی و سپس شناسه انگلیسی در پرانتز.
- شناسه ثابت گره مسئله و پیشینه (NODE_A)
- پروفایل استخراج فعلی (PROFILE_SECTIONED_DEVICE_PARALLEL_FULLTEXT)
- فهرست پرسشهای مصاحبه دستگاه (DEVICE_INTERVIEW_QUESTIONS)
- مسیر فیلد مشکل فنی (problem_and_background.technical_problem)
- مسیر فیلد رویکردهای پیشین (problem_and_background.prior_approaches)
- مسیر فیلد ضعفهای پیشین (problem_and_background.prior_weaknesses)
- مسیر فیلد نزدیکترین هنر شناختهشده (problem_and_background.closest_known_art)
- مدل فعال استخراج بخشبندیشده (active_sectioned_extraction_model)
- حداکثر retry فراخوانی LLM گره (sectioned_extraction_invoke_max_retries)
چه چیزهایی پر میشوند؟
مشکل فنی (technical_problem)
problem_and_background.technical_problem
چطور: LLM ساختاریافته با پرامپت گره A روی متن کامل افشا؛ مرتبط با پرسش اول مصاحبه (Q01)
ویژگیها:
- باید مکانیزم فنی مشخص باشد، نه صرفاً ناکارآمدی تجاری
- بدون داده ساختگی؛ شکاف بهصورت مفقود یا استنتاجشده (missing / inferred) ثبت میشود
رویکردهای پیشین (prior_approaches)
problem_and_background.prior_approaches
چطور: همان گره A؛ مرتبط با پرسش دوم مصاحبه (Q02)
ویژگیها:
- نام دستگاه یا سیستم قبلی بههمراه نقش آن در حل همان مسئله
ضعفهای پیشین (prior_weaknesses)
problem_and_background.prior_weaknesses
چطور: همان گره A؛ مرتبط با پرسش سوم مصاحبه (Q03)
ویژگیها:
- دقت، پایداری، انرژی، کنترل، ایمنی و مانند آن بهصورت مشخص
نزدیکترین هنر شناختهشده (closest_known_art)
problem_and_background.closest_known_art
چطور: همان گره A؛ مرتبط با پرسش چهارم مصاحبه (Q04)
ویژگیها:
- مرجع محصول، مقاله یا پتنت مشابه فقط در صورت وجود در افشا
کنترلهای کیفیت
- مقادیر باید به متن منبع متصل باشند؛ ردیابی منبع (provenance)
- در مسیر ناهمزمان، شکافهای BLOCKING / HIGH / MEDIUM / LOW مانع رویداد تکمیلشده (completed) میشوند
- پوشش not-applicable و EXTRACTION_FAILURE به سؤال مخترع تبدیل نمیشوند
نکات
- نقاط تمایز مشترک با گره D نیز از پرسش پنجم (Q05) تغذیه میشوند