เรียนรู้วิธีใช้ node NVIDIA Nemotron Chat Model ใน n8n ปฏิบัติตามเอกสารทางเทคนิคเพื่อรวม node NVIDIA Nemotron Chat Model เข้ากับ workflow ของคุณ
ใช้ node NVIDIA Nemotron Chat Model เพื่อเข้าถึง NVIDIA Nemotron รูปแบบที่มีตัวแทนการสนทนา 1 . ปุ่มทำงานกับรุ่น Nemotron ที่โฮสต์ build.nvidia.com และด้วย NVIDIA Inference Microservices (NIM) ที่โฮสต์เอง
ในหน้านี้ คุณจะพบ parameter node สำหรับ node NVIDIA Nemotron Chat Model และลิงก์ไปยังแหล่งข้อมูลเพิ่มเติม
Credentials
อ้างถึง NVIDIA Nemotron credentials สำหรับข้อมูลการตรวจสอบสิทธิ์สำหรับ node นี้
ความละเอียด parameter ใน sub-node (Parameter resolution in sub-nodes)
sub-node มีพฤติกรรมแตกต่างไปจาก node อื่นๆ เมื่อประมวลผลหลายรายการโดยใช้ expression
node ส่วนใหญ่ รวมถึง node รูท รับไอเท็มจำนวนเท่าใดก็ได้เป็น input ประมวลผลไอเท็มเหล่านี้ และ output ผลลัพธ์ คุณสามารถใช้ expression เพื่ออ้างถึงรายการ input และ node จะแก้ไข expression สำหรับแต่ละรายการตามลำดับ เช่น ให้ input เป็น 5 name ค่านิยม, การแสดงออก {{ $json.name }} จะแก้ไขชื่อแต่ละชื่อตามลำดับ
ใน sub-node expression จะแก้ไขเป็นรายการแรกเสมอ เช่น ให้ input เป็น 5 name ค่านิยม, การแสดงออก {{ $json.name }} แก้เป็นชื่อเสมอ
parameter node
Model
เลือกโมเดล Nemotron เพื่อใช้ในการสร้างเสร็จสมบูรณ์
n8n โหลดโมเดล Nemotron แบบไดนามิกจากจุดสิ้นสุดที่กำหนดค่าไว้ใน credentials ของคุณ หาก n8n ไม่สามารถเข้าถึงตำแหน่งข้อมูลได้ ระบบจะถอยกลับไปยังรายการรหัสโมเดล Nemotron ที่รู้จักกันดี
ตัวเลือก node
ใช้ตัวเลือกเหล่านี้เพื่อปรับแต่งพฤติกรรมของ node เพิ่มเติม
Frequency Penalty
ใช้ตัวเลือกนี้เพื่อควบคุมโอกาสที่โมเดลจะเกิดซ้ำ ค่าที่สูงกว่าจะช่วยลดโอกาสที่โมเดลจะเกิดซ้ำ
Maximum Number of Tokens
ป้อนจำนวน token สูงสุดที่ใช้ ซึ่งจะกำหนดระยะเวลาในการทำให้เสร็จสมบูรณ์ ใช้ -1 สำหรับค่าเริ่มต้นของรุ่น
Response Format
เลือก Text หรือ JSON. JSON ตรวจสอบให้แน่ใจว่าโมเดลส่งคืน JSON ที่ถูกต้อง เมื่อคุณเลือก JSON , ใส่คำว่า json ในพรอมต์ของคุณในเครือข่ายหรือตัวแทน
Presence Penalty
ใช้ตัวเลือกนี้เพื่อควบคุมโอกาสที่โมเดลจะพูดถึงหัวข้อใหม่ๆ ค่าที่สูงกว่าจะเพิ่มโอกาสที่โมเดลจะพูดถึงหัวข้อใหม่ๆ
Sampling Temperature
ใช้ตัวเลือกนี้เพื่อควบคุมการสุ่มของกระบวนการสุ่มตัวอย่าง อุณหภูมิที่สูงขึ้นจะสร้างตัวอย่างที่หลากหลายมากขึ้น แต่เพิ่มความเสี่ยงต่อการเกิดอาการประสาทหลอน
Timeout
ป้อนเวลาร้องขอสูงสุดเป็นมิลลิวินาที
Max Retries
ป้อนจำนวนครั้งสูงสุดเพื่อลองส่งคำขออีกครั้ง
Top P
ใช้ตัวเลือกนี้เพื่อกำหนดความน่าจะเป็นที่ควรใช้ให้เสร็จสิ้น ใช้ค่าที่ต่ำกว่าเพื่อละเว้นตัวเลือกที่น่าจะเป็นไปได้น้อยกว่า
เทมเพลตและตัวอย่าง
เรียกดูเทมเพลตการรวมเอกสาร node NVIDIA Nemotron Chat Model หรือ ค้นหาเทมเพลตทั้งหมด
ทรัพยากรที่เกี่ยวข้อง
อ้างถึง แค็ตตาล็อกบิลด์ของ NVIDIA สำหรับรายชื่อรุ่น Nemotron และสำหรับ เอกสาร NIM สำหรับคำแนะนำในการโฮสต์ด้วยตนเอง เนื่องจาก NVIDIA API รองรับ OpenAI-spec คุณจึงสามารถอ้างอิงได้ เอกสาร OpenAI ของ LangChain สำหรับข้อมูลเพิ่มเติมเกี่ยวกับลูกค้าที่เกี่ยวข้อง
ดูของ n8n AI ขั้นสูง เอกสารประกอบ
หมายเหตุ
-
เจ้าหน้าที่ AI คือระบบปัญญาประดิษฐ์ที่สามารถตอบสนองคำขอ ตัดสินใจ และปฏิบัติงานในโลกแห่งความเป็นจริงให้กับผู้ใช้ได้ พวกเขาใช้โมเดลภาษาขนาดใหญ่ (LLM) เพื่อตีความข้อมูลที่ผู้ใช้ป้อนและตัดสินใจเกี่ยวกับวิธีดำเนินการตามคำขอให้ดีที่สุดโดยใช้ข้อมูลและทรัพยากรที่มีอยู่ ↩

