๋ฐ˜์‘ํ˜•

์ œ์กฐ๊ณต์ • ๋ฐ์ดํ„ฐ์—๋Š” ์ด๋ฏธ์ง€, ์Œ์„ฑ, ํ…์ŠคํŠธ, ์„ผ์„œ ๋“ฑ ๋‹ค์–‘ํ•œ ํ˜•์‹์ด ์กด์žฌํ•œ๋‹ค.
๋ฉ€ํ‹ฐ๋ชจ๋‹ฌ Agentic AI ์‹œ์Šคํ…œ์„ ์„ค๊ณ„ํ•˜์—ฌ,
๋น„์ „·ํ…์ŠคํŠธ·์‹œ๊ณ„์—ด ๋ฐ์ดํ„ฐ๋ฅผ ๋™์‹œ์— ๋ถ„์„ํ•˜๊ณ  ๋ณด๊ณ ์„œ๋ฅผ ์ƒ์„ฑํ•˜๋Š” ๊ตฌ์กฐ๋ฅผ ์ œ์‹œํ•˜์‹œ์˜ค.

 

 

 

โ‘  ๊ฐœ๋…

  • ๋ฉ€ํ‹ฐ๋ชจ๋‹ฌ Agentic AI๋Š” LLM์ด ํ…์ŠคํŠธ ์™ธ์—๋„
    ์ด๋ฏธ์ง€(๋น„์ „), ์‹œ๊ณ„์—ด(์„ผ์„œ), ์Œ์„ฑ(ํ˜„์žฅ๋ณด๊ณ ) ๋“ฑ ๋‹ค์–‘ํ•œ ํ˜•ํƒœ์˜ ๋ฐ์ดํ„ฐ๋ฅผ ์ดํ•ด·ํ†ตํ•ฉ·์ถ”๋ก ํ•˜๋Š” ์ฒด๊ณ„๋‹ค.
  • ์ œ์กฐ๊ณต์ •์—์„œ๋Š” ์‹œ๊ฐ์  ๊ฒฐํ•จ, ์˜จ๋„·์••๋ ฅ ๋กœ๊ทธ, ์ž‘์—…์ž ์ฝ”๋ฉ˜ํŠธ๋ฅผ ๊ฒฐํ•ฉํ•ด ์ข…ํ•ฉ ์›์ธ·์กฐ์น˜ ๋ณด๊ณ ์„œ๋ฅผ ์ƒ์„ฑํ•˜๋Š” ๋ฐ ํ™œ์šฉ๋œ๋‹ค.

โ‘ก ์‹œ์Šคํ…œ ๊ตฌ์กฐ

 
[Vision Encoder] โ”€โ”
[Sensor Encoder] โ”€โ”ผ→ [Fusion Layer] → [Reasoning LLM] → [RAG + Report-Agent]
[Text Encoder] โ”€โ”€โ”€โ”˜
  • Vision: ViT, SAM, CLIP
  • Sensor: Temporal Convolutional Network (TCN), Transformer Encoder
  • Text: LLM (LLama3, Exaone, GPT)
  • Fusion: Perceiver IO, BLIP-2, OpenCLIP
  • RAG: SOP/WI ๋ฌธ์„œ ์—ฐ๊ฒฐ

โ‘ข LangGraph ์›Œํฌํ”Œ๋กœ ์˜ˆ์‹œ

nodes:
  - vision_agent (image encoder)
  - signal_agent (sensor pattern extractor)
  - text_agent (log summarizer)
  - fusion_agent (multimodal reasoning)
  - rag_agent
  - report_agent
edges:
  - vision_agent, signal_agent, text_agent -> fusion_agent
  - fusion_agent -> rag_agent
  - rag_agent -> report_agent

โ‘ฃ ๋™์ž‘ ๋‹จ๊ณ„

  1. Vision-Agent: ๊ณ ํ•ด์ƒ๋„ ์ด๋ฏธ์ง€ ์ž…๋ ฅ → CLIP ๊ธฐ๋ฐ˜ “LPGํ†ต” ํƒ์ง€.
  2. Signal-Agent: TimescaleDB์—์„œ ์˜จ๋„์‹œ๊ณ„์—ด ๋ถˆ์•ˆ์ • ํŒจํ„ด ๊ฒ€์ถœ(±8โ„ƒ ํŽธ์ฐจ).
  3. Text-Agent: ํ˜„์žฅ ์ž‘์—…์ž ๋กœ๊ทธ ์š”์•ฝ (“์˜ค๋ธ ์†๋„ 1.1m/s”).
  4. Fusion-Agent: ์„ธ ์ž…๋ ฅ์„ ํ†ตํ•ฉํ•˜์—ฌ “์˜จ๋„ + ์†๋„ ๊ด€๋ จ ์ด์ƒ” ์ถ”๋ก .
  5. RAG-Agent: SOP-HT-221 §3.2 ๊ฒ€์ƒ‰ → ํ—ˆ์šฉ๋ฒ”์œ„ ±5โ„ƒ ์ธ์šฉ.
  6. Report-Agent: ์‹œ๊ฐ+์ˆ˜์น˜+๋ฌธํ—Œ ๊ทผ๊ฑฐ ํฌํ•จํ•œ ๋ฆฌํฌํŠธ ์ƒ์„ฑ.

โ‘ค ์ถœ๋ ฅ ์˜ˆ์‹œ

์š”์•ฝ: ๋ผ์ธ2์—์„œ LPGํ†ต์ด ํฌํ•จ๋œ ์Šคํฌ๋žฉ ํŠธ๋Ÿญ ์ ์žฌ, ์˜ค๋ธ ์˜จ๋„ ±8โ„ƒ ํŽธ์ฐจ๋กœ ํ’ˆ์งˆ ์ €ํ•˜ ๋ฐœ์ƒ.
๊ทผ๊ฑฐ: SOP-HT-221 §3.2(ํ—ˆ์šฉ ±5โ„ƒ), Sensor ๋กœ๊ทธ(±8โ„ƒ), Vision ๋ถ„์„(LPGํ†ต ๊ฐ์ง€).
์กฐ์น˜: ์˜ค๋ธ ์˜จ๋„ PID ์žฌํŠœ๋‹, ์†๋„ 1.00m/s ์žฌ์„ค์ •.


โ‘ฅ ๊ธฐ์ˆ ์  ๊ตฌ์„ฑ ํฌ์ธํŠธ

๊ณ„์ธต๊ธฐ์ˆ ์„ค๋ช…
์ž…๋ ฅ ์ธ์ฝ”๋”ฉ CLIP, TCN, LLM ๊ฐ ๋ฐ์ดํ„ฐ ํƒ€์ž…์„ ๋ฒกํ„ฐ๋กœ ๋ณ€ํ™˜
์œตํ•ฉ(Fusion) Perceiver IO Modal ๊ฐ„ ์˜๋ฏธ ์ •๋ ฌ
์ถ”๋ก (LLM) LangGraph Node ์ถ”๋ก  + ์ž์—ฐ์–ด ์ƒ์„ฑ
RAG OpenSearch + pgvector ๋ฌธ์„œ ๊ทผ๊ฑฐ ๊ฒฐํ•ฉ
๋ฆฌํฌํŠธ DOCX Template ์ž๋™ ์ƒ์„ฑ ๋ฐ ์„œ๋ช… ์Šน์ธ

โ‘ฆ ์‹ค๋ฌด ํšจ๊ณผ

ํ•ญ๋ชฉ๊ธฐ์กด ๋ถ„์„๋ฉ€ํ‹ฐ๋ชจ๋‹ฌ Agentic AI
๋ฐ์ดํ„ฐ ์ข…๋ฅ˜ ์„ผ์„œ/๋ฌธ์„œ๋งŒ ์ด๋ฏธ์ง€·์„ผ์„œ·ํ…์ŠคํŠธ ํ†ตํ•ฉ
์›์ธ ๋ถ„์„ ์ •ํ™•๋„ 75~80% 95% ์ด์ƒ
๋ณด๊ณ ์„œ ์ƒ์„ฑ์‹œ๊ฐ„ 6์‹œ๊ฐ„ ์ˆ˜๋™ 10๋ถ„ ์ž๋™
์„ค๋ช… ๊ฐ€๋Šฅ์„ฑ ๋‚ฎ์Œ ์ด๋ฏธ์ง€+์ˆ˜์น˜+๋ฌธ์„œ ๊ทผ๊ฑฐ ์ œ์‹œ

โ‘ง ํ•œ๊ณ„ ๋ฐ ํ–ฅํ›„ ๊ณผ์ œ

  • ๋Œ€์šฉ๋Ÿ‰ ๋ฉ€ํ‹ฐ๋ชจ๋‹ฌ ๋ฐ์ดํ„ฐ ์ฒ˜๋ฆฌ ์‹œ GPU ๋น„์šฉ ์ฆ๊ฐ€.
  • Fusion Layer์˜ Alignment Drift → ์ •๊ธฐ ์žฌํ•™์Šต ํ•„์š”.
  • ์ด๋ฏธ์ง€/์„ผ์„œ ๋ฐ์ดํ„ฐ์˜ ๋ณด์•ˆ ๊ด€๋ฆฌ(Edge ์ „์ฒ˜๋ฆฌ, ์ต๋ช…ํ™”) ์ค‘์š”.

โ‘จ ํ‰๊ฐ€ ํฌ์ธํŠธ

  • ๋ฉ€ํ‹ฐ๋ชจ๋‹ฌ ์ž…๋ ฅ(๋น„์ „·์‹œ๊ณ„์—ด·ํ…์ŠคํŠธ)์„ ๋ชจ๋‘ ๊ตฌ์กฐ์ ์œผ๋กœ ๋‹ค๋ค˜๋Š”๊ฐ€
  • Fusion Layer์˜ ์—ญํ• ์„ ๊ตฌ์ฒด์ ์œผ๋กœ ์„ค๋ช…ํ–ˆ๋Š”๊ฐ€
  • RAG ๋ฐ Report-Agent ์—ฐ๊ฒฐ๊นŒ์ง€ ๋ช…์‹œํ–ˆ๋Š”๊ฐ€

โœ… ์š”์•ฝ ํ‚ค์›Œ๋“œ ํ•œ๋ˆˆ์— ๋ณด๊ธฐ

 
Multi-Agent ํ˜‘์—…  → Routing, Confidence ๊ธฐ๋ฐ˜ ๋ถ„๊ธฐ
Self-Eval Harness → ์ž๋™ Groundedness/Citation ํ‰๊ฐ€
Multimodal Fusion → Vision+Sensor+Text ์œตํ•ฉ ๋ณด๊ณ ์„œ ์ƒ์„ฑ
 
๋ฐ˜์‘ํ˜•

+ Recent posts