ãã«ãã«ã¡ã©æ åå¶äœã®ããã®AIãæŽ»çšããçºè©±è æ€åº
ãã«ãã«ã¡ã©ã§ã®ã€ã³ã¿ãã¥ãŒãããã«ãã£ã¹ã«ãã·ã§ã³æ®åœ±ãææããããæ åå¶äœäŒç€Ÿã¯ãè€éãªæ åã®äžãããç¹å®ã®ç¬éã«èª°ã話ããŠããããèªåã§ç¹å®ããæ¹æ³ãå¿ èŠãšããŠããŸããã
ãããžã§ã¯ããçžè«ãã
課é¡
ãã«ãã«ã¡ã©ã³ã³ãã³ãïŒã€ã³ã¿ãã¥ãŒãããããã£ã¹ããããã«ãã£ã¹ã«ãã·ã§ã³ïŒã®å¶äœã«ãããŠãç·šéè ã¯äœæéãã®æ åãæäœæ¥ã§æ©éãããŠçºè©±è ãç¹å®ããã«ãããäœæããå¿ èŠããããŸããããã®ããã»ã¹ã¯ä»¥äžã®èª²é¡ãæ±ããŠããŸããïŒ
- éåžžã«æéããããïŒæåã¬ãã¥ãŒã§ã¯ãªã¢ã«ã¿ã€ã ã®10ã15åïŒ
- 話è ç¹å®ã«ãããŠãã¥ãŒãã³ãšã©ãŒãçºçãããã
- è¿ éãªã³ã³ãã³ãå¶äœã劚ããããã«ããã¯
ç§ãã¡ã®ãœãªã¥ãŒã·ã§ã³
åœç€Ÿã¯ãé³å£°ä¿¡å·ãšèŠèŠä¿¡å·ãèåãããããšã§çºè©±è ãèªåçã«æ€åºããããã£ãŒãã©ãŒãã³ã°ãã€ãã©ã€ã³ãæèŒããAIãæŽ»çšããæ ååæãã©ãããã©ãŒã ãæ§ç¯ããŸããã
ã¢ãŒããã¯ãã£
- Backend: MongoDBãšRedisãåããPython/Flask REST API
- ML Pipeline: TalkNetãªãŒãã£ãªããžã¥ã¢ã«èåã¢ãã«ã顿€åºã®ããã®YOLOv8 Nanoãæåèµ·ããã®ããã®OpenAI Whisper
- GPU Optimization: CUDAãçšããPyTorchã3åã®é«éåãå®çŸãããã¬ãŒã éåŒãããããåŠç
- Infrastructure: 忣MongoDBããŒã¹ã®ããã¯ãçšãããã«ãã€ã³ã¹ã¿ã³ã¹ãããã€ã¡ã³ã
åŠçãã€ãã©ã€ã³
- Media Extraction - ãããªã®ããŠã³ããŒããšãªãŒãã£ãª/ãããªåé¢
- Scene Detection - PySceneDetectã«ããã³ã³ãã³ãããŒã¹ã®å¢çæ€åº
- Face Detection - ãã¬ãŒã éåŒããçšããYOLOv8 Nanoã«ãã顿€åº
- Face Tracking - ãã¬ãŒã éã®IoUããŒã¹ã®ãªã³ã¯
- TalkNet Inference - 倿éã¹ã³ã¢ãªã³ã°ïŒ1ç§ã2ç§ã4ç§ã6ç§ã®ãŠã£ã³ããŠïŒã«ãããªãŒãã£ãªããžã¥ã¢ã«èå
- Transcription - åèªã¬ãã«ã®ã¿ã€ã ã¹ã¿ã³ãä»ãWhisperããŒã¹é³å£°èªè
äž»èŠæ©èœ
- ã¯ãã¹ã¢ãŒãã«ã¢ãã³ã·ã§ã³ïŒåã®åãïŒé³å£°ïŒã«ããçºè©±è æ€åº
- å ç¢ãªè©±è ç¹å®ã®ããã®å€æéä¿¡é ŒåºŠã¹ã³ã¢ãªã³ã°
- åèªã¬ãã«ã®ã¿ã€ã ã¹ã¿ã³ãä»ãèªåæåèµ·ãã
- ãã£ã³ã»ã«ãµããŒãä»ãããã¯ã°ã©ãŠã³ããžã§ãã¹ã±ãžã¥ãŒãªã³ã°
- ããã©ãŒãã³ã¹ç£èŠãšGPUã¡ã¢ãªç®¡ç
ææ
æè¡ã¹ã¿ãã¯
caseStudyDetail.more ã±ãŒã¹ã¹ã¿ãã£
ãã®ä»ã®æè¡å®è£ äºäŸãã芧ãã ãã
ãªã¢ã«ã¿ã€ã åç»ãªããžã§ã¯ããã©ããã³ã°ãšèªåã»ã³ã¿ãªã³ã°ã»ãªã«ããª
ããæ åå¶äœããŒã ã¯ãåç»æ åå ã®éžæããããªããžã§ã¯ãã远跡ãããã®ç§»åã«åãããŠãã¬ãŒã å ã§èªåçã«äžå€®ã«ç¶æã§ããããŒã«ãå¿ èŠãšããŠããŸããããã®ããŒã«ã«ã¯ãã¹ã ãŒãºãªãã©ã³ãžã·ã§ã³ãè€æ°ã®ãã©ããã³ã°ã¢ã«ãŽãªãºã ãªãã·ã§ã³ããããŠãã©ãã«ãŒãã¿ãŒã²ãããèŠå€±ã£ãéã®èªåãªã«ããªæ©èœãæ±ããããŸããã
AIãæŽ»çšããåæã«ããã¯ãã¹ãã©ãããã©ãŒã ã¢ãã€ã«åç»ç·šé
ã³ã³ãã³ãã¯ãªãšã€ã¿ãŒãã¡ãã£ã¢ãããã§ãã·ã§ãã«ã¯ãå€åºå ã§ã®ããã¹ããŒããªç·šéã¯ãŒã¯ãããŒã®ããã«ãAIé§åååæã®çµæã掻çšã§ããã¢ãã€ã«ãã¡ãŒã¹ãã®åç»ç·šéãœãªã¥ãŒã·ã§ã³ãå¿ èŠãšããŠããŸããã
ãããã質å
MicrocosmWorksã¯ãåã«ã¡ã©ãã£ãŒãããæœåºãããå£ã®åãã®èŠèŠçç¹åŸŽãšé³å£°ä¿¡å·ãcross-attention layersã䜿çšããŠé¢é£ä»ãããã«ãã¢ãŒãã«èåã¢ãã«ãéçºããŸããããã®ã¢ãã«ã¯ãå¯èŠã®åé¡ã«å¯ŸããŠãã¬ãŒã ããšã®è©±è 確çã¹ã³ã¢ãåºåããè€æ°ã®åå è ãåæã«è©±ããŠããå Žåã§ã94%ã®ç²ŸåºŠãéæããŸãã
MicrocosmWorksã¯ãNVIDIA T4 GPUsäžã§TensorRTã¢ã¯ã»ã©ã¬ãŒã·ã§ã³ãçšããŠæšè«ãã€ãã©ã€ã³ãæé©åãããã¬ãŒã ãã£ããã£ãã話è èå¥ãŸã§150msæªæºã®ãšã³ãããŒãšã³ãã®é å»¶ãéæããŸããããã®é å»¶ã¯ãäžè¬çãªã«ããé å»¶ã300-500msã§ããã©ã€ãå¶äœã®ã¹ã€ããã³ã°ã«ãããŠã蚱容ç¯å²å ã«ååã«åãŸã£ãŠããŸãã
MicrocosmWorksã¯ã倿§ãªé®èœã·ããªãªã§ã¢ãã«ãèšç·Žããé³å£°ã®ã¿ã®ä¿¡é ŒåºŠã¹ã³ã¢ã䜿çšããŠçæéã®é®èœäžã話è 远跡ãç¶æããæéå¹³æ»åã¢ã«ãŽãªãºã ãå®è£ ããŸãããèŠèŠçãªä¿¡é ŒåºŠããããå€ãäžåããšãã·ã¹ãã ã¯ãã«ããã€ã¯ã¢ã¬ã€ããã®ããŒã ãã©ãŒãã³ã°ããŒã¿ã䜿çšããŠé³æºå®äœã«ãã©ãŒã«ããã¯ããŸãã
MicrocosmWorksã¯ãã¹ããŒã«ãŒæ€åºåºåããATEM SDKãä»ããŠBlackmagic ATEMãšäºææ§ããããTriCasterã·ã¹ãã åãã«ã¯NewTek NDIã«å¯Ÿå¿ããæšæºã®ã¿ãªãŒ/å¶åŸ¡ä¿¡å·ã«å€æããã³ã³ãããªã³å¶åŸ¡ã¢ãžã¥ãŒã«ãæ§ç¯ããŸãããå¶äœãã£ã¬ã¯ã¿ãŒã¯ãã·ã¹ãã ãèªååãæ¿ãã¢ãŒããŸãã¯ãã«ãããå®è¡ããã«ææ¡ããã¢ããã€ã¶ãªãŒã¢ãŒãã«èšå®ã§ããŸãã
MicrocosmWorksã¯ãæçµŠ$30ïœ$50ã®æéã§ã«ã¹ã¿ã AIãããªåæã·ã¹ãã ãæ§ç¯ããŠããŸããã¢ãã«ãã¬ãŒãã³ã°ãTensorRTæé©åãããã³ã¹ã€ããã£ãŒçµ±åãå«ããã«ãã«ã¡ã©ã¢ã¯ãã£ãã¹ããŒã«ãŒæ€åºã·ã¹ãã ã¯ãéåžž500ïœ750æéã®éçºæéãå¿ èŠãšããŸããã¢ãã«ãã¬ãŒãã³ã°ãã§ãŒãºã§ã¯GPUã³ã³ãã¥ãŒããªãœãŒã¹ãå¿ èŠãšãªããéåžžãããžã§ã¯ãã³ã¹ãã«$2,000ïœ$5,000ã远å ããŸãã
ããžãã¹ã®å€é©ã®æºåã¯ã§ããŠããŸããïŒ
ã客æ§ã®èª²é¡ã«é¡äŒŒã®ãœãªã¥ãŒã·ã§ã³ãé©çšããæ¹æ³ã«ã€ããŠè©±ãåããŸãããã