Search

Tag: #real-time-inference7 results

LLM 踏入自主拳擊擂台

LLM 踏入自主拳擊擂台

一名開發者建立自主拳擊基準測試,用於評估 LLM 在即時壓力下的決策速度、適應力、策略、視覺能力與工具呼叫可靠性。初步使用 Gemini Flash Live 的測試顯示,速度快且具備視覺能力的模型能夠閃避及反擊,而較慢的本地模型可能需要時間縮放機制。

Reddit r/MachineLearningCommunityAug 3#embodied-agents#real-time-inference#agent-benchmarking