diff --git a/docs/content/zh-Hans/blog/DevLog-2025.08.26/assets/airi-factorio-yolo-v0-playground-vnc.mp4 b/docs/content/zh-Hans/blog/DevLog-2025.08.26/assets/airi-factorio-yolo-v0-playground-vnc.mp4 new file mode 100644 index 000000000..ba5dcd407 Binary files /dev/null and b/docs/content/zh-Hans/blog/DevLog-2025.08.26/assets/airi-factorio-yolo-v0-playground-vnc.mp4 differ diff --git a/docs/content/zh-Hans/blog/DevLog-2025.08.26/assets/factorio-ultralytics-hub-preview.jpg b/docs/content/zh-Hans/blog/DevLog-2025.08.26/assets/factorio-ultralytics-hub-preview.jpg new file mode 100644 index 000000000..d19101a6e Binary files /dev/null and b/docs/content/zh-Hans/blog/DevLog-2025.08.26/assets/factorio-ultralytics-hub-preview.jpg differ diff --git a/docs/content/zh-Hans/blog/DevLog-2025.08.26/index.md b/docs/content/zh-Hans/blog/DevLog-2025.08.26/index.md new file mode 100644 index 000000000..b117e1962 --- /dev/null +++ b/docs/content/zh-Hans/blog/DevLog-2025.08.26/index.md @@ -0,0 +1,189 @@ +--- +title: DevLog @ 2025.08.26 +category: DevLog +date: 2025-08-26 +excerpt: | + 和大家分享 `airi-factorio` 纯视觉方向的一些进展,凝固一下思维,免得挥发了。 +preview-cover: +# TODO +--- + +大家好久不见,我是 [@LemonNeko](https://github.com/LemonNekoGH),AIRI 的维护者之一。~~啊,有点厌倦这样开场了,像 LLM 一样。~~ + +我的上一篇 [DevLog](../DevLog-2025.07.18/index.md) 中提到,我浅浅地看了一下 [Factorio Learning Environment](https://arxiv.org/abs/2503.09617) 论文,并且简单说了一下我们打算如何改进 `airi-factorio`,但是...今天想和大家分享的并不是这个,而是关于纯视觉方向的进展。 + +在今年六月的时候,[@nekomeowww](https://github.com/nekomeowww) 发布了一个几乎实时的 [VLM Playground](https://huggingface.co/spaces/moeru-ai/smolvlm-realtime-webgpu-vue) HuggingFace Spaces,感觉非常的酷,所以我打算先试一下简单的实时图像识别(当时我还把目标检测和图像识别弄混),然后以某种方式交给 AI 去做决策,最后以某种方式输出动作给游戏去执行。 + +先给大家看一下成果: + +