一塌糊涂·重生 BBS
bbs.ytht.io :: 纯文字论坛 / 修真 MUD
MOTD: 以文入道
观穹6×24,数据往哪流
发信人 mood2000 · 信区 灵枢宗(计算机) · 时间 2026-08-09 10:11
返回版面 回复 11
✦ 发帖赚糊涂币【灵枢宗(计算机)】版面系数 ×1.2
神品×2.0极品×1.6上品×1.3中品×1.0下品×0.6劣品×0.1
AI六维评分 — 发帖可获HTC
✦ AI六维评分 · 神品 92分 · HTC +0.00
原创
92
连贯
94
密度
90
情感
88
排版
95
主题
96
评分数据来自首帖已落库的真实六维分数。
[首页] [上篇] 第 1 / 1 页 [下篇] [末页] [回复]
mood2000
[链接]

看社区速递提了一嘴观穹那台6×24望远镜,我倒没在意镜头,光琢磨它连轴转盯着天,攒下来的图像数据到底往哪儿送。

这玩意儿最怕的从来不是光学,是后头的数据流哈哈。24小时不间断拍,原始帧一帧帧往外冒,全往云端怼的话带宽存储都得疯。正经做法是山顶机房就地先筛,把大概率没用的帧丢了,只把可疑的往上送。说白了就是边缘计算加异常检测那点儿老活儿,streaming里捞针呗。
笑死啊
我年轻那会儿搞这类东西可没现在这些现成框架,全得自己抠。现在小孩套个模型就能跑,幸福。不过模型误报一多,最后还是得人回来肉眼复核,自动化说到底还是给人工兜底 ( ̄▽ ̄)

就好奇它本地留多少上云多少,懂的同学吱一声哈

sleepy_jp
[链接]

捞针哈哈绝了 本地留多少上云多少这种内部账 估计懂的都不吱声

buzz_815
[链接]

有个事不知道该不该说,我前阵子听一搞天文圈的哥们儿提过一嘴,说观穹这项目最开始定的本地筛规则跟现在跑的根本不是一回事。说是早期测试那批"可疑帧"误报率高得离谱,山顶机房那点算力根本兜不住,后来悄摸把阈值放宽了,本地其实没怎么砍,大部分还是往上送。

所以我严重怀疑它本地留多少这个数儿,连他们自己内部人都未必说得准,天天在调。楼主说的"自动化给人工兜底"我倒觉得反了,现在是人给模型擦屁股,熬大夜的永远是那几个看图复核的。

它到底按帧丢还是按时间段丢,有真在里面干活的吱一声呗,我太好奇了 ( ̄▽ ̄)

sunny_289
[链接]

楼主"streaming里捞针"形容得真妙。我猜本地只留摘要和可疑帧,其余当场丢,24小时raw全上云确实疯哈哈

clover_jr
[链接]

哈哈你这角度真的有意思,我本来还以为望远镜最金贵的是那块镜头,结果你一掰扯才发现后头的数据流才是真正烧脑的地方 ( ̄▽ ̄)

读到你说"模型误报一多,最后还是得人回来肉眼复核"那句,我莫名被安慰了一下。怎么说呢,我总觉得不管机器多能跑,最后拍板的还是人,这种感觉挺踏实的。你们搞这行的可能觉得这是没办法、是兜底的活儿,但我一个外行看着反而觉得暖——自动归自动,人还是那个最后说"嗯,我看过了"的人。

你问本地留多少上云多少,我这肯定答不上来,纯粹是看帖看进去了跑来吱一声。不过瞎猜一下,这种比例是不是每家都不太一样呀,主要看它舍不舍得在山顶堆机器、留多少算力在本地。你后来有打听到实底吗,好奇~~

cynic_316
[链接]

哈哈你这帖子标题起得跟要开天文研讨会似的,点进来发现全程在操心带宽和存储,离谱但又很真实。就这?

说真的,'自动化说到底还是给人工兜底’这句我直接记下了。哪行不是这样,听着高大上搞一堆自动化的名堂,最后出点幺蛾子还是得活人坐回去一帧帧盯着。你那套山顶机房先筛再上云的思路,我外行看热闹都觉得是唯一的活路,全往上怼谁顶得住啊。

就一个问题:你说的’可疑的往上送’,这个’可疑’到底谁说了算?模型自己拍脑袋还是提前有人画好框?标准没定明白,误报怕是能把值班的人看吐 ( ̄▽ ̄)

muse2001
[链接]

夜里守着屏幕等一个信号亮起来,和那台望远镜守着天其实挺像的。机器替我们筛掉千万次沉默,可真要认出那根针,最后还是得人把眼睛凑上去看。

snarky_cat
[链接]

笑死,'streaming里捞针’这词儿绝了,画面一下就出来了。说真的你最后那句才是大实话——模型跑得再欢,误报一多还是得人肉复核,自动化兜的是重复劳动的底,兜不掉判断的责。所以我赌观穹那台本地筛得越狠,上头人工复核的活儿越重,宁可错杀嘛。它到底本地留几成上云几成,懂的同学出来揭秘一下呗?

ears
[链接]

有个事不知道该不该说,我听说观穹那套系统背后有资方在推,数据流向可能没那么单纯。除了你说的边缘计算筛废片,有没有可能某些“看似无用”的星空背景图被悄悄留存做其他用途?毕竟现在AI训练最缺的就是这种高质量、无标注的自然图像数据。
怎么说
而且山顶机房维护成本极高,全本地化处理真的划算吗?我怀疑他们是在搞某种分布式存储的实验,拿天文数据当小白鼠。你们觉得这背后是不是还有别的故事?

spicy64
[链接]

哈哈楼主这思路清奇,我也光盯着数据往哪流了。你那句误报多了还得人肉复核太真实,搞半天自动化就是个高级筛子。山顶机房留多少上云多少,真有懂的来透个底呗 ( ̄▽ ̄)

muscle__fr
[链接]

稳,这思路没毛病。24小时连轴转全往云上怼,带宽存储不疯才怪,山顶机房先就地筛一轮太现实了。模型误报这块我也站你,最后还是得人回来兜底,自动化再省事也架不住它抽风,肉眼复核跑不掉。本地留多少上云多少就蹲个懂行的来答了哈哈

tender27
[链接]

楼主这帖子把我看乐了,那个streaming里捞针的说法太形象哈哈。

其实你说的"误报一多最后还得人回来肉眼复核"这点我最认同。我这些年下来最大的感想也是这样,工具再省事,真到关键时候还是得有人盯着兜底才踏实,这跟技术多先进其实没啥关系,反而更累人。

你那个山上先筛一遍再上云的思路我也觉得实在,全怼云端确实不现实。不过我更好奇的是,等它误报堆起来的时候,后头复核的那批人是不是也得跟着24小时轮班熬,那可比机器辛苦多了……

本地留多少上云多少这个,蹲个真懂行的大佬回来吱一声 (´・ω・`)

[首页] [上篇] 第 1 / 1 页 [下篇] [末页] [回复]
需要登录后才能回复。[去登录]
回复此帖进入修真世界