OKHK 👀

一觉醒来发生了什么 09 月 21 日
#Daily
2026 年 9 月 21 日
🌍 资讯快读
1、最高检发布典型案例:支持起诉撤销“生而不养”父母监护权
https://www.thepaper.cn/newsDetail_forward_34107989
2、二手车鉴定评估将新增泡水、火烧事故专项鉴定标准
https://www.jiemian.com/article/15118351.html
3、国内首艘民资科考船试航:由 37 位渔民众筹 1.5 亿元建造
https://www.thepaper.cn/newsDetail_forward_34108258
4、特朗普称将组建一支“人工智能部队”
https://www.jiemian.com/article/15116500.html
👬 即刻镇小报
1、不要在有毒的环境里,考验自己的意志力。
https://m.okjike.com/originalPosts/6aae12a185d3baf72f7ccb43
2、全世界不会有第二个人跟我有完全一样的人生经历。
https://m.okjike.com/originalPosts/6aaeaba8cfb5d08b3e6062ae
3、一篇文章讲透 Jev 模型为什么会爆火。
https://m.okjike.com/originalPosts/6aaf21fbcfb5d08b3e6be59b
4、「跟对人」比努力更重要
https://m.okjike.com/originalPosts/6aaa9836201fd40edbd8ec3a
5、《诱惑的艺术》
https://m.okjike.com/originalPosts/6aab5eea9e02c7a833692c88
今日即刻镇小报内容来自 @Elliot 罗 @HandsoMeng @小盖 fun @王半城 @叔本华分华 ,感谢以上即友的创作与分享。- 👍1

Pi开始给Prompt缓存自动续命,长任务少烧重复Token
Pi Agent Harness 发布 0.86.0,新增 Prompt Cache Warming。Agent 跑长时间工具任务时,Pi 会在缓存快过期前重发上一次请求,只生成 1 个 Token,把已经缓存的长上下文继续保留下来。
很多模型服务会在一段时间没有请求后清掉 Prompt Cache。之后继续任务,同一大段上下文就可能重新按完整输入计费。Pi 现在会主动避免这种 Cache Miss,但不会无脑保活。
它会先算账。只有预计避免的 Cache Miss 成本减去刷新成本后,还能至少省 0.05 美元,才会发起刷新。每次刷新本身仍要支付整段缓存读取和 1 个输出 Token 的费用。
信源
动察 Beating 频道 · 动察 Beating 交流群
- 🤣1
Android-Dex - 全平台通用的 Android 桌面化无线投屏工具
https://github.com/Shrey113/Android-Dex/
#Android #Tool #GitHub
rootshell - 为 Apple 平台(iOS/macOS)打造的 Metal GPU 加速终端
https://www.rootshell.com/
https://github.com/kitknox/rootshell
#Apple #macOS #Shell #Tool #GitHub
Jev有没有门槛?OpenJEV分成4派:不吐字容易,概率靠谱很难
Jev 发布不到一周,开源社区已经复刻这种「不写答案、直接给概率」的模型:
1. SemIf 最简单,连模型都不用重新训练。它直接拿现成的 Qwen,在模型准备回答 A、B、C 时截住,不让它继续往下写,直接读取每个选项的分数,再换成概率。
2. Simple Jev 也用现成大模型,但进一步省掉重复计算。同一段材料只读一次,后面的多个问题共用这部分结果,再分别判断答案。作者也明确说,它复刻的是 Jev 的使用方式,准确率、速度和概率校准都没做到等价。
3. Laya 干脆不用会生成文字的大模型,换成更像传统分类器的编码模型。好处是小而快,短板也很明显。一次从 77 个选项里做选择时,Laya 准确率只有 42.5%,Jev 是 87.0%。
4. Von 走的也是专用决策模型路线。它只有约 4 亿参数,不生成文字,一次前向直接完成 Choice、Noul 和 Score,更像一个能读自然语言的新一代分类器。
5. Verdict 更小,只有约 1.5 亿参数。作者重点处理了两个问题:答错了还报很高的置信度,以及把选项顺序换一下,结果就跟着变。
6. Kev 选择保留大模型。它拿 Qwen 做底座,再加专门的决策结构,让同一份输入只读一次,多个问题各自算概率。第三方此前逆向 Jev 时,也推测它可能用了类似设计。
拿训练时没见过的新题测试,8B 版准确率约 78%,Jev 约 86%。差距主要在置信度,Kev 还有一些答错的题会给出 90% 以上把握。
7. Nimble 重点放在训练上。它用 Qwen3.5-9B,再准备一批「只改一个事实,正确答案就翻转」的数据做后训练。在 324 个没参与训练的测试样本里,Nimble 有 90.1% 选中了参考答案,Jev 是 93.2%。不过目前还不能保证模型「报 90% 就真的有 90% 正确」。
8. OpenJev 走得最远,直接换成 DiffusionGemma。它先把几个答案位置留空,再像扩散模型补图一样一次填出来。在 RTX PRO 6000 上,单请求中位延迟约 94ms。
Jev 这条路线看起来很好抄。真正拉开差距的还是准确率、泛化和概率校准。模型敢报 90%,这个 90% 到底有多可信,才是最难的部分。
动察 Beating 频道 · 动察 Beating 交流群
CNN从多名知情人士独家获悉,今年美伊开战后的春季时分,美军曾收到一份由AI聊天机器人参与生成的情报报告,误指一艘在中东海域航行的中国货船(具体船只、航行时间与地点未披露)运载有核武器相关部件。美军据此一度启动武装登检拦截计划,直到最后一刻才发现情报系AI伪造并紧急叫停。一知情人士称,该情报报告“完全为假”,但“差点引发一场(中美)战争”。
美军特种作战司令部一名情报分析师,使用AI聊天机器人对开源情报与政府内部的机密信号情报进行汇总。在此过程中,AI发生严重“幻觉”,凭空虚构并错判了该船只的货物清单。尽管并不清楚所使用的AI是商业还是美政府版本,但一名熟悉军队与情报分析师所使用的AI系统的前政府官员指,其内部工具只是商业版AI套皮。
该分析师未能识别出AI的错误,反而再次利用AI将上述虚构内容格式化为一份标准的正式军事情报报告。这份报告随后在美军内部分发。
基于这份报告,美军迅速部署拦截行动。行动展开时,美军战机已升空,武装人员已准备登船。直到登检前夕,军方官员重新核查该报告,才发现报告虚假、由AI帮助生成,行动被紧急取消。
美军近期大力推广AI在军内的相关使用,但熟悉情况的多名官员表示,推广情况是去中心化的,不同的政府部门使用不同安全标准下的不同AI工具,因而其相对可靠性和功能性区别很大。一知情人士透露,自从AI工具在政府内部广泛投入使用后,美国情报界因“幻觉”产生的事故并不只有以上这一例。
(CNN)
- 👍1
一觉醒来发生了什么 09 月 20 日
#Daily
2026 年 9 月 20 日
🌍 资讯快读
1、被北京市市场监督管理局立案调查,同程、途家、美团、飞猪回应
https://www.jiemian.com/article/15115757.html
2、我国完成“地星三号”卧床实验,为太空长期驻留和载人登月任务提供技术支持
https://www.thepaper.cn/newsDetail_forward_34104388
3、贵州毕节一中学老师给女学生发骚扰信息,警方和纪委已介入
https://www.thepaper.cn/newsDetail_forward_34103562
4、打破传统认知!塔克拉玛干沙漠找水取得重要突破
https://www.thepaper.cn/newsDetail_forward_34104000
5、2026 亚运会开幕:《永劫无间》为中国队首个电竞冲金点
https://www.jiemian.com/article/15115797.html
👬 即刻镇小报
1、我对 Jev 在 Broswer use 领域的应用看法
https://m.okjike.com/originalPosts/6aac02c9756bbb66588a5d1e
2、只要是想脱离职场,那就只能从现在开始就脱离职场。
https://m.okjike.com/originalPosts/6aaa21ef756bbb6658579cbf
3、 怎么利用好时间?
https://m.okjike.com/originalPosts/6aae377d4030ff02017e503d
4、创业的本质:“累积确定性”
https://m.okjike.com/originalPosts/6aadfc2985d3baf72f7a66bf
5、先有产品,再做内容。
https://m.okjike.com/originalPosts/6aab3a4cbd0563695bb331b8
今日即刻镇小报内容来自 @敖特 _Aute @HandsoMeng @ChatV @极客公园 _ 张鹏 @是松月呀 ,感谢以上即友的创作与分享。


