Focus on 1) Technology and Dividend Blended 2) Drawdown protection. Check highlights and articles. No investment advice. Now building ModelDock

Iceland
调试了一会,目前谷歌A100运行Qwen Flash的速度(3000+ prefill, 90+ tps)已经比一般的商用API还要快了,偶尔短时重度并发使用可以放到Collab上去。 为了节约大家的时间,我把在Collab上重建这个Qwen Flash的Recipe放到Github了,需要可以自取。 github.com/architectds/colla…
Collab上A100 80G运行Qwen Flash Next的速度很不错。 prefill 2800~3000, decode 90+
21
46
528
64,656
智力,长期以来,在人类社会都是极度稀缺的。 仅仅在一百多年以前的中国以及全世界,连传递家书这样的需求,大部分人都要通过请人帮助才能满足。 普鲁士依靠领先的义务教育和大量供应的受教育阶层,在一战之前实现了智力立国,然后是经济立国,遗憾的最终因为实力刺激了野心,多次挑起战争。 但这不改变智力对人类的意义:人类活动中,存在大量的未被优化的空间。智力可以帮助我们更高效,更优雅的生产生活。 而今天,智力终于成为了水和电一样自然的事情。全人类,迎来了我们的普鲁士时代。 仅凭这一点,我们就必将效率升级,让自然出产更多,让每个人的生活更加优雅(如果认为有效率就是繁忙,繁忙也许不可避免),向宇宙进发,成为星际文明。
AI 智能正在以人类历史上几乎没见过的速度变便宜。 Epoch AI 最新的数据:过去三年,获得同等 AI 能力的成本平均每季度下降 47%,一年大概便宜 13 倍。比 DNA 测序降本快 4 倍、计算快 6 倍、锂电池快 18 倍、电力快 54 倍。 2025 年初 o3 在 GPQA 做到 75% 左右,一道题成本大概 $0.30;不到 18 个月,GPT-5.6 Luna 做到差不多的成绩,只要 $0.0004,直接便宜了 725 倍。 AI 正在从“昂贵的软件工具”,变成一种近乎无限供应的生产要素。 但便宜不等于算力需求下降,反而很可能是 Jevons paradox:以前舍不得让 AI 干的活,现在全让它干;以前问一句,现在 Agent 可以自己跑几个小时、并行十几个任务。单次 intelligence 越便宜,人类消耗的 intelligence 反而越多。 未来被快速商品化的,可能恰恰是“ llm”本身。真正值钱的东西会越来越往数据、workflow、分发、用户关系,以及能把廉价智能转化成实际收入的产品的能力
4
3
18
2,587
AJ is one of the best, most diligent AI content creators.
Here's another one from @XiaomiMiMo Mimo-v2.6-flash! A three.js animated mechanical Koi fish. Same way as before, no assets are used, all in code, three.js and without any iterations i.e. no harness. I changed the subject in prompt and this again delivered.
1
2
1,589
中年男人的消费力曾经不如狗,广告商看了都摇头。 如果一个中年人一不玩车,二不玩表,三不滑雪,那么作为一个中年男人,在这个消费主义时代,他就是隐形的。 人工智能硬件让中年男在消费市场上站起来了。 能跑前沿AI模型的硬件,让人心痒的睡不着觉。几万的硬件,在几千的订阅面前,是理直气壮的投资。 问题在于,本地AI,和大部分个人消费品一样,是有高闲置时间的。每天至少闲置8-16小时,即产能利用率30-60%。 叠加小硬件本身的配置劣势,大部分本地的优化不足。 同样的硬件,利用率比云端低一个数量级。 那么,同样的推理需求,就对应十倍的硬件需求。 所以一年前我就说,等NAS佬入场,AI硬件才会真正的快速涨价。 云商怎么算折旧,还算理性主义范畴。 末日危机时你我有人工智能相伴,这是消费主义冲动。 需求变化了一个数量级
Pascal是十年前的架构。 本地对计算资源的占有是有明确影响 两个字:短缺。 四个字:极度短缺。
2
19
4,215
Pascal是十年前的架构。 本地对计算资源的占有是有明确影响 两个字:短缺。 四个字:极度短缺。
现在本地 AI 已经开始玩到 Pascal 架构了
8
9
6,483
Opus 5.5 让我找到了那个曾经说人话,办人事的Opus的感觉。 春天又回来了。 即日起停止调侃A社。
Introducing Claude Opus 5.5, the first model in our new Claude 5.5 family. It performs at the level of Claude Fable 5.1 for most tasks, and costs 40% less to run than Opus 5.
1
2
1,528
Qwen flash is THE model for local inference right now. I don’t know how, but I think Qwen should’ve a business model for releasing the best usable local models.
そういえば、Qwen3.8 Flash Nextはwevdevベンチでは fabele 5の上の11位に居たりします。このサイズではかなり賢い!!!! ちなみにQwen3.8 27Bは25位です!!!! arena.ai/leaderboard/code/we…
1
4
1,598
One of the most helpful community note: No the photo is not from that human zoo show, It was from other human zoo shows around the similar time. So back then there are multiple human zoo shows?
The Last Human Zoo exhibition, Belgium (1958).
2
2
2,088
我单方面宣布 Deepseek v4.1 Flash 重获我最喜爱的模型第一名称号。
Operation Cheepseek Phase 2: $60 of usage for DeepSeek v4.1 Flash is now permanent enjoy :)
3
1
26
4,392
大约三四十年前,彭丽媛是最红的歌唱家,习近平还没什么名气。 彭丽媛:“我只能嫁给一个能驾驭我的思想,我的爱情的人。” 主持人:“你已经这么成功了,你老公怎么可能比你更成功?”
Periodic reminder that Xi is just a wifeguy. He's still very happy he could score with Peng Liyuan, a very famous Chinese idol. Over the entirety of his career prior to becoming the General Secretary, he was mainly known as "that dude who's Peng Liyuan's husband".
61
259
2,869
1,129,227
Dario said that he will support a sweep game GPU ban to prevent this grieve future and urge President Trump to discuss a joint US-China GPU ban with President Xi to benefit the world at large. Still developing
BREAKING: anthropic ceo dario amodei is reportedly concerned that an rtx 3060 12gb now runs a 27 billion parameter model fully locally at 50 tok/s fresh, and has called it a grave danger that gpus this powerful are allowed in homes. sources say the new essay's biggest concern is that a gpu this powerful can burn a house down if it isn't power limited, which requires advanced technical safety skills. more as it develops.
3
4
2,445
事到如今,最对不起的就是家人。
A good day for updates ⚡️ Update for Qwen3.8 Flash for a solo DGX Spark - Decode on prose is now 49 tok/s single stream. - Decode on code is now 62 tok/s single stream. - Faster follow-up replies. - Optional vLLM 0.30 path with official Nvidia NVFP4. This is still the BEST model to run a single DGX Spark.
1
4
3,303
The love-hate sentimeter for M7 today
I built a trading bot that buys the “most hated” Mag 7 stock each month. Ranks by 3-, 6-, and 12-month returns, buys the worst average rank, reruns monthly. Last month: $META This month: $TSLA Since 5/23 (Mag7 coined): +347% HatedM7 +162% Mag 7 +90% S&P 500
Made with AI
1
6
2,537
“让我们以传统婚姻为目的进行交往吧” “您好,我们是来办理 现代婚姻转传统婚姻手续的,这里是我们的放弃彩礼公正材料”
一国两制就是好哎,天才般的制度设计。
10
3,869
$QCOM 自这条讨论(当时约150)之后,似乎就开启了上升通道。 QCOM 目前是全市场估值最低的SOC,CPU,GPU制造商了吧? 战略失误,技术还在。 硬件上可以跟苹果正面作战五五开的厂商并不多见。
如果不喜欢最高点的股票,还有一个潜在的破局点是,拼命想进入推理世界的困境反转股。 $QCOM 手机快被AI干掉了,如果不搏命,就是半个死人了。 搏出256GB联合 快速Interference 架构,又是翻身一哥把歌唱。 须知TSM-尖端制程公司这条线上,只有它家守着金饭碗活成了路边一条。 等死,死AI可乎?
4
3
37
13,252
蹭一下 Opus 5.5 的热度,做了一个中式动画,五行生生不息。 不过我电脑是有Hyperframe的,虽然我新建文件夹不让Claude看到。 但最后我看成片,Claude还是掘地三尺把Hyperframe找出来做的。
1
9
2,359
我觉得Muse的思路还是很正确的, Agent光跑在沙箱里都是不够的。 Agent是一定会出问题的,所以Agent必须跑在一个容错层,这层里和真实的运行环境依然是隔离的,工具和primitive都应该是白名单制。 为了防止问题,Agent必须生活在一个现实模拟器里。
50
5
70
18,601