🔥 DeepSeek V4 Flash 0731 (HN 535⭐)
DeepSeek 发布 V4 Flash 版本,284B 总参数 / 13B 活跃参数,1M token 上下文窗口,MIT 开源协议。Artificial Analysis Intelligence Index 排名 #3/101,输入 $0.14/1M tokens,输出 $0.28/1M tokens,性价比极高。支持 Reasoning 模式,缓存命中价格仅 $0.003/1M tokens(排名 #1)。
🤖 qm — 多智能体协作框架 (HN 406⭐ · GitHub 2,171⭐)
"Multiplayer agent harness for work" — yc-software/qm 是一个多智能体协同工作框架,支持多个 Agent 并行协作完成任务,在 HN 和 GitHub 上同时引发大量关注。
💾 waste — 29GB RAM 运行 Kimi K3 (2.78T 参数) (HN 166⭐ · GitHub 323⭐)
sqliteai/waste 是一个无依赖、可嵌入的 C 推理引擎,通过从 NVMe 流式加载激活权重,突破内存限制,实现完整 Kimi K3 (2.78 万亿参数) 模型在仅 29GB RAM 上以 ~0.50 tok/s 的速度运行。这是本地运行超大模型的重要技术突破。
🔐 Tailscale 未能阻止 Hugging Face 入侵 (HN 390⭐)
Tailscale 官方发布针对 Hugging Face 安全入侵事件的深度复盘,分析了攻击路径、防御措施的局限性以及事后改进方案,对 AI 基础设施安全具有重要参考价值。
📜 二十五年前是密码学,今天是模型权重 (HN 114⭐)
Anuradha Weeraman 撰文对比 25 年前的密码学出口管制与当前 AI 模型权重管制。指出美国商务部已要求某 AI 实验室在允许外国人接触其最新模型前获取许可证——包括实验室自家在加州的外籍员工。
⚡ Predictive Speculative KV Replication (HN 32⭐)
JW Laboratory 提出预测性推测 KV 复制技术,针对突发流量场景优化 LLM 推理。GitHub: jwlaboratory/bite-the-bullet。
🗺️ 10GB RAM 处理十亿级图算法:DataFusion (HN 108⭐)
展示使用 Apache DataFusion 在仅 10GB RAM 下高效运行十亿规模图算法的实践经验。
📊 市场动态
今日市场数据源访问受限,未能获取有效股票/市场动态信息。