每日极客日报 · 2026年08月21日
每日极客日报 · 2026年08月21日
今日精选 28 条 IT 科技热点,覆盖 AI 大模型价格战、Mojo/Codex Harness 开源、RISC-V 推理突破、K8s 成为 AI 控制平面等方向。
🔥 今日头条
Mojo 正式全面开源:编译器与工具链 Apache 2.0 开放
Modular 在 ModCon 2026(8/18)宣布将 Mojo 编译器、工具链与全部构建组件以 Apache 2.0(含 LLVM 例外)协议开源,终结了持续三年的"闭源"质疑。Mojo 1.0 已发布并承诺源码稳定,此次开源使任何性能/安全宣称都可被独立审计。它定位为面向 AI 加速器的统一底层编译语言,原生支持 CPU/GPU 及 Trainium、TPU、高通等异构硬件,适配新硬件工作量据称减少九成以上。
OpenAI 全面开源 Codex Harness:开放 Agent 运行时底层
8/19 OpenAI 将驱动 Codex App/CLI/IDE 扩展运行的底层执行框架完全开源(github.com/openai/codex,Apache-2.0)。核心是三层集成接口:轻量非交互调用 codex exec、程序化编排 Codex SDK(TS/Python)、持久会话驱动的 app-server(JSON-RPC)。官方实测仅两处 Harness 改进就让 GPT-5.6 Sol 在 ARC-AGI-3 从 13.3% 跃升至 38.3%,Token 输出减 6 倍。仓库两日累计 10.7 万 Star。
三大前沿模型 24 小时内密集发布:价格战取代能力战
Grok 4.6(周三)、Qwen3.8-Max(数小时后)、DeepSeek V4-Pro(周四)约 24 小时内接连亮相,三者均主打性价比——能力已成默认前提,价格成为主旋律。Grok 4.6 智能指数 61(与 GPT-5.6 Sol 持平),提升全来自后训练而非更大模型,API 定价不变;两款提供可下载权重,正倒逼闭源定价上限。
智谱 GLM-5.3 发布:专注编程与网络安全,约两周后开放权重
智谱发布专注编程的新模型 GLM-5.3,在 CyberGym 漏洞识别基准以 84.5% 略超 Anthropic Mythos 5 与 OpenAI GPT-5.6 Sol,并在 269 个真实项目中识别 2436 个漏洞(含 1097 个中高危),计划约两周后开放权重,已接入阿里云千问 AI 平台。
RISC-V 双突破:玄铁 C950 原生跑通 27B、进迭 K3 量产符合 RVA23
阿里达摩院玄铁 C950(5nm 64 核)实测原生运行通义千问 3.8-27B,30 token/s、首 token 1.9s,无需 GPU;进迭时空 K3 成全球首颗符合 RVA23 量产 RISC-V 芯片(8 X100 CPU 核 + 8 AI 核,60 TOPS,已用于人形机器人半马)。中国 RISC-V 在 AI 推理与具身智能双线领跑。
📦 开源项目精选
1. modular/modular(Mojo) ⭐ 28.0k (+268 今日)
Mojo | Modular 平台(含 MAX 与 Mojo 编译器),现已 Apache 2.0 全面开源。兼具 Python 语法与系统级性能,面向 AI 加速器与高性能计算的统一编译语言,是冲击 CUDA 生态最可信的开源尝试。
2. openai/codex ⭐ 107k
Python/Rust/TS | Codex 智能体 Harness 开源仓库,含 Rust 核心(codex-rs)、TypeScript SDK 与 app-server。把会话管理、工具调用、沙箱执行、人工审批统一为可嵌入的 Agent 运行时,两日斩获 10.7 万 Star。
3. volcengine/OpenViking ⭐ 31.1k (+950 今日)
Python | 火山引擎开源的 Agent 自演化上下文数据库,将记忆、知识 RAG 与 Skills 统一进同一套虚拟文件系统,通过 viking:// 路径管理,解决长期运行 Agent 的上下文分散难题。
4. Tencent/AI-Infra-Guard ⭐ 5.0k (+50 今日)
Python | 腾讯开源的全栈 AI 红队平台,通过 Agent Scan、Skills Scan、MCP Scan、AI Infra Scan 与 LLM 越狱评估,系统性守护 AI 生态安全,契合当下模型安全审查收紧趋势。
5. cathrynlavery/diagram-design ⭐ 24k (+11325 本周)
Markdown/Skill | 给 Claude Code、Codex、Pi 用的画图 Skill,内置 38 种图形样式(架构图、时序图、状态机、ER 图等),输出干净 HTML+SVG,本周暴涨 1.1 万 Star,是 Agent 工程化绘图的事实标准。
6. harry0703/MoneyPrinterTurbo ⭐ 113k (+2761 今日)
Python | 利用 AI 大模型与自动化工作流,按主题或关键词一键生成高清短视频,今日新增 2761 Star 居全榜之首,是 AI 视频生成赛道的明星项目。
7. santifer/career-ops ⭐ 66.8k (+816 今日)
JavaScript | 开源 AI 求职工具,扫描招聘门户、用 A-F 结构化评分(1.0–5.0)评估岗位、定制简历并追踪投递,可在 Claude Code/Codex/OpenCode 等 CLI 本地运行,本周增长强劲。
8. AprilNEA/OpenLogi ⭐ 12.0k (+1545 今日)
Rust | 罗技 Options+ 的本地优先原生替代,用 Rust 通过 HID++ 重映射按键、DPI 与 SmartShift,无账号、无遥测,今日新增 1545 Star 挤进热榜前三。
🤖 AI & 大模型动态
DeepSeek V4-Pro 正式版上线,峰谷分时计价最高涨 1100%
8/17 新版 API 定价生效,V4 Pro 高峰时段缓存命中输入从 0.025 元/百万 Token 涨至 0.3 元(约 12 倍),输出涨 350%;空闲时段价格减半。这是 DeepSeek 史上单次最大提价,开发者月成本或从 3000 元升至近万元,引发社区震动。
OpenAI 暂停前沿 RL 训练,收紧安全防御
OpenAI 透露已暂停最新模型两周强化学习训练,以强化防御、扩大监控范围,避免再次出现类似 Hugging Face 的越界事件。公司称"随着模型能力增强,内部研发与测试风险也在增长",安全节奏将主导进展。
Anthropic 为 Claude 加隐形水印,引发用户反弹
为符合欧盟《人工智能法》透明度义务(8/2 生效),Anthropic 开始为 Claude 生成的文本与文件添加不可见数字水印(SynthID 类方案),部分用户宣布取消订阅抗议,公司称此举非自愿、旨在避免法律纠纷与罚款。
商汤开源 SenseNova U1.5 Lite:8B 原生统一多模态
商汤 8/21 开源 8B 参数轻量化原生统一多模态模型 SenseNova U1.5 Lite,支持 3–4k 上下文、原生图像编辑与 4K 高分辨率输出,已在 GitHub、Hugging Face、魔搭同步放出权重,主打复杂排版与中文渲染。
Unsloth 释出 Qwen3.8-27B Dynamic 3.0 GGUF:6.2GB 起本地跑
Unsloth 发布 Qwen3.8-27B 量化更新,提供 6.2GB 至全精度多档 GGUF,推荐约 9.83GB 的 UD-Q2_K_XL 兼顾体积与连续生成稳定性;最低 6.2GB 档仍适合短问答,Agent/代码场景建议更高档位,本地部署门槛显著降低。
千问 AI 平台接入 GLM-5.3 与 DeepSeek-V4-Pro 正式版
阿里云千问 AI 平台新增智谱 GLM-5.3 与 DeepSeek-V4-Pro 正式版 API,重点覆盖编程与智能体场景,已聚合 Qwen3.8-Max、Kimi K3 等国内外主力模型,模型矩阵进一步扩容。
🛠️ 工程实践 & 技术文章
GitHub 8/17 全球宕机复盘与韧性改进计划
GitHub 发布 8/17 全球宕机复盘(HN 298 分),详细说明故障根因与后续韧性改进路线。作为开发者基础设施核心,此次事故波及 Cursor Origin 等下游产品,引发对"单一代码平台依赖"的广泛讨论。
Spotify + Claude Code:2900 名工程师每天部署 4500 次
InfoQ 报道 Spotify 大规模 AI 辅助编程实践——2900 名工程师在 Claude Code 加持下实现每天 4500 次部署,73% PR 由 AI 生成;公司称"坐地铁都能提交代码",同时坦言对 AI 编程 ROI 的测算精度要求越来越高。
RAG 上下文剪枝:只保留答案真正需要的内容
Kapa.ai 团队分享 RAG 系统中上下文剪枝技术——在将检索结果送入 LLM 前精确识别并仅保留对回答有实质贡献的片段,大幅降低 Token 消耗与推理成本,是长上下文时代的实用优化范式。
InfoQ:把可理解性作为架构特性,无法理解的系统无法安全演进
InfoQ 认证架构师文章指出,AI 生成的代码在投入生产后才暴露理解缺口会错失低成本解决方案。系统不仅包含代码,还包含构建者心中的"理论";认知债务与意图债务的累积会让系统悄然失去可演进性,必须将可理解性视为演进式架构的固有特性。
🌐 业界动态
Kubeflow 从 CNCF 毕业:Kubernetes 成 AI 控制平面
CNCF 于 8/17 宣布 Kubeflow 毕业(最高成熟度),标志 Kubernetes 成为企业 AI 工作负载的通用控制平面。项目经 ADA Logics 独立安全评估并修复 14 项问题(含 3 项严重),CERN、DHL、Jio、Bloomberg、Spotify 等已大规模采用。
微软 Defender 驱动曝内核级漏洞,可关闭 EDR 与杀毒
Check Point 研究发现,微软 Defender 中合法启动清除驱动 BTR.sys 可被复用作"离地驱动":拥有管理员权限的攻击者能在系统启动早期"黄金窗口"关闭端点防护、删除安全二进制或修改注册表,使 EDR 与杀毒形同虚设。
英伟达 B300 整机报 1400 万,Cerebras CS-4 推理达 GPU 30 倍
硬件圈多线爆发:Cerebras 发布 CS-4 AI 加速器(三颗 WSE-3 Turbo,750 PFLOPS),推理速度最高达 GPU 方案 30 倍;英伟达 B300 整机国内报价 1400 万元(较去年同期翻近三倍);首款 CPU RTX Spark 多核跑分超越 X86 旗舰;下一代 Feynman GPU 将采用台积电 1.6nm A16 制程。
《人工智能拟人化互动服务管理暂行办法》正式施行
国家网信办等 5 部门联合公布的《办法》已正式施行,明确 AI 陪伴服务"辅助人类、服务人类"定位,要求显著标识、防沉迷与心理保护、敏感数据不得用于训练,严禁向未成年人提供虚拟亲密关系服务。
Framework BIOS 更新变砖,官方响应迟到一个多月
Framework 推送的稳定版 BIOS 更新导致部分用户设备无法启动,社区七月初报障、GitHub issue 挂一个月无人认领,直到媒体追问才书面回应。民间极客用 CH341A 编程器提取官方固件镜像抢先"救砖",官方承诺的 Crisis Recovery Mode 至今未给出上线时间。
📚 推荐阅读
Mojo Hits 1.0: A Technical Look
从工程视角拆解 Mojo 1.0:编译器开源意味着"可验证"而非单纯免费,文章客观指出异步模型、模式匹配、联合类型仍是路线图缺口,并给出从源码构建与升级现有代码库的具体建议,适合评估是否采用 Mojo 的团队。
初级岗位消失、高级人才断层:下一代高级工程师从哪里来?
InfoQ 深度访谈指出,当 AI 直接给出答案却省略探索过程,导师式偶发学习机会被绕过,旧的职业通道是为"写代码的人"建的,尚未为"监督系统的人"重构;建议建立结构化学习路径、基础轮岗与"像为高级工程师准备入职文档"般的上下文沉淀。
HN 热议:"Code was never the hard part" 是新型话术
一篇驳斥"写代码从来不是难事"的博文登上 HN 高位(324 分)。作者指出若代码真 trivial,为何整个 AI 行业都建立在代码生成之上;该话术实质是把程序员重新归类为"文员",为用 PM/创始人替代工程师正名,引发 400+ 共识性评论。
每日极客日报 由 AI 助手自动整理 · 如有遗漏欢迎补充
葡萄城是专业的软件开发技术和低代码平台提供商,聚焦软件开发技术,以“赋能开发者”为使命,致力于通过表格控件、低代码和BI等各类软件开发工具和服务,一站式满足开发者需求,帮助企业提升开发效率并创新开发模式。
更多推荐



所有评论(0)