AUI 技术与产业观察

2026

Sep 28

代码免费之后,谁来为运行买单

一场静悄悄的成本转移正在软件行业发生。当大模型把编写代码的边际成本压到接近零,当GPT-6 Luna把单次任务的价格打到几美分,当任何团队都能在一周内复制出功能完备的智能体原型,一个更尖锐的问题浮出水面:这些被廉价复制出来的系统,其全生命周期的运营成本究竟由谁承担?Richard J. Wolff在技术社区发表的长文提出了"判断债务"的概念,指出团队在所有权未明时就开始依赖AI成果,被推迟的责任最终以排查、对账和支持的形式落到并未获得初始收益的团队头上。与此同时,OpenAI的GPT-6 Sol与Anthropic的Claude Opus 5.5在同日发布,定价战背后隐藏着一个反直觉的真相:代码生成越便宜,系统运维越昂贵。 廉价生成的幻觉 如果把软件行业比作建筑业,那么今天的AI工具就像一台可以瞬间打印出整栋大楼图纸的机器。图纸本身几乎免费,但把图纸变成能住人的建筑,需 …
more
Sep 26

纯 Rust 文档解析利器 anydoc

最近,大名鼎鼎的 Firecrawl 开源了一个名为 anydoc 的项目,值得聊一聊。 以前,如果想把一份 DOCX 手动转成文本再喂给模型,用 LibreOffice 光转换就得等一秒多,还不算手动操作的时间。anydoc 把这个过程压到了中位数 4.4 毫秒,覆盖全部 14 种常见格式,并输出统一的 GitHub-Flavored Markdown。 它不是又一个"够用就行"的转换器。Firecrawl 用纯 Rust 重写了整条流水线,把 Word、PowerPoint、Excel、OpenDocument、RTF、EPUB、CSV 和 PDF 统统纳入同一个文档模型,再统一序列化。结果是:无论你丢进去的是 2003 年的老 .doc,还是昨天刚导出的 .pptx,标题层级、合并单元格、脚注和任务列表,输出都长一个样。全程本地运行,不依赖外部服务,也不需要机器 …
more
Sep 23

JetBrains Air与编程的黄昏

2026 年 9 月下旬,JetBrains 正式揭开了其酝酿已久的产品体系——Air。这是一套被官方定义为 “面向智能体软件开发(Agentic Software Development)” 的产品组合,标志着这家拥有二十余年历史的 IDE 巨头,正式将战略重心从 “辅助人写代码” 转向 “管理 AI 写代码”。消息在开发者社区迅速发酵,Hacker News 上的讨论帖在短时间内涌入大量评论。对于一家以 IntelliJ IDEA、PyCharm 等工具安身立命的公司而言,这一步棋的分量不亚于一次自我革命:它等于公开承认,那个以 “人坐在键盘前逐行敲击代码” 为核心场景的时代,正在走向黄昏。 一家 IDE 公司的身份危机 要理解 Air 的分量,先得理解 JetBrains 的焦虑从何而来。 …
more
Sep 22

不会聊天的大模型 Jev,为何登顶

九月中旬,一个名为 Jev 的模型在 Hacker News 上发布,一天内拿到 1863 分、近五百条评论,三天之内被浏览器自动化团队完成官方集成,社区冒出多个独立复现项目。它的特别之处在于:这个模型不生成任何文本。你给它一段状态和一组问题,它只返回三类东西——一个布尔概率、一个在有限选项上的概率分布、一个带分布的分数。创始人 Diogo Almeida 说得很直白:这是"结构化数据模型,技术上不是语言模型"。官方自报的数据:输出 token 免费,输入每百万 token 只要 0.042 美元,延迟 70 到 500 毫秒,宣称比大语言模型快最多 193.6 倍、便宜 444.6 倍。社区给它找到了一批恰如其分的用途:意图分类、模型路由、语义标注、输出护栏、高频实时决策。同样迅速到来的是翻车实测:在扑克决策上与最优解吻合率只有 63%,单步迷宫都解不稳,错得最离谱的 …
more
Sep 20

从 WebGL 到 WebGPU:PlayCanvas Engine 的工程实践

在浏览器环境中构建高性能 3D 交互应用,工程团队通常面临着双重约束:一方面,需要应对移动设备多样的 GPU 硬件差异、严格的内存限制以及网络加载延迟;另一方面,随着场景复杂度的提升,多光源阴影、骨骼动画、物理碰撞与后处理管线对主线程与渲染驱动的开销提出了极高要求。 在现有的 Web 3D 技术方案中,Three.js 作为底层渲染库灵活性极佳,但缺乏完整的游戏引擎基础设施(如实体组件体系、物理与空间音频管理),通常需要开发者自行组装全套上层系统;而基于 C++ 编译至 WebAssembly 的传统游戏引擎(如 Unity WebGL 导出),虽然功能完备,但初始包体较大、启动冷时间长,在追求即开即用的移动端营销与轻量互动场景中存在适配成本。 开源项目 playcanvas/engine 走出了一条兼顾轻量与完备的工程路线:它是一套用纯 JavaScript/TypeScript 构建的 …
more
Sep 20

深入解析 text-to-CAD

在三维数字资产生成领域,近年来的技术探索大多集中在以多边形网格(Polygon Mesh)、神经辐射场(NeRF)或高斯泼溅(3D Gaussian Splatting)为核心的表示方法上。这些方法在游戏影视资产与外观概念设计中表现出众,但难以直接迁移至严谨的精密机械与实体制造场景。 工业工程对几何模型有着截然不同的标准:零件需要具备严格的边界表示(B-Rep, Boundary Representation)、确定的解析曲面与精确尺寸公差,并能输出为 STEP、DXF 等标准交换格式。在装配与自动化阶段,往往还需要进一步产出机器人结构描述(URDF/SRDF)并对接切片工具(Slicer)生成可加工的 G-code。 开源项目 earthtojake/text-to-cad 及其底层核心引擎 cadgen 选择了另一条技术路线:不依赖端到端的黑盒网格扩散,而是让大语言模型(如 …
more
Sep 19

如何 100% 本地运行 DeepSeek Agent Harness

将 DeepSeek Harness 与 Ollama 结合使用,可以实现 0 美元的 API 账单、完全的数据隐私保护和完整的自主执行能力。 自主软件开发的范式转变 软件工程领域正在经历一场根本性变革,人工智能与代码库的交互方式正在被重新定义。过去多年间,机器学习模型主要扮演被动的自动补全引擎,或者是嵌入在集成开发环境(IDE)中的局部聊天助手。自主编码智能体(Agent)改变了这一切:它能检查本地文件树、执行 shell 命令、重构复杂代码库、运行多步骤的诊断循环,从而重塑开发者的工作流。 不过,早期的商业实现,最有代表性的是 Anthropic 的 Claude Code 和 OpenAI 的 Codex CLI,都把这些自主执行循环绑定在封闭的专有云端模型之上。 DeepSeek Agent Harness(DSH)提供了另一条路径:一个开源的、插件优先的框架,明确把推理引擎与操作 …
more
Sep 18

智能时代的中国经济答卷

近一段时间,围绕通用人工智能经济影响的讨论明显升温。一端是模型能力的快速外溢:在部分需要综合信息、校准概率和快速判断的任务上,人工智能已经逼近甚至超过少数训练有素的人类预测者;在软件工程场景中,编码代理能够成批生成代码、搭建原型、修补缺陷,并开始倒逼工程管理体系引入更接近航空、生命科学和临床实验的质量控制方法。另一端则是社会情绪的复杂波动:有人担心制造业城市长期衰退的历史会在白领行业重演,有人忧虑大规模失业会让财政与政治体系失去理性讨论空间,也有人提醒,把裁员简单归因于人工智能并不严谨,许多科技企业在过去多年里本就周期性地调整人员结构。 这些争论看似分散,实则指向同一个核心问题:当机器开始在认知劳动中具备可替代性,经济政策应当怎样重新安排增长、分配、竞争与安全之间的顺序。技术本身不会自动带来共同富裕,也不会天然导致社会崩解。真正决定结局的,是一个社会能否在技术扩散的早期建立可信的规则、稳健 …
more
Sep 16

本地语音 AI 助手技术方案:基于 MLX 与 Qwen 实现

本文基于 Sandeep Aggarwal 的 Jarvis 项目 整理为技术方案文档。 1. 概述与目标 1.1 项目背景 需要构建一个完全运行在本地 Mac 上的语音 AI 助手,具备持续聆听、唤醒词激活、任务执行和打断处理能力。核心约束条件为: 隐私:语音数据不离开本地设备 延迟:端到端响应延迟需支持自然对话节奏 成本:零云端 API 调用费用 1.2 运行环境 项目 规格 硬件 MacBook Air M2, 24 GB 统一内存 操作系统 macOS (Apple Silicon) 推理框架 MLX (Apple 机器学习框架) 语言模型 Qwen3.5-4B-MLX-4bit 编程语言 Python 3 (asyncio) 2. 系统架构 2.1 架构总览 系统由 7 个核心组件构成,通过 Python asyncio 事件循环串联为流式管线: 架构图 …
more
Sep 13

六款芯片,一个问题

本文为原文的中文翻译,原文链接:https://dev.to/lovestaco/cpu-gpu-tpu-npu-dpu-qpu-six-chips-one-question-438b。 翻开你笔记本的规格表,你会看到一个 CPU、一个 GPU,如果机器够新,还会看到一个 NPU。 打开云实例页面,摆在你面前的是 GPU、TPU,还有一块网卡,仔细一看,那其实是一整台电脑披着风衣。 在某个实验室里,一台比深空还冷的冰箱正在运行一台 QPU。 六个缩写,全都以 PU 结尾,全都在做"计算"。 那个显而易见、我躲了很多年的问题是:为什么不干脆造一款足够好的处理器,然后就到此为止? 简短的回答是,“计算"并不是一件事。更长的回答才是有趣的部分。 CPU 是那个对什么都点头的朋友 CPU 是 central processing unit(中央处理器)的 …
more
Sep 12

智能体对接数仓的一致性和安全性优化

问题背景 当前系统中,业务分析师日常工作的一个高频场景是跨数据源核对数据。典型情况:数仓拉出的周环比增速与 BI 看板显示的数字存在偏差,两个系统本身并未报错,但业务口径存在细微差异。当需要在管理层面前解释这类偏差时,分析师只能手动打开多个标签页,靠肉眼和经验判断差异原因。 只要公司有两个以上系统能查同一件事,这类数据对不上的问题就会反复出现。分析师需要在数仓、看板、合作方对账单之间反复切换,把数字抄到草稿纸上逐项比对,全凭经验判断这是正常时延还是实际错误。目前系统缺少自动化的交叉核对能力。 基于上述现状,本文梳理当前系统在接入 AI 智能体后的架构演进过程,分析各阶段暴露的问题,并提出对应的优化方案。 现状与问题分析 阶段一:单 MCP 聊天机器人 初期方案在语义层前套了一层 MCP 服务,挂载智能体,让用户用自然语言提问,替代手写 SQL 或在看板中逐层筛选。演示阶段效果不错,但上线后 …
more
Sep 11

Kimi的算力长征与资本赛跑

一家年化收入刚过 3 亿美元的公司,还在追着投资人要钱。月之暗面以 500 亿美元投前估值推进新一轮融资,同时以保密形式向港交所递了招股书。收入和融资同时发生,看起来拧巴,但在大模型行业里这算常态:收入涨得越快,推理成本涨得更快,算力才是决定谁活到最后的那个硬约束。 赚得越多,烧得越快 先把账算清楚。Kimi 的 ARR 从 3 月的 1 亿美元涨到 6 月中旬的 3 亿美元以上,一个季度翻了三倍,增速超过很多成熟 SaaS 公司。但拆开看,API 收入占七成以上,其中大部分来自海外开发者、Coding 工具和 Agent 调用。Kimi 赚的是模型被反复调用产生的用量收入,收入越火爆,GPU 消耗越大,推理成本跟着水涨船高。 K3 发布后需求超出预期,模型能力提升让用户任务复杂度同步上升,7 月 19 日 Kimi 因 GPU 容量逼近上限暂停了新用户订阅。一个商业化节节攀升的产品,因为 …
more
Sep 9

人机回环,不该只是一次弹窗

一声 “y”,回答不了一个已经改变的世界 几乎每一场智能体演示的结尾,都是同一个画面:控制台光标跳动,弹出一行字,“Approve this action? (y/n)"。工程师敲下一个 “y”,回车,掌声响起,屏幕上的任务清单一项项被划掉。观众记住了 “自主智能”,记住了 “人工智能替人干活”,却很少有人追问:那个敲下 “y” 的人,那一刻到底知不知道自己在批准什么? 最近技术社区的讨论正在把这个问题重新摆上桌。一位拥有网络安全与医疗背景的 AI 从业者,把这段演示代码称为 “人机回环的谎言”:它假设审批人永远在线,问题永远新鲜,世界永远静止。而真实的生产环境里,审批人可能正飞在万米高空,答复要三天后才落地。等待期间,执行任 …
more
Sep 8

当潮水换了方向:全球AI竞速进入价值兑现期

8 月 27 日,OpenAI 在巴西正式启动商业化运营。巴西以周活跃用户计已跻身 ChatGPT 全球三大市场,过去一年用户量近乎翻倍,每天约 2.15 亿条消息涌向硅谷的服务器。其中 35% 与工作相关,这 35% 当中又有 53% 要求 ChatGPT 直接 “完成任务或生成成果”。开发者侧数据更细:自 2026 年初以来,巴西每周使用 Codex 的用户数增长 11 倍以上,每日互动量膨胀近 30 倍,远超 “用户数翻倍” 的总盘,意味着单位用户的智能体调用频次正以数十倍速率提升。 同期港交所的另一份财报读出了同样信号。MiniMax 上半年收入 1.17 亿美元,同比增长 283.1%,已逼近 2025 全年;8 月 ARR 达 8 亿美元,是六个月前 1.5 亿美元的 5.3 倍;企业客户与开发者数量突破 200 万。阿里 …
more
Sep 6

北疆落子:十六万颗昇腾芯片背后

十六万片之巨:一份订单里的产业纵深 据彭博社报道,中国人工智能初创企业深度求索(DeepSeek)计划在内蒙古新建的数据中心内部署至少十六万片华为昇腾950DT加速芯片,主要用于模型推理。若计划如期推进,这一数据中心将成为DeepSeek发展人工智能业务的关键算力底座,与此同时,知情人士透露中国或将拥有数个同等规模的数据中心。十六万片——这个数字本身已足以写进中国半导体与算力基础设施的年度记分牌。但数字之下,更值得记取的是它所折射出的三层纵深。 第一层是部署纵深。一家头部AI企业首次将主力推理集群全栈锚定在国产芯片之上,且规模直指十万片级,这在过去是不可想象的。回望2024至2025年间,国产芯片多以"小步快跑、单点适配"姿态切入推理市场,万片以上的集群规模尚属罕见;如今一举跃升至十六万片,意味着昇腾950DT已具备承担头部模型规模化推理任务的工程可靠性。 第二层是地理 …
more
Sep 6

从烟盒到餐桌的工业迁徙

一罐果汁背后的产业迁徙 1963年,美国烟草巨头R.J.雷诺兹公司作出一个当时看来并不显眼、后来却影响深远的决定——收购夏威夷宾治(Hawaiian Punch)。这是一家做果汁饮料的小厂,雷诺兹看中的是它已经铺好的渠道和现成的品牌外壳。这是美国烟草业第一次把脚伸进食品行业的门里,也是一条后来被反复验证、屡试不爽的商业逻辑的起点:把卖香烟练出来的那套本事,原封不动地搬到新的货架上去。 加州大学伯克利分校与加州大学旧金山分校的一项联合研究,把这条线索的完整版图勾勒了出来。研究显示,在随后的二十多年里,R.J.雷诺兹和菲利普·莫里斯两大烟草集团,几乎以"碾压式"的姿态横扫了北美食品工业的半壁江山——通用食品(General Foods)、卡夫(Kraft)、纳贝斯克(Nabisco)、德尔蒙特(Del Monte)、七喜(7UP)等人们耳熟能详的品牌,相继被纳入烟草资本旗下 …
more
Sep 1

万亿征途:华为研发长征的代价与回报

一张"看似矛盾"的成绩单 2026年8月31日晚,北京金融资产交易所等平台同步披露的华为投资控股有限公司2026年半年度财务报告,注定要在岁末的财经盘点里占据一席特殊的版面。一方面,4678.19亿元的营业收入,同比增长9.55%,是华为自2020年以来同期最高水平,半年时间几乎重回到2020年同期4507亿元的历史峰位,参照当前增速,全年9000亿元已无悬念,2020年8914亿元的历史峰值被改写只是时间问题。另一方面,归属于母公司所有者的净利润仅为234.28亿元,同比下滑36.77%;净利润238.09亿元,同比下滑35.99%;营业利润率从去年同期的10.49%滑落至7.01%。 如果只看一张利润表,这似乎是一家"增收不增利"的公司;但若把研发投入1213.82亿元、占营收25.94%、同比增长25.2%这一组数字摆上桌面,再叠加存货激增 …
more
Aug 31

加密之门再启:欧盟安全战略与密码学底线

事件缘起:一份被重新摆上桌面的路线图 2025年4月,欧盟委员会正式发布内部安全战略ProtectEU,将"合法且有效的数据访问"列为核心支柱之一;同年6月24日,配套的《执法数据访问路线图》落地,明确提出要评估现有数据留存规则的效力,并启动一项专门的"加密技术路线图",以识别和评估能够让执法机关"合法"访问加密数据的技术方案(来源:欧盟委员会内政事务总司官网公告,2025年6月24日)。这一表述,被外界普遍理解为对加密后门思路的再次激活。 进入2026年夏秋之交,围绕ProtectEU的立法博弈再度升温。据多家欧洲媒体报道,欧盟委员会在经历内部安全战略的阶段性推进后,正在试图将"对加密数据的合法访问"从一个政治口号,转译成具体的法律提案与技术规范。这一次,它所面对的不只是技术上的不可能三角,更是欧洲议会此前用 …
more
Aug 31

Steam 12TB 历史档案外泄

一位置名为"积攒者"的匿名上传者,把 2003 至 2013 年间 Valve 积累的内部档案倾倒在了公共种子网络上,总量 12TB。社区把这件事叫做 teraleak,也就是"万亿字节级泄漏"。 《传送门 2》原型版里尚未被剪辑的台词、《求生之路 2》从未曝光的测试关卡、《半衰期 2:第三章》里一闪而过的神秘武器,只是这次考古狂欢里最先被挖出来的几样。真正值得追问的,是这些内容为什么还能被访问。Valve 在 2013 年把内容分发系统从 Steam2 迁到了 SteamPipe,旧有服务器架构已经退场,但那些承载着发行版、内部测试版、Alpha 与 Beta 构建、概念原型乃至被砍掉章节的 depot 文件,似乎一直处于"技术上仍可访问、运营上已被遗忘"的状态。数据本身今天不再有实时威胁,但资产管理链条上的任何一个疏漏,都可能 …
more
Aug 30

OpenAI 宣布断供 Cursor

断供声明 2026 年 8 月 29 日,OpenAI 在官网发布声明:11 月 12 日起切断对 Cursor 的模型供应。Cursor 由 Anysphere 开发,是一款 AI 编程工具。两个月前它被 SpaceX 以 600 亿美元的全股票交易收编,而 SpaceX 同时是 xAI(即 SpaceXAI,Grok 模型的母公司)的实际控制者。OpenAI 给出的理由指向信任:马斯克旗下公司过往屡次违反合同,今年早些时候马斯克在法庭上承认,xAI 曾通过 OpenAI 的输出蒸馏训练 Grok。OpenAI 因此不再信任 SpaceX 体系下的 Cursor 会在其服务条款内使用模型。 Cursor 的成绩单摆在那里:2026 年 3 月达到 20 亿美元年化经常性收入,占 AI 编程市场约四分之一份额,《财富》500 强中约 120 家企业将其作为首选开发工具。断供之后,它将失去对 …
more

© 2026 Hot Ingest