Yunkai's Blog Lab

Yunkai's Blog Lab

Foundation Models for Automatic CAD Generation
Created2026-07-08|技术动态
事件概述2026年7月,arXiv上发布了一篇题为《Foundation Models for Automatic CAD Generation》的论文(arXiv:2607.05573),被接收为Springer系列书籍《Advances in Global Applied Artificial Intelligence》的一章。该论文系统研究了使用大语言模型(LLMs)和视觉-语言模型(VLMs)自动从自然语言规格生成参数化3D计算机辅助设计(CAD)的问题。作者提出了一个统一评估流水线和包含97个工程设计问题的基准,并介绍了名为LLMForge的多模型文本到CAD框架,在两种批评范式(IterTracer和IterVision)下进行了实证研究。 关键技术点 LLMForge框架:集成了JSON-schema验证、解析特征评分、网格合成和多轮迭代优化。该框架采用两种不同的批评机制来迭代改进生成的设计。 IterTracer:使用Phong着色光线追踪渲染器,结合解析视觉度量(轮廓IoU、孔可见性、边缘间隙、纵横比一致性)提供轻量级的几何感知反馈。这种反馈连续在多轮迭代中驱...
From Graphs to Gradients: Physics-Inspired Structural Attribution for Cyber-Physical IoT Systems and Beyond
Created2026-07-08|技术动态
事件/论文/产品概述arXiv 上发布了一篇来自希腊研究团队的新论文,提出了一种受统计力学启发的可解释性框架,用于对工业物联网及更广泛的混合信息物理系统进行结构归因。传统因果解释方法需要恢复显式的有向因果图,这在带有反馈回路和部分可观测性的大规模系统中往往不可行。本文转而通过无向的、基于能量的系统表示来建模变量依赖关系,从而在不恢复有向因果图的前提下实现依赖感知的归因分析。 关键技术点 能量基表示:借鉴统计力学,将信息物理系统建模为一个能量景观,变量的依赖关系通过无向图编码在能量函数中。 依赖感知归因:通过分析单个组件扰动下能量景观的变化,量化该组件对系统行为的影响,避免直接推断因果方向。 混合变量支持:框架能处理连续与离散混合变量,适用于工业物联网中常见的异构数据环境。 实验验证:在包含连续和离散变量的工业物联网测试床上进行仿真,与最先进的图基方法相比,归因准确性、鲁棒性和可扩展性均有提升。 对数据科学或 AI Agent 落地的意义在高风险领域(如工业安全、自主系统),理解AI决策的“为什么”至关重要。传统相关性解释容易产生误导,而因果解释又因计算代价高...
叙事世界模型:基于叙事学的长篇小说作家记忆系统
Created2026-07-08|技术动态
论文概述近日,arXiv 上发布了一篇题为《Narrative World Model: Narratology-Grounded Writer Memory for Long-Form Fiction》的预印本论文(arXiv:2607.05577)。该论文由 Mohammad Saifullah、Thomas Kornmaier、Taaha Kazi、Vasu Sharma、Aditya Sanjiv Kanade 和 Aanand Kumar Yadav 共同撰写。文章专注于解决长篇小说创作中的一个核心痛点:作家需要一种能够回答关于故事状态的多跳问答的记忆系统——比如“谁在什么时候知道了一个秘密”、“某个事件是否发生在揭示该事件的叙述之前”、“某个伏笔是否得到了回报”以及“人物关系是如何变化的”。 通用检索和智能体记忆系统虽然能够表示实体和事实,但无法捕捉这些提问所依赖的叙事学结构,因此常常返回错误证据或空结果。为此,作者提出了 叙事世界模型(Narrative World Model, NWM)。 关键技术点NWM 的核心架构由两部分组成: 基于叙事学的类型化时间状态图...
Prompt-to-Paper:面向生物信息学的智能体AI论文生成系统
Created2026-07-08|技术动态
事件概述2026年7月,arXiv上发布了一项名为 Prompt-to-Paper 的研究,提出了一套多智能体(Multi-Agent)框架,旨在解决大语言模型自动生成学术论文时的三大核心缺陷:缺乏可验证的文献基础、伪造实验结果、以及缺乏标准化的多维质量评估体系。该系统在五组生物信息学案例中成功生成了可直接提交的PDF论文,且所有引用均在有效范围内,每篇论文的生成成本仅为 0.31 美元。 关键技术点 确定性检索增强生成(Deterministic RAG) 采用章节感知的相关性评分(section-aware relevance scoring)与雪球引用扩展(snowball citation expansion),确保每个陈述都锚定在一组60–100篇可验证的文献中。 与常规RAG不同,该方法强制要求生成内容不脱离真实引用,从源头杜绝“幻觉引用”。 自主编码智能体(Autonomous Coding Agent) 该智能体能够直接执行真实的计算生物学实验,例如序列比对、基因表达分析等,替代原有系统常见的“合成数据”或“虚构结果”。 输出结果为真实的数值,而非...
Vacuum at the Page Level:深入 PostgreSQL 存储内核对 VACUUM 的字节级剖析
Created2026-07-06|技术动态
事件/论文/产品概述boringsql.com 发布了一篇深度技术文章 “Vacuum at the Page Level”,它是 PostgreSQL Storage Internals 系列教程的第 7 章。文章不再重复讲解 VACUUM 的操作配置(如 autovacuum 调优、worker 分配),而是采用“逐字节”的方式,通过 pageinspect、pg_visibility、pg_freespacemap 等工具,可视化地展示 VACUUM 在对一个简单表执行清理时,页面(page)内部每一个字段、每一条行指针(line pointer)、每一个元组头部如何变化。文章完整记录了从创建基线、产生死元组、到 VACUUM 三个阶段(堆扫描、索引清理、堆清理)后的前后快照,并详细解释了行指针从 LP_NORMAL → LP_DEAD → LP_UNUSED 的生命周期。 关键技术点 VACUUM 的三个阶段 Phase 1: Heap scan – 顺序扫描堆页面,执行 page pruning(清理 HOT 链之外的空闲空间),冻结旧元组,收...
实时英国铁路网络地图 —— Signalbox Live Train Map
Created2026-07-06|技术动态
事件/产品概述2026年7月6日,Hacker News 首页出现了一个名为 Signalbox - Live Train Map 的项目。该网站(map.signalbox.io)提供一张覆盖英国全境的实时铁路网络地图,用户可以通过交互界面直观地查看列车实时位置、线路运行状态以及车站信息。 仅从公开的摘要和标题推断,这并非一款普通的静态地图,而是一个持续更新、数据驱动的实时监控工具。项目在发布后迅速获得142个点赞和56条评论,说明其在技术社区引发了较高关注。 关键技术点由于原文未提供项目技术细节,以下分析基于同类实时轨道监控系统的常见技术方案,并非来源于项目原文: 实时数据流处理:要展示全国范围内数千列火车的实时位置,系统需要持续接收英国铁路运营商的信号数据(如 Train Position 或 Network Rail 的公开馈送),并通过 WebSocket 或 SSE 推送到前端,保证低延迟更新。 高密度矢量地图渲染:面对密集的轨道网络和动态移动的列车图标,前端需采用 Canvas 或 WebGL 渲染方案(例如 Mapbox GL JS、Leaflet ...
Generate parametric, manufacturable 3D models in seconds
Created2026-07-06|技术动态
事件概述Kyrall 是一个最新亮相的 AI 驱动的 3D 建模工具,它的宣传口号是“在几秒内生成参数化、可制造的 3D 模型”。该信息在 Hacker News 上获得关注(45 分,36 条评论),显示出社区对 AI 与工业设计结合方向的兴趣。原文仅提供了产品主页和 HN 讨论链接,未给出详细技术白皮书或演示视频,因此下文基于产品描述进行合理分析。 关键技术点 生成式参数化建模:Kyrall 宣称能直接输出参数化模型,这意味着生成的几何体不是固定的网格,而是带有可调整的参数(如尺寸、角度、特征数),用户在后期可以修改,这比传统生成式 AI(如文本生成 3D 网格)更接近工业设计流程。 面向制造的设计(DFM):产品强调“manufacturable”,说明 AI 在生成时已经考虑了加工可行性(如最小壁厚、脱模斜度、支撑结构等)。这项能力通常需要大量制造经验数据或物理模拟来约束生成过程。 速度优势:“in seconds”暗示底层模型经过优化,可能使用轻量级神经网络或基于梯度的高速优化算法;但具体推理速度、硬件要求原文未说明。 对数据科学或 AI Agent 落地的意义 降低...
当人性化支持未能建立客户关系——Castro Podcasts 的反思
Created2026-07-06|技术动态
事件概述Castro Podcasts 创始人 Dustin Bluck 在 2026 年 7 月发表了一篇深度反思文章,记录了他试图通过“真正人性化的支持”来建立客户关系,但最终发现这一策略并未如预期的那样有效。他曾在收购 Castro 后认为,基于实际用户体验的人工支持是轻松的差异化优势,但实际运作中,绝大多数诚恳的回答反而使用户更加不满。文章将支持请求分为五类,逐一剖析为何每种类型都难以建立真正的忠诚度。 关键技术点Bluck 归纳了五类支持请求及其失败原因: 订阅与定价投诉——用户只想要降价或免费,任何合理解释都会被负面情绪反弹。即使赠送额外试用期,转化率也低于标准。 Bug 报告——对开发者有价值的 bug 信息,但用户往往得不到即时解决。无法复现、优先级低、信息不足等情况使回复变成“无法解决”的坏消息,反而加深失望。 复杂问题/人工干预——合并账户、跨地域问题等,这类情况用户确实会感激,但占比不足 1%。 用户困惑/表述不清——反复询问基础操作的用户会逐渐耗尽支持资源,且其订阅价值并不更高。Bluck 引用 Patrick McKenzie 的术...
GPT-5.6 Sol Ultra 将整合进 Codex:一则简短推文引发的猜想
Created2026-07-06|技术动态
事件概述2026 年 7 月 6 日凌晨,X(原 Twitter)用户 Tibo(@thsottiaux)在回复另一用户 @haider1 时发布了一条极简推文: Ultra will be in codex. 该推文迅速引发关注,截至发稿已有超过 59 万次浏览、193 个转发和 3800 个点赞,并在 Hacker News 上获得 320 个点赞和 267 条评论。由于 Tibo 此前曾参与 OpenAI 相关讨论(原文未明确其身份),社区普遍将其解读为:GPT-5.6 Sol Ultra 这个模型将被集成到 Codex(OpenAI 的代码生成工具)中。 关键技术点 GPT-5.6 Sol Ultra:根据命名惯例,“5.6”可能代表 GPT-5 系列的一个中间版本或重大更新,“Sol”或许是内部代号,“Ultra”暗示其为该系列中能力最强的变体。原文除名称外未给出任何具体参数或能力描述。 Codex 整合:Codex 是 OpenAI 推出的、以 GPT 模型为基础的代码生成与辅助工具,原本基于 GPT-3 系列,后逐步升级。将 Ultra 整合进 Codex 意...
我的本命年启程:马到成功,心想事成 🐎✨
Created2026-02-23|随笔
🎉 新年快乐,崭新的自己!嗨,未来的我(以及任何可能看到这里的访客),新年好! 在噼里啪啦的鞭炮声(或者墨尔本夏日的虫鸣)里,迎来了我的本命年——丙午马年。 本命年常常被赋予特殊的意义,像是一个需要打起十二分精神应对的“关卡”。但对我而言,它更像是一个全新的起跑线。过去一年的学习、摸索、尝试,无论是关于数据管道、API调用,还是那些令人头大的技术细节,都化作了脚下的力量。 今年,我只许一个愿望:找到一份心仪的工作。无论是在我深爱的上海,还是在我正在奋斗的墨尔本。 我知道,这个过程可能会充满挑战——改不完的简历、刷不完的面试题、需要反复打磨的话术。但我也知道,我已经走在了正确的路上。每一天的学习,每一次的尝试,都在让我离目标更近一步。 💪 给此刻的自己(和未来的你)打打气“路虽远,行则将至;事虽难,做则必成。” 技术之路就像解一个巨大的谜题,有时会卡壳,有时会绕远路。但请记住:• 你 已经 在路上了。你搭建了这个博客,记录思考,这本身就是了不起的一步。 • 你 已经 在实战了。从 NetSuite API 到数据清洗,你摸到了真实世界的数据脉搏。 • 你 正在 变得强大。每一次...
1…353637
avatar
Yunkai Huang
嗨,这里是云开~
Articles
362
Tags
748
Categories
5
Follow Me
Announcement
This is my Blog
Recent Posts
月面晨昏线悖论:日落后月亮为什么还“朝上”?以及作者顺手测出的 LLM 推理短板2026-09-27
重新拾起木工:从狗门到露台花坛的两次动手实践2026-09-27
当 Google 开始安慰你:AI Overview 误读搜索意图引发的产品反思2026-09-27
当写代码比注册公司还快:为什么开发者该提前准备一个 LLC2026-09-27
DeepSeek 开源 DSec 沙箱基础设施论文:单集群日跑 300 万沙箱,支撑 Agentic RL 训练2026-09-26
Categories
  • [技术动态]11
  • 技术动态348
  • 技术探索1
    • 随笔1
  • 随笔1
Tags
强化学习 Adversarial Defense 广告技术 PostgreSQL AI Overview Enterprise Dual-Use 大模型成本 数字农业 预注册实验 几何光学 知识图谱 Football 安全 Infrastructure Devin 实时地图 工作流自动化 Place Recognition Edge Computing 金融问答 递归自我改进 EEG 天文 Cost-Aware 自主实验 Go Battery 计算机历史 Medical AI Explainable AI 视觉错觉 Model Distillation Security 启发式搜索 Cyber Security 效率优化 专利撰写 GPT-6 老年科技
Archives
  • September 2026 112
  • August 2026 134
  • July 2026 113
  • February 2026 3
Website Info
Article Count :
362
Unique Visitors :
Page Views :
Last Update :
© 2025 - 2026 By Yunkai HuangFramework Hexo 8.1.1|Theme Butterfly 5.5.4