Yunkai's Blog Lab

Archives

All Articles - 362
2026
2026-07-13
GATS: Graph-Augmented Tree Search with Layered World Models for Efficient Agent Planning
2026-07-13
Long-Horizon-Terminal-Bench: Testing the Limits of Agents on Long-Horizon Terminal Tasks with Dense Reward-Based Grading
2026-07-13
Neuro-Agentic Control:用 LLM 智能体控制安全控制器的深度学习框架
2026-07-13
MedRealMM:真实世界多模态中文在线医疗咨询评测基准
2026-07-10
德国电信如何用AI重塑电信业:从客服到网络的AI原生转型
2026-07-10
对抗性社会认识论:人类与大型语言模型集群的新视角
2026-07-10
对齐临床需求与AI能力:关于大语言模型医学推理的综述
2026-07-10
AI集成模型评估农业韧性:当经济模型遇见生物物理模拟
2026-07-10
Context Graphs for Proactive Enterprise Agents
2026-07-08
CSTutorBench:评估小语言模型在积木式编程中的辅导能力
1…34353637
avatar
Yunkai Huang
嗨,这里是云开~
Articles
362
Tags
748
Categories
5
Follow Me
Announcement
This is my Blog
Recent Posts
月面晨昏线悖论:日落后月亮为什么还“朝上”?以及作者顺手测出的 LLM 推理短板2026-09-27
重新拾起木工:从狗门到露台花坛的两次动手实践2026-09-27
当 Google 开始安慰你:AI Overview 误读搜索意图引发的产品反思2026-09-27
当写代码比注册公司还快:为什么开发者该提前准备一个 LLC2026-09-27
DeepSeek 开源 DSec 沙箱基础设施论文:单集群日跑 300 万沙箱,支撑 Agentic RL 训练2026-09-26
Categories
  • [技术动态]11
  • 技术动态348
  • 技术探索1
    • 随笔1
  • 随笔1
Tags
强化学习 Adversarial Defense 广告技术 PostgreSQL AI Overview Enterprise Dual-Use 大模型成本 数字农业 预注册实验 几何光学 知识图谱 Football 安全 Infrastructure Devin 实时地图 工作流自动化 Place Recognition Edge Computing 金融问答 递归自我改进 EEG 天文 Cost-Aware 自主实验 Go Battery 计算机历史 Medical AI Explainable AI 视觉错觉 Model Distillation Security 启发式搜索 Cyber Security 效率优化 专利撰写 GPT-6 老年科技
Archives
  • September 2026 112
  • August 2026 134
  • July 2026 113
  • February 2026 3
Website Info
Article Count :
362
Unique Visitors :
Page Views :
Last Update :
© 2025 - 2026 By Yunkai HuangFramework Hexo 8.1.1|Theme Butterfly 5.5.4