Yunkai's Blog Lab

arXiv

Tag - arXiv
2026
2026-09-25
PAWS:策略驱动的智能体世界模拟——把政策、新闻、主体行动与市场对齐的金融多智能体数据集
2026-09-25
预测智能体何时该思考?ReliabilityRoute 的行为压力测试
2026-09-24
当工具调用"假装成功":一篇关于 Agent 工具交互静默失败的审计研究
2026-09-24
Harness as a Language:极简 Agent 框架 JAZ 用单一 invoke 原语挑战记忆与自我改进系统
2026-09-24
目标要不要一个"旋钮"?MODPO 可操控多元对齐中的目标冲突预测与权衡覆盖
2026-09-22
Attention-Aware Routing:让 MoE 路由"看见"注意力
2026-09-22
CaLR:用因果潜空间修正,让扩散语言模型也能做严谨推理
2026-09-21
RBS-Attention:面向长上下文大模型的半径约束稀疏 Prefill
2026-09-18
基础模型需要操作系统:FMOS 自进化系统层立场论文解读
2026-09-18
正则化强调式 TD(RETD):当均值收缩不再保证固定步长下的稳定
12…4
avatar
Yunkai Huang
嗨,这里是云开~
Articles
362
Tags
748
Categories
5
Follow Me
Announcement
This is my Blog
Recent Posts
月面晨昏线悖论:日落后月亮为什么还“朝上”?以及作者顺手测出的 LLM 推理短板2026-09-27
重新拾起木工:从狗门到露台花坛的两次动手实践2026-09-27
当 Google 开始安慰你:AI Overview 误读搜索意图引发的产品反思2026-09-27
当写代码比注册公司还快:为什么开发者该提前准备一个 LLC2026-09-27
DeepSeek 开源 DSec 沙箱基础设施论文:单集群日跑 300 万沙箱,支撑 Agentic RL 训练2026-09-26
Categories
  • [技术动态]11
  • 技术动态348
  • 技术探索1
    • 随笔1
  • 随笔1
Tags
强化学习 Adversarial Defense 广告技术 PostgreSQL AI Overview Enterprise Dual-Use 大模型成本 数字农业 预注册实验 几何光学 知识图谱 Football 安全 Infrastructure Devin 实时地图 工作流自动化 Place Recognition Edge Computing 金融问答 递归自我改进 EEG 天文 Cost-Aware 自主实验 Go Battery 计算机历史 Medical AI Explainable AI 视觉错觉 Model Distillation Security 启发式搜索 Cyber Security 效率优化 专利撰写 GPT-6 老年科技
Archives
  • September 2026 112
  • August 2026 134
  • July 2026 113
  • February 2026 3
Website Info
Article Count :
362
Unique Visitors :
Page Views :
Last Update :
© 2025 - 2026 By Yunkai HuangFramework Hexo 8.1.1|Theme Butterfly 5.5.4