Yunkai's Blog Lab
LLM
Tag - LLM
2026
2026-09-27
当 Google 开始安慰你:AI Overview 误读搜索意图引发的产品反思
2026-09-25
Pistis 技术报告:27B/9B 多模态模型、IDRL 后训练范式与自动推理框架优化
2026-09-24
Harness as a Language:极简 Agent 框架 JAZ 用单一 invoke 原语挑战记忆与自我改进系统
2026-09-24
目标要不要一个"旋钮"?MODPO 可操控多元对齐中的目标冲突预测与权衡覆盖
2026-09-21
RBS-Attention:面向长上下文大模型的半径约束稀疏 Prefill
2026-09-20
DAPO:字节跳动 Seed 与清华 AIR 开源的大规模 LLM 强化学习系统
2026-09-19
ENZO:把 300+ 模型、自建 Agent 和本地密钥保险箱塞进一个开源工作台
2026-09-18
我们期待 LLM 做什么?LLM Benchmark 设计版图的全景测绘
2026-09-10
超越对与错:评估大语言模型中的二阶社会推理
2026-09-05
读者的反抗:当 LLM 写作撞上人类的阅读直觉
1
2
…
6
Yunkai Huang
嗨,这里是云开~
Articles
362
Tags
748
Categories
5
Follow Me
Announcement
This is my Blog
Recent Posts
月面晨昏线悖论:日落后月亮为什么还“朝上”?以及作者顺手测出的 LLM 推理短板
2026-09-27
重新拾起木工:从狗门到露台花坛的两次动手实践
2026-09-27
当 Google 开始安慰你:AI Overview 误读搜索意图引发的产品反思
2026-09-27
当写代码比注册公司还快:为什么开发者该提前准备一个 LLC
2026-09-27
DeepSeek 开源 DSec 沙箱基础设施论文:单集群日跑 300 万沙箱,支撑 Agentic RL 训练
2026-09-26
Categories
[技术动态]
11
技术动态
348
技术探索
1
随笔
1
随笔
1
Tags
强化学习
Adversarial Defense
广告技术
PostgreSQL
AI Overview
Enterprise
Dual-Use
大模型成本
数字农业
预注册实验
几何光学
知识图谱
Football
安全
Infrastructure
Devin
实时地图
工作流自动化
Place Recognition
Edge Computing
金融问答
递归自我改进
EEG
天文
Cost-Aware
自主实验
Go
Battery
计算机历史
Medical AI
Explainable AI
视觉错觉
Model Distillation
Security
启发式搜索
Cyber Security
效率优化
专利撰写
GPT-6
老年科技
Archives
September 2026
112
August 2026
134
July 2026
113
February 2026
3
Website Info
Article Count :
362
Unique Visitors :
Page Views :
Last Update :