「动态上下文发现」共找到 1990 篇相关文章
哈萨比斯出的难题,GPT之父接上了:用一个知识停在1930年的模型
GPT之父Alec Radford等用1931年前数据训练13B模型Talkie,切断现代知识污染。研究者测试其能力,探讨它对未来的“预感”、规避污染问题及数据多样性等,同时训练中也面临时间泄漏、数据质量等难题。
ACL 2026 | 中科大&上海AILab揭示强化学习后训练的Scaling Law
中国科学技术大学和上海人工智能实验室等团队,在Qwen2.5和Llama 3模型开展研究,揭示强化学习后训练的Scaling Law,提出幂律公式预测模型学习效率与训练轨迹,成果被ACL 2026接收。
The Batch: 945 | 制药巨头大举押注 AI
制药巨头 Eli Lilly 向 Insilico Medicine 提供最高 27.5 亿美元,用于药物研发。Insilico 用生成式 AI 进行药物发现,从靶点到分子设计效率高,虽尚无 AI 药获批,但显示出潜力。
程序员都在给AI当“监工”!7万多条编程消息揭开当前编程现状
圣母大学和范德堡大学研究团队剖析超7万条编程指令,揭示开发者与AI编程助手协作现状。开发者多当“监工”,工作从敲代码转向指导AI、诊断错误等,还总结出人机协同的诸多规律。
Claude Code越更越废?!大厂AI主管公开怒喷思考深度暴跌,官方回应更被怼爆 :菜成AI“玩具”
Claude Code在2月更新后无法用于复杂工程任务,AMD AI团队主管Stella Laurenzo分析发现其思考深度下降67%、算力消耗增加。开发者不满,Claude Code负责人回应未获认同,部分开发者考虑转用Codex。
AI 行业悄悄统一了一件事:Agent Skills 开放标准全解析
Agent Skills 是一套开放标准格式,超 30 家主流 AI 开发工具已采纳。它结构简洁,有精妙的三层加载机制,解决了 AI Agent 上下文窗口问题。与 MCP 解决不同层面问题,生态正快速成型。
12个Ai编程Agent同台PK,最贵的不一定是最强的
上海交大和美团联合发布PRDBench论文,将12个主流AI编程Agent放入50个真实Python项目测试。结果显示,基础模型写代码强,商业版调试优势明显;专门训练的裁判模型比通用大模型靠谱。
IEEE TVCG | 告别写代码!MoGraphGPT:基于模块化大模型与图形控制的2D交互场景创作
香港多所高校研究团队提出 MoGraphGPT 系统,结合上下文感知模块化大模型与图形化控制,能让用户零代码搭建 2D 交互场景。该成果被 IEEE TVCG 录用,还对比实验验证其优势。
Codex正在重塑传统推理框架开发流程
作者用Codex完善SGLang Diffusion的SKILLS流程,修复诸多bug。让其做benchmark脚本,发现不同rmsnorm性能差异。应用flashinfer rmsnorm遇问题,Codex找出原因并修复,还提升了模型性能,体现强大生产力。
Google 开源 gws!一天暴涨 10K+ Star,把整个 Google Workspace 搬进终端。
Google 开源命令行工具 gws (Google Workspace CLI),一天揽 10K+ Star。它动态构建命令界面,支持 Google Workspace 众多服务,兼顾人类与 AI 代理需求,还具备灵活认证等亮点,为 Workspace 自动化带来新可能。