「编程验证」共找到 1844 篇相关文章
JCP | 南科大赵肃楠、王建春等:LESnets:基于物理信息神经算子的湍流大涡模拟
本研究提出基于物理信息神经算子的LESnets方法,用于快速模拟粗网格上三维湍流时空演化。不使用标签数据,训练两种神经算子,验证了其有效性和泛化能力,效率显著优于传统方法。
DeepSeek新版R1直追OpenAI o3!实测来了:“小版本升级”着实不小
DeepSeek在端午节前更新R1新版本DeepSeek - R1 - 0528,看似小版本更新实则提升巨大,在LiveCodeBench上几乎与OpenAI o3 - high相当,实测显示编程等能力显著优化,直追闭源模型。
登上Science Robotics顶刊!清华团队耗时22年,终于教会机器人踢足球
今年8月,清华赵明国教授团队联合字节跳动Seed等在《Science Robotics》发表论文,提出视觉驱动的反应式足球技能学习框架。该研究历经22年技术接力,成果在真机和赛事中验证,加速进化平台助力研究。
Zig 创始人直言,Bun 靠 Claude 生成的 Rust 重构版是“没人把关的烂代码”
Bun创建者用Claude智能体11天将Bun从Zig移植到Rust,虽通过测试,但Zig创始人Andrew Kelley批评其编程实践不规范,认为代码是‘没人把关的烂代码’,且AI生成代码缺监督会出问题。
Grok最新模型吃上Cursor「加餐」,马斯克:Coding实现巨大改进
马斯克在X上透露,xAI的Grok基础模型V9 - Medium(1.5T)完成训练,预计2 - 3周后发布,训练加入大量Cursor数据。同时,xAI的AI编程代理工具Grok Build进入早期Beta测试阶段。
AI月产十亿行代码,暴增76%!程序员论坛炸锅:代码行数≠生产力!
Greptile基于每月用AI审核的十亿行代码发布AI编程年度报告,显示AI助力下代码生产量飞涨,但论坛对此多存怀疑,还分析了不同大模型SDK下载量、模型适配场景等,也给出2025年关键论文。
半年复盘,AI迎来预训练后的新瓶颈。
2025年上半年AI领域发展加速,编码和多模态能力提升。但模型在综合能力上遇到第二轮瓶颈,编码能力强时通用认知能力‘拉胯’,或与RL阶段使用编程数据有关,红杉新基准或推动模型均衡发展。
ICLR 2025 Oral | LLM也有从众心理!
浙江大学团队论文指出,多AI协作系统存在“群体思维”,多个AI共同决策时会盲目跟多数意见。研究者开发BenchForm测试平台验证LLM从众行为,还分析原因、给出让LLM更独立的方法,指出从众利弊及未来挑战。
UIUC清华微软联合提出PlugMem:当Agent记忆告别「经历」,开始存储「经验」
随着大语言模型Agent长期运行,‘记忆该如何设计’成核心问题。UIUC、清华、微软联合提出PlugMem,将记忆拆分为三类,以知识为单位存储,在三类任务中验证其有效性,为Agent长期记忆设计提供新思路。
TileLang深入详解-第三章-Kernel,Buffer,并行控制和矢量化
文章详细介绍TileLang核心编程构造,包括Kernel函数、Buffer和并行控制等。阐述其计算定义、并行与循环控制方式,还提及性能优化的矢量化访存,给出代码示例,并分享源码里形状、并行域和线程的最佳实践。