代码测试」共找到 3161 篇相关文章

算法论文8

Reasoning新突破:SoftCoT++如何让LLM‘多想几条路’?

LLM推理依赖‘思维链’,传统方法在离散token空间生成步骤有信息丢失、多样性不足问题。SoftCoT++在连续空间生成‘软思维’,拆分‘思考’与‘推理’,用专用初始token和对比学习,实验中全面超越传统方法。

深度学习自然语言处理
新闻资讯7

InfoQ 2026 年趋势报告:AI 重写工程师角色,但一切仍然关乎人

InfoQ 2026 年趋势报告探讨了 AI 对软件开发的影响,包括重写工程师角色、团队演变等。嘉宾指出 AI 采用应结合风险和业务场景,巩固基础,重新设计审查流程,关注质量和人的因素。

InfoQ
产品应用7

临时文件自动归档工具|解放双手,杂乱文件自动整理归档!

乡长分享基于AutoHotkey V2等4种AI工具开发的临时文件自动归档工具,可解决文件混乱问题。它能监控指定文件夹,自动搬运归档符合条件的文件,新版本功能强大,操作简单。

AI Build Lab
算法论文8

不换模型,效果提升104%!上海AI Lab让Harness也能自进化了

上海人工智能实验室团队提出的Self-Harness引发关注,它针对Agent外层Harness改进。实验显示,在Terminal-Bench-2.0上,不换模型只改Harness,Qwen3.5-35B-A3B等模型效果显著提升。

量子位
产品应用8

比英伟达早,比李飞飞强,大晓Kairos原生一体化世界模型定义物理AI新路线

大晓机器人发布 Kairos 开悟世界模型,其首创“多模态理解 — 生成 — 预测”原生一体化架构,采用跨具身渐进式训练体系和“以人为中心”的数据金字塔,还实现端侧部署,在四大权威具身智能基准上全面登顶。

机器之心
新闻资讯7

AI撑爆GitHub!天天宕机,18年老兵带5万星项目「决裂出逃」

GitHub第1299号用户、Vagrant之父Mitchell Hashimoto,因GitHub连续宕机和AI转型,带着5万星项目Ghostty出逃。AI让GitHub负载剧增,其资源向AI倾斜致基础设施维护变差,“去GitHub化”声音渐大。

新智元
推荐文章7

吴恩达:最快的团队,人人都是产品经理

吴恩达在最新编辑信中指出,AI编程工具提升开发速度后,瓶颈转移到‘决定做什么’。传统团队配比失衡,最快团队让工程师身兼PM和工程师。Claude Code团队实践与之相符,AI时代人人应成通才。

AGI Hunt
推荐文章7

《动手写AI Agent》权限与安全:让 Agent 不敢乱来

文章指出LLM不理解操作后果,不加权限的AI Agent如定时炸弹。介绍权限模型设计,采用Deny→Ask→Allow三层过滤;给出权限规则结构,用glob模式匹配工具参数;还解释用glob而非正则的原因。

AI Reading Hub
产品应用8

Claude Code 推出 /Ultraplan,超级计划模型

Claude Code 推出 `/ultraplan` 功能,在写代码前提供可视化方案,可编辑、审批。还发布了 Claude for Word 集成微软 Office 套件。Anthropic 迭代快或因内部使用更强的 Mythos 模型。

AGI Hunt
算法论文8

静态稀疏已死:Flux Attention 开启长文本 LLM 自适应推理新时代

文章指出长上下文LLM高效推理面临性能与效率难题,先介绍Elastic Attention打破静态稀疏桎梏,后重点阐述全新的Flux Attention,它将动态稀疏注意力范式升级为层级别路由,解决了算法与硬件的矛盾,在多方面实现突破。

深度学习自然语言处理