「AI编程模型」共找到 13638 篇相关文章
从单领域到多能力协同:数据混合如何重塑AI的强化学习
上海AI Lab的OpenDataLab团队通过大规模实验剖析可验证强化学习(RLVR)在多领域推理中的机制,发现逻辑与数学数据相互支持、代码推理有跨领域混合效应等,为构建AI推理模型提供关键发现。
港科广等发布首个医学世界模型!精准模拟肿瘤演化,规划治疗方案
医学世界模型(MeWM)是创新AI系统,能模拟疾病演变、预测肿瘤变化,助医生术前评估治疗效果、优化方案。港科广等团队提出该模型,有肿瘤演变模拟等三核心贡献,在多方面实验表现佳。
交大系杀出具身赛道重围!1万台订单在手,以世界模型重塑万亿城市基建
物理AI成新征途,通用机器人面临工程难题。酷哇科技发布COOWA WAM 2.0世界模型,实现范式升级。其有四大技术支柱,助力机器人发展。酷哇预计2026年交付超万台机器人,还构想了“Robo City”图景。
对话 Ruby on Rails 之父:发自内心恨透 Copilot,手凿代码才是程序员的乐趣
传奇程序员 DHH 做客播客,深入探讨世界观。他虽用 AI 学习,但担忧 AI 编程助手致技能退化,‘恨透’它。还谈及编程经历、语言看法、架构偏好、商业哲学等,观点鲜明,引发关注。
ACL2025 | 代码助手火了,但安全吗?所有模型评估结果都很扎心
近期,GitHub Copilot、ChatGPT等AI代码生成工具爆火,效率显著提升,但代码安全性存疑。北大团队用CoV-Eval评测20款主流大模型,结果不佳,论文还给出优化方向,呼吁代码上线前严格测试。
性能碾压GPT-4.1-mini!Mistral开源Devstral,还能在笔记本上跑
法国AI初创公司Mistral与All Hands AI合作,发布全新开源语言模型Devstral,有240亿参数,所需算力低,可本地部署。它能解决真实GitHub问题,在SWE基准测试中表现优于多个模型,还能通过API访问。
告别「只会相似度检索」:腾讯最新T-Mem让AI学会「联想回忆」
当前大语言模型长期记忆方案均基于相似度检索,存在结构性盲区,无法在无字面/语义相似时召回关联记忆。腾讯团队提出T-Mem,实现AI联想回忆,已被EMNLP 2026接收,代码开源并上线QQ AI伙伴。
AI发现新物质,仅用200小时!不写一行代码,筛选36.7万种物质
微软在Build大会推出企业级AI科研平台Microsoft Discovery,结合专业AI Agent与高性能计算。它能让无编程背景人员用自然语言使用超算与模拟系统,200小时筛选36.7万种物质找新冷却剂。
Harness Engineering:耗时一周,我是如何将应用的AI Coding率提升至90%的
文章结合Anthropic、OpenAI方法论与项目实践,分享为存量Java应用构建Harness体系,将AI代码率从不到25%提至90%的方法。介绍Harness概念、现状挑战、实战步骤、关键经验及效果,还对其未来发展做了展望。
几分钟扫完细菌全基因组,MIT团队用AI找出大量未知的抗病毒防御系统
MIT科学家开发AI模型DefensePredictor,能从细菌基因组快速找防御系统。用约1.7万个细菌基因组训练,借助ESM2蛋白语言模型,几分钟扫描完一个细菌全基因组,还开源供科学界使用,潜力巨大。