「好代码」共找到 2314 篇相关文章
从需求分析到代码生成,LLM都能干点啥?一文读懂291个软工Benchmark!
大语言模型重塑软件工程各环节,但缺乏评估其在该领域表现的系统工具。浙江大学等机构团队首次对291个软件工程Benchmark系统综述,分析现状、痛点并给出改进方向。
OpenAI o1核心大佬离职后首次演讲!AI智能体=人力+代码「无限杠杆」
OpenAI研究员Hyung Won Chung离职后发声,认为AI是人类历史上最强大杠杆,结合人力与科技优势。它能提升个人学习效率,智能体作为复合杠杆让小团队创造大价值,还能加速社会科学进步。
好玩!AI“穿越”新玩法火了:根据12岁照片生成23岁的你
AI“穿越”新玩法火了,外国网友让ChatGPT根据12岁照片推测23岁样子还挺准。很多人参与,还有新奇玩法。作者用不同名人照片测试ChatGPT、抖音小程序和豆包,结果各有偏差,但玩法有趣。
我用MiniMax Agent开发了个带后端的全栈网站,全程0代码
2025年Agent成AI领域焦点,大厂纷纷布局。作者测试MiniMax Agent,发现其有四大特点:深度研究和上下文管理强,多模态输出出色,编程能力超预期,能执行定时任务,还能开发带后端的全栈网站。
谷歌AlphaGenome横空出世!40亿年生命代码一键破解,或再夺诺奖
谷歌DeepMind发布AlphaGenome,可一次读取100万个DNA碱基,预测基因突变。它以长DNA序列为输入,预测数千种分子特性,克服了现有模型在序列长度和分辨率间的取舍问题,有望推动生物学研究和新疗法诞生。
大模型“拼好题”,45K数据撬动18%提升,数学问题拒绝死记硬背 | MathFusion
上海AI Lab等团队提出MathFusion,通过三种“融合策略”生成新的融合数据集MathFusionQA,仅用45K合成指令,在多基准测试中平均准确率提升18.0个百分点,增强模型解决数学问题的能力。
80%到25%逆转!大模型代码能力最新排名:Anthropic不再是唯一的神?
OpenRouter网站有模型使用排行榜,按不同使用场景分类。2024年12月到2025年2月,Anthropic模型编程流量占比曾达80%,后谷歌Gemini 2.5 Pro等抢占份额,其跌至25%以下,Claude 4发布后份额回升。还介绍了OpenRouter特点。
扩散语言模型真的会比自回归好?理论分析结果可能恰恰相反
北京大学和蚂蚁集团研究表明,扩散语言模型虽理论上有并行生成优势,但实践中在某些任务推理成本更高。研究通过实验对比,分析了扩散与自回归模型在不同评估指标下的效率,指出选择模型要视任务需求。
AI发现新物质,仅用200小时!不写一行代码,筛选36.7万种物质
微软在Build大会推出企业级AI科研平台Microsoft Discovery,结合专业AI Agent与高性能计算。它能让无编程背景人员用自然语言使用超算与模拟系统,200小时筛选36.7万种物质找新冷却剂。
AI让4岁自闭症孩子首次开口,一名工程师爸爸用两小时代码打开儿子声音
一位国外AI工程师花两小时为自闭症儿子做沟通App,让孩子首次开口表达。传统AAC设备贵且无教学和追踪功能,该App内置相关功能,核心是将抽象变具体,正完善后供其他家庭试用。