代码评估」共找到 2297 篇相关文章

新闻资讯7

The Batch: 871 | Mistral测量了大语言模型的能耗、水耗与物料消耗

法国AI公司Mistral发布对Mistral Large 2的环境分析报告,涵盖全生命周期影响。研究表明单次使用影响小,但累计负担大。虽研究有不足,但其方法或推动环保型AI发展。

DeeplearningAI
新闻资讯7

一觉醒来,GitHub没了?CEO辞职,微软接管,开发者天塌了

GitHub CEO Thomas Dohmke宣布辞职,GitHub将不再独立运营,整体并入微软新成立的CoreAI工程集团。微软不再为其找新CEO,由多位微软高管分管。GitHub将成微软AI时代‘武器库’。

新智元
新闻资讯7

AI编程「反直觉」调研引300万围观!开发者坚信提速20%,实测反慢19%

非营利性 AI 调研机构「METR」对 AI 编程工具影响开发者效率进行随机对照实验,结果意外:开发者本坚信提速 20%,实测却慢 19%。还分析了原因,指出调研局限与未来展望。

机器之心
开源动态8

用视频存储文本的黑科技!

memvid-rs是memvid的Rust重实现,可将文本文档编码为视频二维码实现存储和检索。它有高性能、用TRUE机器学习等特点,兼容多格式、跨平台,无需安装,适合存档文本语料库等。

GitHubStore
新闻资讯7

Nature:博士太多,高校已经装不下了!

过去几十年全球博士毕业生数量爆炸式增长,远超学术界职位空缺。如今就业从学术界转向工业界,未来博士教育培养模式应转变,产学研结合,以匹配劳动力市场。

新智元
新闻资讯7

大模型全员0分!谢赛宁领衔华人团队,最新编程竞赛基准出炉,题目每日更新禁止刷题

谢赛宁等人出题,让o3、Gemini - 2.5 - pro等模型全军覆没。LiveCodeBench Pro是实时基准测试,题库每日更新。此前称LLM编程超人类专家,本次测试并非如此,最好模型难题通过率也为0。

量子位
算法论文7

智能体自己出现问题自己找!首次提出“自动化失败归因”课题 | ICML2025 Spotlight

LLM Multi - Agent系统失败诊断难,阻碍迭代优化。宾夕法尼亚州立大学等机构研究者首次提出“自动化失败归因”课题,构建Who&When数据集,开发评估多种归因方法,实验揭示当前方法不足。

量子位
新闻资讯7

3200+ Cursor 用户被恶意“劫持”!贪图“便宜 API”却惨遭收割, AI 开发者们要小心了

近日,网络安全研究人员标记出三个恶意 npm 软件包,攻击 Cursor 编辑器 macOS 版用户,超 3200 次下载。这些包伪装提供‘最便宜 API’窃取凭据、替换代码,还凸显供应链威胁。

InfoQ
开源动态8

视频生成比播放还快:开源VDN-H3,14秒视频11秒搞定

近期,网络出现“无限流”视频,源于MiniMax H3。OpenVDN团队开源Video Delta Net(VDN),基于MiniMax H3使视频生成速度提升75到90倍,14.4秒的768p视频11.23秒就能生成。它采用混合思路,性能提升显著。

AI工程化
推荐文章7

Anthropic:现在学习FDE,年薪百万!

Anthropic大佬分享FDE岗位价值,指出其非外包,是面向客户的软件工程师。还阐述适合的人才、团队,纠正三大误区,强调客户买的是解决问题的过程,现场沟通能力正升值。

探索AGI