「代码评测」共找到 2222 篇相关文章
对话关梦龙:他想用 Agent 拯救你手机里的 100G 废片
前字节跳动剪映早期成员关梦龙,正开发AI编导产品“Cutto”,让AI参与内容生成,降低普通人创作门槛。他认为AI虽提升生产力,但创业竞争更激烈,产品成功需看用户能否持续使用。
9.8K Star!谷歌开源神器 OSV-Scanner,一条命令扫出所有依赖漏洞!
文章介绍谷歌开源的轻量级命令行工具 OSV - Scanner,它能扫描项目依赖中的已知安全漏洞,连接项目依赖与 OSV.dev 数据库。支持多语言、多包管理器,有多种功能,可离线使用,还能提供修复建议和许可证扫描。
ESLint v10 发布,但有开发者已经在考虑换 Biome 了
广泛使用的代码检查工具 ESLint 发布 v10 版本,完成架构调整,移除旧版配置系统,改进查找配置文件方式等。但生态兼容性有问题,迁移成本高,部分开发者考虑换用 Biome 等替代工具。
程序员都在给AI当“监工”!7万多条编程消息揭开当前编程现状
圣母大学和范德堡大学研究团队剖析超7万条编程指令,揭示开发者与AI编程助手协作现状。开发者多当“监工”,工作从敲代码转向指导AI、诊断错误等,还总结出人机协同的诸多规律。
CVPR 2026 | 让AI视频不再「串戏」:免训练精准控制多段动作,SwitchCraft一招破解逻辑崩坏
随着文本到视频扩散模型发展,AI视频生成有进展,但开源模型处理多事件提示词时存在技术瓶颈。西湖大学团队提出免训练框架SwitchCraft,引入注意力控制机制,入选CVPR 2026,代码已开源。
yann lecun(杨立昆)新公司AMI融资10亿美元,要做LLM的替代品
Yann LeCun离开Meta后与Alexandre LeBrun创立AMI Labs,获10.3亿美元融资。他们认为LLM有幻觉问题,AMI Labs用JEPA架构构建‘世界模型’,代码和论文将开源,不过短期内无产品和收入。
CVPR 2026 | AI寒武纪时刻?字节世界模型新作,仅靠视觉学习真实世界知识
豆包大模型团队与北京交通大学联合提出视觉世界模型 “VideoWorld 2”,无需依赖语言模型,仅靠视觉信息让机器掌握复杂能力。它能完成复杂手工任务,成功率远超主流模型,代码与模型已开源。
给GUI Agent装上「世界模型」:阿里通义用混合数据+统一思维链,让模型学会预判屏幕变化
伴随多模态大模型发展,GUI Agent成人机交互新范式,但构建高可用、跨平台的GUI Agent面临诸多挑战。阿里通义实验室开源Mobile - Agent - v3.5框架及GUI - Owl - 1.5模型家族,解决了相关技术壁垒。
AI编程的下半场来了?学会用Agent Skill解决编程的痛点问题
文章分享用 Agent Skill 解决 AI Coding 痛点的实操复盘,如让代码上线、解决 AI 不用 Skill 问题。介绍 Skills 原理、CloudBase Skills 优势及与 MCP 组合,还给出实战案例、踩坑经验和未来规划。
清华刘洋团队论文:揭示为何 70B 的医疗模型,反而不如 8B 会问诊丨ILCR 2026
在医疗AI领域,模型静态评测与临床问诊能力存在断层。清华刘洋团队提出DOCTOR - R1,将临床问诊建模为POMDP,用强化学习训练。实验验证了其有效性,对医疗AI发展有深远启示。