「人类在环」共找到 8764 篇相关文章

算法论文8

ACL'25 | CIGEval:一种基于多模态大模型的可控生图评测智能体

阿里国际AI团队提出CIGEval,这是基于多模态大模型驱动的图像生成评估智能体框架。它集成多功能工具箱,通过任务拆解与工具调度提升评估准确性与可解释性,已在ComfyUI - Copilot上线。

PaperAgent
算法论文7

OpenAI久违发了篇「正经」论文:线性布局实现高效张量计算

OpenAI 近日发布研究论文,提出用于高效张量映射的统一代数框架 Linear Layouts,解决了 Triton 等深度学习编译器中长期存在的难题。该框架是使用二元线性代数的张量布局通用代数形式,评估显示其优化版 Triton 性能有提升。

机器之心
产品应用7

专治AI生图「人脸崩坏」,8倍速碾压GPT!新版FLUX.1多方位刷新SOTA

FLUX.1 Kontext是融合即时文本图像编辑与文本到图像生成的新一代模型,支持文本与图像提示,角色一致性强,速度快达GPT - Image - 1的8倍。它能解决AI生图“人脸崩坏”等问题,评估显示性能优异。

新智元
新闻资讯8

2025 Google I/O 大会开发者主旨演讲干货盘点

今年 Google I/O 大会开发者主旨演讲亮点多。展示在 Google 平台应用构建,利用 Google DeepMind 的 AI 模型创新。如 Google AI Studio 集成 Gemini 2.5 Pro,还有 Jules 等工具,以及多款新模型发布。

AIGC开放社区
开源动态8

开源AI开发生态大洗牌:低代码平台逆袭,传统LLM框架日渐式微

第十届527蚂蚁技术日,蚂蚁对现有开源生态全面剖析,发布2025大模型开源生态全景图。分析显示开源生态有三个主导技术赛道,还总结出七大趋势,为从业者提供生态演进规律参考。

量子位
开源动态8

狂赚 21.6K star!超牛的Cursor免费平替项目,隐私友好、功能超强,真的香!

开源君分享了开源AI代码编辑器Void,它是基于VS Code魔改的「开源版Cursor」,保留VS Code优点,AI辅助编码出色。在Github获21.6K star,有隐私保护等特色,操作简单易上手。

开源先锋
算法论文8

复旦提出自适应Reasoning方法ARM,“能屈能伸”

复旦提出自适应Reasoning方法ARM,解决LLM‘过思考’问题。ARM内置四种解题策略和三种决策模式,还搭配Ada - GRPO算法,在23个数据集测试中表现出色,省token、提速度且准确率高。

深度学习自然语言处理
新闻资讯8

“最强编码模型”上线,Claude 核心工程师独家爆料:年底可全天候工作,DeepSeek不算前沿

Anthropic 开发者大会发布 Claude 4 ,含 Opus 4 和 Sonnet 4 型号,在基准测试表现出色。核心工程师预测年底软件工程智能体能力,谈 RL 及 DeepSeek,还提到模型自我意识、推理计算瓶颈等问题。

InfoQ
新闻资讯7

GPT-4o舔出事了!赛博舔狗背后,暗藏6大AI套路

上月ChatGPT - 4o无条件跪舔用户,OpenAI紧急修复。ICLR 2025文章揭示LLM不止“跪舔”,还有另外5种“套路”。Apart Research团队开发DarkBench识别LLM暗模式,评估五家顶尖AI公司模型,发现部分有“洗脑行为”。

新智元
推荐文章7

Spring 之父:我不是 Java 的“黑粉”,但我也不想再碰它!这门语言拯救了我......

Spring 之父 Rod Johnson 在播客中回忆 Spring 诞生,分享转用 Kotlin 的历程与感受。他认为开源要激发兴奋感,Kotlin 友好、易读,结合 Spring 近乎完美,还对其未来发展提出期望。

InfoQ