「多视角评估」共找到 4795 篇相关文章
能导出 PSD 的 AI 设计工具,出现了
国内 Seede AI 团队发布海外新产品,无需写咒语,填文案信息就能让 AI 搞定排版等。它生成可编辑源文件,适合有内容但不会设计的人,还支持多格式导出,不过不擅长创意生图。
我们做了比你更懂 Java 的 AI-Agent -- Arthas Agent
Arthas是强大的Java诊断工具,但门槛高。Arthas Agent可将自然语言意图转化为Arthas操作,输出诊断报告。它技能优先、安全优先、循证闭环,通过多案例展示其诊断优势,还介绍使用方法和提效建议。
小鹏汽车:没有基座模型,何谈物理AI|甲子光年
3月2日,小鹏汽车宣布第二代VLA正式推送。何小鹏认为,端到端小模型无法让自动驾驶从L2跨越到L4,而第二代VLA开创全新物理模型范式,能直接学习真实物理世界,还在不断迭代提升。
chardet 从 LGPL 变 MIT:一场 AI 重写引发的开源风波
Python 编码检测库 `chardet` 发布 `7.0.0` 后,许可证从 `LGPL` 变为 `MIT`,维护者称借助 Claude Code 重写。原作者反对,认为维护者无权重新授权。维护者给出辩护,社区反应激烈,争论涉及多个法律问题和不同立场。
DeepMind新论文炸锅:AI全自动进化算法,写出专家都想不到的解,网友:这可能就是“王牌”
谷歌DeepMind让LLM驱动的智能体AlphaEvolve改写、进化算法代码。选定CFR、PSRO框架,只开放关键决策逻辑给LLM,通过生成、运行、评估、筛选循环,进化出VAD - CFR和SHOR - PSRO算法,表现超人类手工版本。
如果你还在犹豫要不要尝试 OpenClaw,试试这个 App 一键部署方案
作者推荐 OpenClaw 这款开源产品,它像钢铁侠的 AI 助手贾维斯,可与通讯协同软件协作。还介绍用百度智能云 1 分钱部署 OpenClaw,阐述其配置、应用及价值,称 AI 会成基础设施。
国产模型编程能力卷到这个程度了?MiniMax-M2.5 深度实测
文章深度实测MiniMax-M2.5编程能力,用其开发多款游戏和点名工具,结果出色。还分析其底层技术,如原生Agent RL框架、过程奖励机制等,指出它性价比高,虽有不足但值得关注。
ICLR 2026 oral | AI代码真能进生产环境?SwingArena:从「写对代码Commit」到「通过CI审查」
过去一年大模型写代码能力提升,人们思考其能否参与软件工程核心流程。现有评测基准有缺失,SwingArena填补空白,将博弈引入评测,设计检索增强流水线,其开源后或成评估AI编程能力新工具。
训练加速1.8倍,推理开销降78%!精准筛选题目高效加速RL训练丨清华KDD
清华大学THU-IDM团队与慕尼黑大学CompVis团队合作提出MoPPS框架,解决强化微调代价高问题。它精准挑题,预测难度,开销低、动态适应且平衡探索利用,在多任务表现佳,降本增效,有新范式。
登顶Hugging Face论文热榜,LLM重写数据准备的游戏规则
企业数据团队面临数据准备难题,传统方法依赖人工规则,有诸多局限。上海交通大学等机构研究团队综述指出,LLM正推动数据准备从“规则驱动”向“语义驱动”转变,还给出技术选型、评估基准及工程指南。