成本性能」共找到 6932 篇相关文章

开源动态7

Claude Code 写十万行代码,读一篇公众号就废了

Claude Code 读链接力弱,qiaomu - markdown - proxy 这个 Claude Code Skill 可解决。它按 URL 类型走不同通道抓内容转 Markdown,全程免费,安装简单,解决了 Claude Code 系统性短板。

CourseAI
开源动态8

Hugging Face 推出 GOLD:让不同模型家族也做知识蒸馏

Hugging Face研究团队提出GOLD方法,解决了知识蒸馏中老师和学生模型需用同一套分词器的痛点,让不同模型家族间也做知识蒸馏。它通过三步解决跨分词器蒸馏,实验效果良好,已集到TRL库。

AI工程化
产品应用7

李飞飞World Labs双模齐发,「造」超复杂大场景,一手实测

李飞飞的 World Labs 推出 Marble 1.1 和 Marble 1.1-Plus 两款模型。Marble 1.1 提升视觉效果,Marble 1.1-Plus 更大更复杂场景。官方建议初用选 Marble 1.1,创建大场景用 1.1-Plus,还给出了实测和网友案例。

机器之心
新闻资讯7

OpenAI大佬爆料:打字太慢拖后腿,人类竟了AGI短板?

OpenAI Codex负责人Alexander Embiricos称人类打字速度拖慢AGI进展。奥特曼、Amodei、马斯克等大佬也有类似看法。Embiricos认为要让AI自主审查工作,2026年或迎AGI。

新智元
算法论文8

首篇WebAgents综述:大模型赋AI Agent,实现下一代Web自动化

互联网任务重复繁琐,香港理工大学研究人员从架构、训练和可信性等角度,总结WebAgents代表性方法,梳理研究进展。WebAgents根据用户指令完网页任务,其发展预示人机关系新纪元。

新智元
算法论文7

奖励是假的,让Qwen提升25%性却是真的!

华盛顿大学博士生团队用Qwen模型对虚假奖励进行RLVR,使MATH - 500准确率显著提升约25%。研究发现RLVR不考虑奖励正确性,还分析了虚假奖励有效的原因,提示现有研究要在非Qwen模型验证。

量子位
推荐文章7

为什么软件工程治理很重要:降低风险但不拖累速度

Sarah Wells 在哥本哈根 Goto 会议称,软件工程治理助团队决策、支持价值交付。糟糕治理会拖慢进度、增加本。技术策略和组织技术雷达可辅助决策,还从 DORA 力学治理。

InfoQ
产品应用8

17岁高中生做出AI神器:看一下视网膜,就识别自闭症和多动症

美国17岁高中生Edward Kang开发AI工具RetinaMind,通过视网膜图像识别自闭症和多动症,准确率达89%,还分析疾病基因机制。该果助他获2026年Regeneron科学天才奖二等奖及奖金。

DeepTech深科技
新闻资讯7

AI赋创新玩法点燃星际热浪,2025星际争霸2锦标赛冠军出炉!

近日,2025星际争霸2锦标赛总决赛结束。赛事有全新种族加入、视角移动功增加等创新,玩法和观赛体验升级。经多轮比拼,XingMing击败caonima夺冠,赛事重塑玩家与游戏关系。

AIGC开放社区
开源动态8

一键检测你的电脑跑哪些大模型,这项目6!

介绍工具`LLMFit`,它用Rust编写,自动检测硬件配置,判断大模型否流畅运行,还可推荐最优量化版本和运行模式。该项目在Github获5.9k+ star,有多种安装方式。

开源先锋