推理智能体」共找到 5499 篇相关文章

开源动态7

Claude Code 写十万行代码,读一篇公众号就废了

Claude Code 读链接力弱,qiaomu - markdown - proxy 这个 Claude Code Skill 可解决。它按 URL 类型走不同通道抓内容转 Markdown,全程免费,安装简单,解决了 Claude Code 系统性短板。

CourseAI
产品应用7

Claude Code 出学习模式,比ChatGPT更激进:甚至给你部署作业……

Anthropic为Claude Code和Claude应用出全新学习功,Claude Code支持切换交流风格,Learning模式像结对编程,会留作业。Claude实现方式比ChatGPT激进,开发者反响热烈,标志其向更智教育方向发展。

AGI Hunt
开源动态8

Hugging Face 出 GOLD:让不同模型家族也做知识蒸馏

Hugging Face研究团队提出GOLD方法,解决了知识蒸馏中老师和学生模型需用同一套分词器的痛点,让不同模型家族间也做知识蒸馏。它通过三步解决跨分词器蒸馏,实验效果良好,已集成到TRL库。

AI工程化
产品应用7

李飞飞World Labs双模齐发,「造」超复杂大场景,一手实测

李飞飞的 World Labs 出 Marble 1.1 和 Marble 1.1-Plus 两款模型。Marble 1.1 提升视觉效果,Marble 1.1-Plus 生成更大更复杂场景。官方建议初用选 Marble 1.1,创建大场景用 1.1-Plus,还给出了实测和网友案例。

机器之心
算法论文8

首篇WebAgents综述:大模型赋AI Agent,实现下一代Web自动化

互联网任务重复繁琐,香港理工大学研究人员从架构、训练和可信性等角度,总结WebAgents代表性方法,梳理研究进展。WebAgents根据用户指令完成网页任务,其发展预示人机关系新纪元。

新智元
算法论文7

奖励是假的,让Qwen提升25%性却是真的!

华盛顿大学博士生团队用Qwen模型对虚假奖励进行RLVR,使MATH - 500准确率显著提升约25%。研究发现RLVR不考虑奖励正确性,还分析了虚假奖励有效的原因,提示现有研究要在非Qwen模型验证。

量子位
推荐文章7

为什么软件工程治理很重要:降低风险但不拖累速度

Sarah Wells 在哥本哈根 Goto 会议称,软件工程治理助团队决策、支持价值交付。糟糕治理会拖慢进度、增加成本。技术策略和组织技术雷达可辅助决策,还从 DORA 力学治理。

InfoQ
新闻资讯7

Sora 2 惊现 LLM 力,视频生成模型也理?

Sora 2在科学理基准测试中获55%成绩,虽不敌GPT - 5,但一个视频生成模型理令人惊讶。Epoch AI实验发现其可借LLM重写提示词答题,网友也证实背后或有GPT - 4o等处理。此外,Google研究显示视频模型经大量训练或有力。

AGI Hunt
产品应用8

17岁高中生做出AI神器:看一下视网膜,就识别自闭症和多动症

美国17岁高中生Edward Kang开发AI工具RetinaMind,通过视网膜图像识别自闭症和多动症,准确率达89%,还分析疾病基因机制。该成果助他获2026年Regeneron科学天才奖二等奖及奖金。

DeepTech深科技
开源动态8

美团又上新模型,8个Thinker齐开工,顶个诸葛亮?

临近春节,美团 1 月 15 日更新 LongCat - Flash - Thinking - 2601 模型。它有 5600 亿参数,引入重思考模式,智力提升。实测表现佳,适合特定场景,其技术改进独特,还将出 ZigZag Attention。

机器之心