「小模型推理能力」共找到 9427 篇相关文章

推荐文章7

自构建智能体:一项 LangChain4j 实验

作者将LangChain4j文档交代码助手,让其参照构建智能体,设计多智能体系统编写、测试和调试代码。实验展示了LangChain4j优势,还对比监督者和工作流两种智能体实现模式,揭示速度与自主性权衡关系。

InfoQ
新闻资讯8

00后的他们,正在定义AI时代的新坐标丨红杉中国联合《麻省理工科技评论》中国发布“25岁以下AI创新青年先锋”

AI领域创新正由年轻一代推动。红杉中国与《麻省理工科技评论》中国发起“AI25”计划,揭晓2025年“25岁以下AI创新青年先锋”入选者名单,他们在各领域成果突出,未来还将打造AI原生社区。

DeepTech深科技
产品应用8

Claude Code太难?Coze帮你3分钟做出可变现的 Skills

Claude Code和AI Skills很火,但靠其变现困难,如安装调试复杂、不知如何推广等。Coze 2.0更新解决了这些问题,还提供长期计划能力和新年福利,可让用户无需工程能力参与AI生态价值分配。

歸藏的AI工具箱
开源动态8

刚刚,梁文锋署名开源「记忆」模块,DeepSeek V4更细节了

十几个小时前,DeepSeek 发布新论文,与北大合作,作者有梁文锋。针对大模型问题提出条件记忆,用 Engram 模块实现,已开源。结合此前研究,DeepSeek v4 模样渐清。模型性能、效率表现优,并发现 U 型扩展规律。

机器之心
新闻资讯7

阿里干死豆包图疯传,千问:相煎何太急;字节大幅涨薪,传年利润或达500亿刀;印度AI妖股近两年暴涨550倍,仅2名员工|AI周报

这篇 AI 周报涵盖多领域动态。如阿里辟谣千问全员会干死豆包图;周鸿祎遭前高管实名举报财务造假;字节涨薪并推进 AI 手机合作;多家科技公司有新品发布或业务进展等。

AI前线
新闻资讯7

奥特曼恩师力挺19岁少年!比AlphaFold快4倍,只杀害虫不伤人

2024年,18岁的Tyler Rose和19岁的Navvye Anand创办Bindwell,将AI药物研发技术用于农业,构建基础模型,研发出比AlphaFold快4倍的模型。奥特曼恩师Paul Graham建议卖知识产权授权,公司获600万美金融资。

新智元
新闻资讯7

The Batch: 883 | 美国两个州禁止人工智能驱动的心理健康治疗

美国伊利诺伊州成继内华达州后,第二个禁止用人工智能进行心理治疗的州。该法案限制聊天机器人独立治疗及其他AI使用方式,旨在保护患者和人类治疗师,但也引发对全面禁止利弊的讨论。

DeeplearningAI
新闻资讯7

AI书籍训练诉案,Anthropic与作者达成和解

Techcrunch消息,大模型平台Anthropic就Bartz诉Anthropic案与多名作者达成和解并提交文件。此前下级法院裁定其用书籍训练模型属合理使用,但涉盗版或面临高额处罚,Anthropic曾上诉,和解细节未公开。

AIGC开放社区
产品应用8

1/10成本、Opus 4.7级表现,Cursor甩出了性价比之王Composer 2.5

Cursor推出新模型Composer 2.5,成本仅为Claude Opus 4.7的1/10,性能几乎追平。它更智能,擅长处理长时任务,遵循复杂指令更可靠。未来一周使用额度翻倍,还宣布与SpaceXAI合作训练新模型。

机器之心
算法论文8

视频生成太慢?英伟达、谢赛宁等发布TMD框架,实现70倍加速

大规模视频扩散模型采样效率低,应用受限。英伟达联合谢赛宁等提出TMD框架,将大型视频扩散模型蒸馏为少步生成器。实验显示,TMD能实现超70倍加速,质量损失小,用户也更偏好其生成的视频。

机器之心