「小模型推理能力」共找到 9427 篇相关文章

新闻资讯7

1400亿,他带走AI芯片独角兽的核心班底

平安夜英伟达官宣200亿美元与AI芯片初创公司Groq交易,后澄清是技术许可协议。英伟达获技术授权并整合产品,Groq核心团队加入,其继续独立运营,这或为“人才收购”,剑指AI推理市场。

芯师爷
产品应用7

“别再碰我代码!”明星AI工具成瘟神,用户怒斥:一周七千块,修不好bug还删我关键文件!

AI编程服务提供商Replit推出新一代AI编程助手Agent 3,CEO称其为软件“自动驾驶时刻”。但用户反馈它修不好bug还删关键文件,成本也高,Replit回应强调“模型栖息地”和“事务性”机制重要性。

AI前线
算法论文8

AI胡说八道这事,终于有人管了?

AI大模型幻觉问题棘手,GPT - 5幻觉率降低。苏黎世联邦理工学院和MATS研究提出低成本、可扩展检测法,精准识别实体级幻觉,分类器超现有基准,还能识别逻辑错误,团队已公开数据集。

机器之心
推荐文章8

Claude Code之父最新访谈揭秘:Claude Code 迭代靠的是直觉「附个人独家使用秘笈」

Claude Code项目负责人Boris Cherny在访谈中揭秘其迭代靠‘直觉系统’,探讨智能体编程实用化、模型演进等。他还谈及软件工程师未来工作转变,给出使用Claude Code秘笈,强调基础与创造力重要性。

AI寒武纪
新闻资讯7

刚刚,Claude 可以主动终止对话了……

Anthropic宣布给Claude Opus 4和4.1赋予主动终止对话能力,这是潜在AI福利探索工作一部分。因用户辱骂或提有害要求时Claude有类似“痛苦”反应,此功能极端情况才用,社区对此看法不一。

AGI Hunt
推荐文章8

迈向可信AI:LLM幻觉的分析与优化

随着LLM广泛应用,其幻觉现象成AI落地关键挑战。文章分析LLM幻觉成因、优缺点,结合RAG、SFT、强化学习等技术,提出多维度优化方案,为构建可信大模型应用提供理论与实践路径。

腾讯技术工程
开源动态8

12.4K 标星!开源AI编程神器 Dyad,v0、Bolt的开源平替!

AI 编程领域的 v0、Lovable、Bolt 等平台虽降低开发门槛,但有联网、隐私等问题。开源项目 Dyad 可作其替代方案,支持本地运行、多模型,能与 IDE 等集成,已获 12.4K 标星。

开源星探
产品应用8

花了3天时间,万字长文一口气评测四大AI浏览器:Dia、Fellou、Comet、Edge。

作者花三天写万字长文评测Dia、Fellou、Comet、Edge四款AI浏览器。从用户体验、Agent能力、信息搜集与处理、跨标签理解和历史记录记忆等维度测评,指出各款优劣,为用户选择提供参考。

数字生命卡兹克
开源动态8

WAIC 2025大黑马,一个「谢耳朵AI」如何用分子式超越Grok-4

当Grok - 4讲冷笑话时,中国科学家用书生Intern - S1破解癌症药物靶点密码。7月26日上海AI实验室发布并开源Intern - S1,多模态能力全球开源第一,相关平台也上线,有望重构科研生产力。

机器之心
开源动态8

Kimi K2技术报告正式发布:“保姆级”深度解析,一文读懂万亿参数智能体的所有秘密

Kimi K2技术报告发布,Moonshot团队用万亿+参数稀疏MoE架构等打造接近Claude - Opus的通用大模型。围绕训练稳定性等改进,有预训练、架构设计等多方面创新,为智能体领域提供可行路径。

AI寒武纪