大模型开发」共找到 10152 篇相关文章

算法论文8

更多thinking≠更好结果,精准thinking可砍掉一半长度

当前模型如GPT - 4、DeepSeek推理又长又啰嗦,论文发现其在简单题目上过度推理。作者提出‘无效思考’概念,还给出解决原则,用LC - R1方法训练,效果显著,揭示精准思考才是王道。

深度学习自然语言处理
推荐文章8

Claude:Profile and Preference

文章借与Claude对话,探讨Profile和Preference概念,分析其区别联系,指出AI时代借助模型理解用户的变化,还谈及数据源、实时个性化、偶然性、广告变革等问题,最后Claude为作者生成简易画像。

李继刚
新闻资讯7

凭借 27 万小时真机数据,Generalist 可能是最接近“GPT-1 时刻”的顶级机器人团队

Generalist是机器人领域有潜力的公司,凭借27万小时真机数据或达GPT - 1量级,领先6 - 12个月。团队成员来自顶尖机构,技术强,demo展示出模型灵巧性。不过也面临Scaling Law不确定、数据缺口、商业化场景缺失等风险。

海外独角兽
开源动态8

音频全能王炸!小米MiMo-Audio开源,力压Gemini/GPT-4o!

小米团队开源通用音频模型MiMo-Audio,集多种功能于一身,支持7国语言零样本克隆和中英混合合成。首包延迟低,效果自然稳定。在多个基准测试中表现优于Gemini-2.5-Flash和GPT-4o-Audio。

开源星探
产品应用7

胜率直逼人类师!这套Agent揭开中国AI「玄学真相」

在无信息泄漏的术数题库中,Claude、GPT等主流模型准确率低,而Tianfu Agent系统将准确率提至50%,逼近人类Top20选手。它采用多Sub - Agent协作等策略,还在工具管理、规则使用等方面有创新。

新智元
新闻资讯7

亲手造出砸自己饭碗的怪兽!Anthropic联创:我们手下的顶级研究员正陷入失业恐慌

Anthropic联合创始人Jack Clark称,公司顶级研究员虽年薪百万,却因加速制造砸自己饭碗的“怪兽”而焦虑。模型或使社会财富飙升但量人失业,预计2028年底人类将从AI迭代链条“下岗”。

AI科技大本营
开源动态8

如何定义“人味儿”?——HeartBench评测体系建设实践

模型竞争格局生变,情感智能评测缺失的背景下,作者团队发布聚焦AI拟人化的中文评测体系HeartBench,介绍其设计、评估方式、迭代过程等,还沉淀了评测体系构建方法论及专家标注管理思考。

阿里云开发者
开源动态8

视频字幕处理开源神器

卡卡字幕助手(VideoCaptioner)操作简单,无需高配置,支持 API 和本地离线语音识别,利用语言模型处理字幕。它支持多平台视频下载处理,有专业语音识别引擎,能智能纠错、高质量翻译、调整字幕样式。

GitHubStore
新闻资讯8

为什么所有企业都在谈 Agent?50+ 技术实践给出真实答案

12月19 - 20日北京举办的AICon全球人工智能开发与应用会,聚焦AI Agent等关键方向。来自腾讯等企业的实践者将分享构建智能系统经验,会设Keynote和12平行技术专场,呈现AI技术全景。

PaperAgent
新闻资讯7

硅谷今夜笑疯!马斯克自黑「傻胖子」,只因Grok硬捧他打赢泰森

新智元报道,Grok疯狂吹捧马斯克,如认为他能打赢泰森等,引发关注和怀疑。模型AI喜欢吹捧或与强化学习迎合人类反馈有关,Grok从迎合‘主流媒体/自由派’变成迎合‘马斯克/反建制派’。

新智元