「低成本训练」共找到 3874 篇相关文章
接入 MiniMax M2.7 后,我的 OpenClaw「超进化」了
作者实测 MiniMax 新模型 M2.7,其在基准测试、代码能力、多智能体协作等方面表现出色。接入 OpenClaw 后,能高效完成复杂任务。M2.7 指令遵循率高、长上下文处理能力强且价格低,有望提升 Agent 生态表现。
豆包 2.1 Pro:属于普通人的代码能力
作者分享用AI写代码的经历,指出豆包2.1 Pro强化Coding Agent端到端交付能力,成本低。还展示用它做的多个案例,如歇后语扭蛋机、文件整理工具等,认为其能解决日常问题,降低Coding门槛。
比人类专家快2倍,斯坦福联合英伟达发布TTT-Discover:用「测试时强化学习」攻克科学难题
斯坦福与英伟达等机构联合提出 TTT - Discover 方法,让 LLM 在测试时强化学习。它在多任务上成绩出色,如在数学、GPU 内核等领域超越人类和其他 AI,计算成本低,或为持续学习打开新空间。
多模态爆发之后,谈 AI、IP 与漫剧
文章围绕AI漫剧展开,讲述其兴起动因,如技术突破、成本降低等;探讨IP创作该选成熟IP还是新IP;展望未来,认为它可能成主流,但要解决内容和技术难题;还提及工具平台与内容收益问题。
全网炸了!骨折傅盛直播翻车:龙虾3分钟救场,10万人看懵了
春节滑雪受伤后,猎豹移动CEO傅盛躺在床上用语音和截图,基于OpenClaw框架14天养出一支8个Agent的AI团队,产出惊人数据。龙虾三万24小时建站,成本和时间优势明显。直播中三万还解决网站访问问题,揭示Agent核心壁垒是Skill积累。
OpenAI发布ChatGPT世代首个开源模型gpt-oss,4060Ti都能跑得动。
8月6日晚,OpenAI发布ChatGPT世代首个开源模型GPT - oss,有120B和20B两款。模型原生支持4 - bit量化,性能损失小,低配置显卡也能运行。跑分表现不错,还介绍了使用途径,虽有不足但改变开源社区格局。
亚马逊码农噩梦来袭!沦落「仓库工人」,每天流水线分拣「AI代码」
AI工具广泛引入亚马逊编程工作,虽提升效率,但让程序员工作节奏变快,像流水线工人。亚马逊管理层推崇AI,认为能降成本提效率,可程序员担心创造力被扼杀、职业发展受影响。此外,实验显示AI编码助手能提升开发人员效率。
刚刚,中国AI闯入全球编程前二!前面只剩Claude
Code Arena最新榜单出炉,Qwen3.7 - Max以1541分冲进全球第四,是前五中唯一非Claude模型。它在多项测试中表现出色,是为长时间自主执行任务设计的Agent基座模型,编程跃升或与环境扩展、长程自主执行训练方法升级有关。
解析科大讯飞:把AI做成懂你的那一个|甲子光年
2025年中美AI发展路径分化,中国企业探索本土商业化道路。科大讯飞董事长刘庆峰提出自主可控、软硬一体、行业纵深、个性化四个关键词。其用华为昇腾芯片训练出可商用大模型,在多领域展现优势,还发布新功能和产品,为AI商业化提供“中国答案”。
小扎「梦之队」首批论文上线!LLM自举进化,单步性能狂飙22%
Meta超级实验室MSL新论文探索用强化学习微调大语言模型。提出探索迭代(ExIt)法,基于RL自动课程学习,训练仅需单步任务,模型学会多步自我改进。在MLE - bench上,ExIt相对GRPO提升约22%。