智快网
快讯 行业 产业 汽车 科技 AI+ 热点
英伟达开源框架Polar:助力代码智能体训练,SWE-Bench分数显著提升
IT之家注:GRPO 是一种面向强化学习训练的优化方法,会依据奖励信号调整模型策略,让模型在多步决策任务里学会更优动作。论文还把初始化、运行中、后处理拆到独立工作池,并设置 READY 缓冲区,让运行时预…

2026-05-29

两部门联合发布《人工智能计量体系和能力建设指引(2026版)》 助力AI产业高质量发展
针对算法“黑箱”、决策可解释性差等痛点,《指引》部署AI系统内部状态监测与表征等关键技术攻关,推动建立人工智能可靠、安全、可信计量标准,实现AI技术性能“可测量、可比较、可追溯”。“十五五”规划纲要提出推进量…

2026-05-29

Claude Opus 4.8发布:AI学会承认不确定,诚实度成新核心卖点
在对齐评估中,Opus 4.8在亲社会特质(比如尊重用户自主权、为用户利益着想)上达到了新高,而欺骗、配合滥用等「不对齐行为」的发生率大幅低于 Opus 4.7,接近Anthropic 目前对齐表现最好…

2026-05-29

Grok Build 0.1编程实战表现亮眼,成本低于竞品获马斯克盛赞
月 29 日消息,AI 编程智能体 IDE 工具 Kilo Code 今天在 X 平台发布系列图文,分享了 Grok Build 0.1实战开发报告,称构建交付服务过程零工具调用失败,且成本低于 GPT-5…

2026-05-29

iOS 27前瞻:苹果重塑Siri,多模态交互与AI网页搜索功能齐升级
苹果公司“彻底重做”Siri,将其从一款语音助手升级为具备多模态交互能力的AI平台。 核心内容包括:重新设计的Siri界面、引入谷歌Gemini技术的全新底层模型、AI驱动的网页搜索功能,以及一款对标Chat…

2026-05-29

Blackwell架构引领新潮,AI大模型密集发布,能力跃迁与商业变革双加速
花旗研究把"首批基于Blackwell架构训练的模型"列为近期AI竞争中最关键的技术催化剂,逻辑很直接:目前所有排在前沿模型榜单上的产品,包括OpenAI GPT-5.5(花旗AI智能指数60)、谷歌Gem…

2026-05-29

Anthropic完成H轮融资,Opus 4.8发布,动态工作流引领AI协作新趋势
官方在新闻稿末尾是这么写的:“Opus 4.8相比Opus 4.7,并没有很夸张的提升,更多的是那种用户真正用起来后,才能感受到的细节升级。”Opus 4.8发布的同时,Anthropic还推出了几项功能…

2026-05-29

亚马逊关停内部AI排行榜“Kirorank”:纠偏形式化倾向,回归技术实用价值
【环球网科技综合报道】5月29日消息,据《金融时报》报道,亚马逊公司宣布关闭内部 AI 评分排行榜 “Kirorank”,针对部分员工为追求排名、过度消耗算力资源的现象及时纠偏,明确倡导人工智能技术回归实用…

2026-05-29

« 上一页 1/5220 下一页 »