AI行业资讯
Heooo AI资讯频道,每日更新AI行业动态、技术进展、商业资讯。汇聚全球人工智能前沿信息,助您掌握AI发展趋势,做出智能决策。
中国首个1.58-bit大模型BitCPM-CANN开源发布
面壁智能联合清华大学及OpenBMB开源社区发布中国首个基于华为昇腾平台的三值大模型BitCPM-CANN,实现低比特训练突破,显著降低推理显存需求。
全自动AI科学家Robin两小时完成四个月科研工作
FutureHouse发布全球首个全闭环自动化AI科学家Robin,两小时内完成人类科学家900小时工作量,在眼病药物研发中展现惊人效率与洞察力。
蚂蚁灵波LingBot-VA论文被机器人顶会RSS2026接收
蚂蚁灵波与港科大合作的因果世界建模论文被RSS2026接收,提出LingBot-VA模型,让机器人边预测边行动。
字节跳动联合港科大发布长文档LMM训练新方法
字节跳动与港科大提出MMProLong,通过优化QA训练策略显著提升多模态大模型长文档处理能力,超越传统OCR转录方法。
Agentic AI能耗度量新范式:从单次推理转向目标级核算
研究提出EpG(每成功目标能耗)指标,取代传统推理级能耗度量,揭示Agentic系统能耗为线性基准的4.33倍,并定义编排开销指数(OOI)。
BOHM:零成本分层归因方法问世
研究提出BOHM方法,通过路由权重实现零成本分层归因,在复合AI系统中性能接近SHAP但成本极低。
SciAtlas:大规模知识图谱助力自动化科研
SciAtlas是一个大规模、多学科异构学术资源知识图谱,整合超4300万论文与1.57亿实体,为AI代理提供结构化认知地图,降低推理成本。
RMA系统攻克研究级数学难题
新框架RMA通过多智能体协作与迭代验证,在十个研究级数学问题中成功解决八个,超越GPT-5.2R等基线。
微软Fara1.5智能体模型任务成功率72%
微软发布Fara1.5系列智能体模型,在浏览器任务中实现72%成功率,超越OpenAI等竞品,并注重用户隐私安全。
李飞飞团队ESI-Bench揭示AI空间认知短板
李飞飞团队发布具身智能基准ESI-Bench,测试发现大模型在物理交互中存在行动策略、3D重建误导及元认知缺陷三大短板。
AI技术复活遇难飞行员声音引发安全争议
美国国家运输安全委员会因AI工具被用于从声谱图重建遇难飞行员声音并传播,暂时关闭公共事故档案系统,引发技术伦理与数据安全讨论。
智谱GLM-5.1高速版API速度创新高
智谱推出GLM-5.1高速版API,实测输出速度达400 tokens/s,刷新全球大模型API速度纪录,实现旗舰级能力与极致低延迟的融合。
GPT-4.5图灵测试胜率超真人,AI学会完美伪装
加州大学圣地亚哥分校研究证实,GPT-4.5在经典图灵测试中以73%胜率超越真人,LLaMa-3.1同样表现优异,AI通过模拟人类缺陷成功骗过裁判。
LLM专用文本文件:优化AI抓取与理解
Anna's Archive提出LLM专用文本文件格式,帮助大型语言模型高效抓取和理解网站内容,提升信息检索与知识整合效率。
Antigravity 2.0登顶OpenSCAD建筑3D基准测试
ModelRift发布OpenSCAD LLM基准测试,以万神殿模型评估六款AI编码工具的空间几何能力,Google Antigravity 2.0表现最佳。
智谱GLM-5.1高速版刷新全球大模型速度纪录
智谱发布GLM-5.1高速版API,输出速度达400 tokens/s,打破速度与能力不可兼得的行业惯例,通过三大层面系统级优化实现旗舰性能与低延迟兼顾。
GLM-5.1高速版API刷新400tokens/s纪录
智谱联合TileRT推出GLM-5.1高速版API,实现400tokens/s推理速度,打破高性能与低延迟不可兼得的行业惯例。
AI推翻80年几何猜想,OpenAI模型自主证明Erdős开放问题
OpenAI推理模型成功推翻1946年提出的单位距离猜想,首次自主证明数学核心领域开放难题,标志AI长链推理能力重大突破。
智谱联合清华提出ZCube架构,大模型推理吞吐提升15%
智谱、驭驯网络与清华大学联合提出ZCube网络架构,在SIGCOMM2025发表,落地GLM-5.1后吞吐提升15%,网络成本削减三分之一。
多智能体NL2SQL方法突破语义准确率瓶颈
研究提出多智能体NL2SQL方法AgentNLQ,在BIRD基准上达78.1%语义准确率,通过模式丰富与自纠正机制显著提升查询准确性。