AI行业资讯

Heooo AI资讯频道,每日更新AI行业动态、技术进展、商业资讯。汇聚全球人工智能前沿信息,助您掌握AI发展趋势,做出智能决策。

微软Copilot漏洞被披露可窃取隐私

安全公司Varonis研究员发现微软Copilot存在安全漏洞,攻击者可利用?autorun=1和?q=参数绕过用户确认,诱导受害者点击恶意链接后自动窃取收件箱邮件内容、密码等敏感信息,并将数据以Base64编码外传至攻击者服务器。

# 技术进展Heooo AI工具导航08月19日11时01分 30

Anthropic神秘披露Model 2 综合能力略超Claude Mythos 5

Anthropic在2026年8月风险报告中意外透露未发布的Model 2模型,其多项任务性能优于当前公开最强模型Claude Mythos 5,提升幅度有限但侧重综合能力代际打磨,并附内部基准CoBench v2数据佐证,引发业界对其模型迭代与命名策略的广泛猜测。

# 技术进展Heooo AI工具导航08月18日19时34分 26

MatrAIx系统模拟83亿个AI人

哈佛大学与麻省理工学院联合OpenAI、谷歌DeepMind等机构推出MatrAIx系统,可生成83亿个AI智能体模拟全球人类行为。该系统以1290个维度建模,行为一致性达91.5%,相关人格核心集已开源,被视为社科与产品研究的新试验场。

# 技术进展Heooo AI工具导航08月18日17时33分 24
昆仑万维推Mureka V9.5,AI音乐迈向‘人情味’创作 封面图

昆仑万维推Mureka V9.5,AI音乐迈向‘人情味’创作

昆仑万维发布Mureka V9.5,通过自研MusiCoT框架强化音乐逻辑与情感表达,显著提升人声真实感与Prompt控制精度,尤其在中文国风领域实现突破,让AI音乐更具“活人味儿”。

# 技术进展Heooo AI工具导航08月18日16时34分 23

Anthropic首曝Model2模型性能超越Claude Mythos 5

Anthropic在最新风险报告中首次披露未发布的新模型Model 2,其在多项基准测试中表现优于当前最强模型Claude Mythos 5。尽管性能提升幅度温和,但该模型代表了Claude Mythos Preview技术路线的深度迭代,进一步夯实AI综合能力。

# 技术进展Heooo AI工具导航08月18日16时34分 28

Anthropic披露Model 2模型性能略超最强AI

Anthropic在最新风险报告中披露了尚未发布的Model 2模型,其在多项任务上的表现优于目前公开的最强模型Claude Mythos 5,但增幅不大,主要提升综合能力。报告还提及Model 1,有推测认为两者属于Claude Mythos Preview的迭代版本。

# 技术进展Heooo AI工具导航08月18日16时00分 22

哈佛麻省理工发布83亿AI智能体模拟人类

哈佛大学和麻省理工学院联合OpenAI、谷歌DeepMind等机构推出MatrAIx系统,可生成83亿个AI智能体模拟全球人类行为。该系统基于1290个维度建模,智能体可填写问卷、聊天、浏览网页等,测试一致性达91.5%。百万人格核心集已在Hugging Face开源。

# 技术进展Heooo AI工具导航08月18日15时33分 31

KL散度门控机制优化多智能体通信时机

多智能体强化学习中通信时机决定协作效率。现有方法要么每步都通信,要么用高方差REINFORCE学习二值门控。新研究提出基于信念分布KL散度超过阈值才通信的原则性方案,在捕食者-猎物及MPE基准上验证,展现出性能提升与方差降低的双重优势。

# 技术进展Heooo AI工具导航08月18日12时58分 24

医学推理中语言模型展现元认知敏感性

最新研究构建心理物理学启发式医学基准,评测大型语言模型在认知障碍诊断中的信心校准。实验显示模型诊断准确率达93.5%,信心随证据强度变化,但存在局部校准失败,提示需直接测量信心质量而非仅凭基准准确率。

# 技术进展Heooo AI工具导航08月18日12时29分 24

复现实验揭示α-FLOPs公式低估执行时间波动

一项新研究复现了α-FLOPs估算公式的原始实验,验证了FLOPs无法直接衡量执行时间的论点。研究发现,新硬件上执行时间存在跳变和振荡等不稳定性,公式系统性低估实际耗时,同时暴露了原始研究缺乏完整复现依赖的问题,强调可复现性的重要性。

# 技术进展Heooo AI工具导航08月18日12时02分 25

多模态模型抽象感知推理新基准揭示巨大短板

一项新研究推出“未成文基准”,通过听笔划声和看手部动作推断书写中的单词,测试多模态模型的抽象感知推理能力。结果显示人类准确率超80%,而GPT-4o、Gemini 2.5-Pro等顶尖模型不足10%,且多模态融合反而降低性能,暴露模型跨模态因果推理的根本缺陷。

# 技术进展Heooo AI工具导航08月18日12时02分 24

字节清华AIR发布CUDA Agent加速GPU内核

字节跳动Seed团队与清华AIR联合推出CUDA Agent,通过强化学习训练大模型编写高性能GPU内核。在KernelBench基准上,通过率提升至98.8%,96.8%生成内核超越torch.compile。开放数据集与训练配方,助力AI基础设施等领域。

# 技术进展Heooo AI工具导航08月18日12时01分 25

推箱子AI求解器:毫秒级最优解的秘密

一个基于A*搜索的推箱子AI求解器,通过宏推送、位掩码状态、Dial桶队列和死锁剪枝等技术,将C++求解器移植到JavaScript,在浏览器中实现第1至14关毫秒级最优解,第15关离线计算。

# 技术进展Heooo AI工具导航08月17日22时30分 28

谷歌推出AI内容水印自主关闭功能

谷歌宣布用户可自主选择关闭AI生成图片、视频及音乐中的显式水印,该功能将陆续登陆Nano Banana、Omni、Lyria等模型,并优先在Gemini网页端和Flow视频编辑软件上线。同时保留SynthID等隐形水印及C2PA元数据,确保内容透明可追溯,并开源Credentio开发库。

# 技术进展Heooo AI工具导航08月17日21时35分 21
GPT-5.6 Sol:OpenAI最强视觉模型问世 封面图

GPT-5.6 Sol:OpenAI最强视觉模型问世

OpenAI最新发布的GPT-5.6系列中,Sol模型在视觉任务上表现卓越,尤其在目标检测与文档布局理解方面显著超越前代。Roboflow基准测试显示其mAP@50达46.2,远超GPT-5.5的13.8,标志着OpenAI视觉能力的重大突破。

# 技术进展Heooo AI工具导航08月17日21时33分 26

提示注入侵入法庭,法官警告程序滥用

美国康涅狄格州一名自行出庭的原告在法院文件中隐藏仅供AI读取的提示指令,试图影响案件处理。法官认定此举构成严重程序滥用,禁止其使用电子提交系统。这是美国司法体系首例此类案件,引发对AI输入端攻击的广泛担忧。

# 技术进展Heooo AI工具导航08月17日19时34分 27

丰菽2.0发布,多模型协同深耕大豆育种

安徽农业大学团队在南宁发布大豆垂直大模型“丰菽”2.0,通过多模型协同机制降低单一模型偏差,整合海量科研数据,构建六大功能模块,推动大豆数据辅助育种落地。

# 技术进展Heooo AI工具导航08月17日15时33分 25
GPT-5.6 Sol 百万上下文向ChatGPT用户开放 封面图

GPT-5.6 Sol 百万上下文向ChatGPT用户开放

OpenAI工程师宣布,Codex中GPT-5.6 Sol模型的百万Token上下文窗口现已支持ChatGPT订阅用户手动启用,大幅缓解大型项目开发中的上下文截断问题,但需注意额度消耗加快。

# 技术进展Heooo AI工具导航08月17日14时34分 23

MoE模型层间敏感性研究揭示深度感知掩蔽策略

一项针对Qwen3.6-35B-A3B混合专家模型的系统性研究发现,MoE层对专家掩蔽的敏感性呈显著深度依赖性:晚期层容忍激进掩蔽,而早期层高度脆弱。在XLCoST基准上,仅掩蔽极晚期层640个专家即可保留419/500个高质量输出,为深度感知的MoE模型压缩提供了实证基础。

# 技术进展Heooo AI工具导航08月17日13时29分 27
小红书开源大模型获华为昇腾全量适配 封面图

小红书开源大模型获华为昇腾全量适配

小红书发布全新开源大模型dots3-note preview,拥有280B总参数与16B激活参数,支持文本、视觉、语音全模态感知。华为昇腾当日完成Atlas 800A3与900A3超节点全量适配,通过全链路优化提升推理吞吐量,并原生适配MTP投机解码,显著降低解码延迟。

# 技术进展Heooo AI工具导航08月17日12时34分 26