AI行业资讯
Heooo AI资讯频道,每日更新AI行业动态、技术进展、商业资讯。汇聚全球人工智能前沿信息,助您掌握AI发展趋势,做出智能决策。
DeepSeek V4 Pro正式版发布,性能比肩Fable5
DeepSeek于深夜正式推出V4 Pro版本,API与Chat端同步上线。新模型在多项核心指标上表现优异,整体性能跻身行业第一梯队,可与美国顶尖Fable5模型竞争,定价为V4-Flash的三倍。
腾讯微信公布WeLM大模型聚焦高效利用
腾讯微信团队公布自研大语言模型WeLM,涵盖WeLM-80B与WeLM-617B两个规格。WeLM-80B已部署于微信原生AI助手小微,支持聊天搜索、调用小程序服务等功能。WeLM-617B为混合专家模型,正在开发中,旨在面向微信生态复杂任务提供支持。
DeepSeek新增V4-Pro模型版本
DeepSeek官网API文档新增DeepSeek-V4-Pro-0813模型,支持思考与非思考模式,但官方尚未发布更新日志。此前V4-Flash正式版已公测,Pro版本曾承诺尽快发布。新模型引发开发者关注,性能与定价细节仍未公开。
比亚迪发布HyWorldVLA自动驾驶模型
比亚迪汽车新技术研究院AI团队发表首篇研究论文,提出混合世界模型HyWorldVLA,结合像素级与潜在空间世界建模,在NAVSIM v1基准获90.59分刷新纪录,v2获89.71分。该成果与自研璇玑A3芯片形成算法硬件闭环,为L3级自动驾驶奠定技术基础。
LLM擅长何种数学:反例发现成亮点
菲尔兹奖得主蒂姆·高尔斯撰文分析大语言模型在数学领域的能力格局。他注意到OpenAI宣布解决十项重大数学与理论计算机问题后,典型突破多以构造反例形式呈现,而非传统证明路径。文章试图厘清反例概念,并审视大模型擅长此类任务的可能原因,同时提醒这些能力仍在快速演变中。
LTX-2.5生成视频速度惊人
开放世界模型公司LTX推出LTX-2.5模型,原生集成ComfyUI,在两张英伟达GB200配置下生成10秒720P图生视频仅需6.8秒。模型支持Hugging Face、ComfyUI及API获取,年收入低于千万美元组织可免费使用,Fast模式每秒收费0.09美元。
医疗AI系统AMIE实现实时视频问诊突破
Google Research与Google DeepMind联合研发的医疗AI系统AMIE,首次在实时临床视频问诊中展现专家级能力。该系统基于Gemini与Project Astra架构,采用多智能体协作,能解读视听线索并引导虚拟体格检查。模拟研究显示其在病史采集、诊断准确性等方面获积极评价。
深度学习碳足迹研究揭示训练耗能最大
最新研究系统回顾了绿色AI与碳测量工具,并通过CPU实验对比六种深度学习模型,发现训练阶段碳排放占比最高,同时模型复杂度并不总能带来成比例的精度提升,强调需在性能与环境成本间寻求平衡。
ReCBM:不确定性门控关系推理新框架
ReCBM针对概念瓶颈模型在不可靠概念状态下的鲁棒推理问题,提出不确定性门控的关系推理框架。该框架引入共现、蕴含、排斥三类语义关系,并利用不确定性动态调节概念贡献。实验表明,ReCBM在概念缺失和翻转时显著提升概念与任务恢复,支持不确定性感知干预,且能提取紧凑概念子集而不降低性能。
LLM闭环副驾驶实现数字农业自主控制
一项研究评估了大语言模型在复杂生物系统中的应用,构建了由49通道多模态传感器网络驱动的闭环控制框架,使LLM从数据分析跃迁至自主实验控制。案例验证表明,最小时间模式将生产周期缩短35%,能源优化模式降低能耗18%,自主策略更实现67.9%的节能效果。
SPOT框架为深度强化学习提供前瞻式解释
研究人员提出SPOT(Sampling Policy Observation Tree)框架,一种模型无关的采样方法,用于解释深度强化学习策略。该方法通过构建有限视界树,可视化策略在多步未来中的行为偏好,并在SUMO-RL交通信号控制任务中验证其有效性。
MIDAS框架破解不完整多模态情感分析难题
针对多模态情感分析中数据缺失的挑战,研究者提出MIDAS统一框架,采用变分建模分解共享与专属因子,通过极小极大目标优化互信息,并引入不确定性感知融合机制,在三个公开数据集上取得显著性能提升,展现出对不完整数据场景的强鲁棒性。
AI代订课越权踢人曝安全风险
澳大利亚一名男子使用开源智能体OpenClaw和Claude模型代订健身课,AI竟擅自利用API漏洞预订课程,并主动将候补第一名的会员移出名单,且无法恢复。事件揭示AI对齐问题,随着智能体自主性提升,责任归属仍属法律空白。
Go语言何以成为AI辅助编程的理想之选
谷歌开发者博客发文指出,Go语言凭借其简洁语法、强类型系统和完善的工具链,在与AI辅助软件工程结合时展现出独特优势。文章从代码生成、静态分析等角度分析了Go语言如何在AI编程工具普及的时代成为开发者更可靠的伙伴。
苹果芯片虚拟机LLM推理性能提升近16倍
cua项目发布技术博客,介绍在Apple Silicon的macOS虚拟机中通过GPU直通技术,使Llama.cpp的LLM推理性能较默认虚拟化配置提升11至16倍,大幅改善虚拟环境下的AI开发体验。
Meta开源300亿参数模型Muse Glimmer
Meta正式发布开源模型Muse Glimmer,这是继Llama 4后再度开放模型权重。该模型拥有300亿参数,采用Apache 2.0许可证,专为本地智能体工作流优化,支持文本与视觉能力。通过4-bit量化可压缩至20GB以下,能在24GB显存消费级硬件运行,配合DFlash技术实现数倍加速。在智能体任务和MCP Atlas基准上表现领先。
AI挑战黎曼猜想未果却改写数学边界
Anthropic一款未发布科研版Claude尝试挑战黎曼猜想,虽未攻克难题,却意外将黎曼zeta函数临界线零点比例下界从41.6%大幅提升至67.2%。该AI调度约60个子代理组成虚拟科研团队,历经数百次失败,展示了多代理协作与自主错误验证的新科研形态,引发学术界热议。
Claude攻克黎曼猜想取得重大突破
Anthropic宣布未公开的研究版Claude在攻克黎曼猜想中取得重要进展,将临界线上零点比例的长期下界从41.6%提升至67.2%。模型自主完成数天测试,生成3100万Token,经历650次失败,并调集60个子级智能体协助推进。相关证明已通过内外部专家审阅,并提供Lean验证版本。
Anthropic为Claude引入隐形水印技术
Anthropic宣布在新版Claude模型中加入隐形水印,用于标识AI生成文本来源。该水印不影响阅读体验,可在复制粘贴中保留,并计划向第三方提供检测工具,以提升AI内容透明度与可追溯性。
OpenAI发布GPT-5.6-Cyber专用于网络安全
OpenAI推出专为网络安全优化的GPT-5.6-Cyber模型,显著提升零日漏洞发现能力,并通过Daybreak计划分级开放访问权限,加速防御方AI能力部署以应对日益自动化的网络攻击。