AI行业资讯
Heooo AI资讯频道,每日更新AI行业动态、技术进展、商业资讯。汇聚全球人工智能前沿信息,助您掌握AI发展趋势,做出智能决策。
谷歌推视频生成新模型最高产出4K成片
谷歌推出Gemini Omni 1.1 Flash视频生成AI模型,最高支持4K分辨率输出,相比标准版720p在速度与成本上大幅优化。新模型支持场景扩展、首尾帧指定与视频参考功能,可按10秒步长续生成,单条最长40秒。成本分层清晰,360p预览每秒仅0.03美元,速度提升最高60%。
OpenAI联合苹果前高管申请永久驳回商业秘密案
OpenAI与苹果前高管及io Products联合提交请愿书,请求法院带偏见地驳回苹果的商业秘密窃取诉讼。该案涉及人才流动与技术产权保护,双方已完成诉辩状提交,法院将于10月1日举行动议听证会。
百度双重主要上市落地 AI全栈资产迎重估
百度双重主要上市正式落地,最快将于9月7日纳入港股通,直接对接南向资金。第二季度AI业务收入达125亿元,占总收入50%,已连续两季过半。昆仑芯启动独立上市,智能云GPU收入同比增283%,全栈AI资产有望撬动万亿港元估值空间。
小鹏第二代VLA大模型升级 安全能力提升20倍
小鹏发布第二代VLA大模型重大升级,端侧参数扩大3.5倍,引入Infini-VLA长时序架构,推理速度提升300%,综合安全能力提升20倍。全新XOS6.3.0版本搭载Master Agent实现驾舱融合,并推动L4级技术下放量产车型。
Midjourney发布V8.2图像编辑模型
AI绘画巨头Midjourney正式开放V8.2图像编辑模型测试,支持指令编辑、多图参考、局部重绘与画布扩展等功能,全面革新创作方式。用户可通过拖拽图片、编辑按钮或Discord指令调用,官网界面同步迭代,官方邀请社区反馈以优化体验。
谷歌AI模式升级,新增航班酒店预订能力
谷歌宣布其搜索AI模式重大升级,新增航班价格追踪、酒店预订辅助及积分里程查询功能。用户可通过对话式交互获取300多家平台的实时比价与推荐,覆盖全球180多个国家和地区,并支持跳转至Booking.com等合作方完成支付交易,加速迈向全流程AI旅行代理。
英伟达暂停云算力分成计划规避反垄断风险
英伟达暂停一项面向AI云服务商的新型融资计划,该计划以信用支持换取云业务营收分成,推出不足两月即叫停。内部担忧触发反垄断审查,外部对芯片巨头干预客户运营敏感。英伟达表示新计划仍在运作,后续或调整以平衡扩张与合规。
玄幂量子增强大模型正式发布
国光量超人工智能研究团队推出国内首个量子增强大模型“玄幂”家族,将量子技术引入大语言模型决策与推理核心流程。该模型在科研科普、任务路由、智能体决策等场景中表现优于主流开源模型,提供更稳定的专业理解与更清晰的判断,显著缩短决策路径。
Meta年砸百亿美元押注Anthropic大模型
据财联社引述相关报道,Meta内部曾预测未来每年在Anthropic AI模型上的支出最高可达100亿美元。Anthropic凭借Claude系列在长文本处理、复杂逻辑推理及企业级应用生态上构筑技术壁垒,此次重金投入凸显科技巨头对顶级第三方大模型的高度依赖。
谷歌发布Omni 1.1 Flash视频生成模型
谷歌推出Gemini Omni 1.1 Flash视频生成AI模型,支持从已有视频末尾无缝扩展、指定首尾帧、生成360p预览及最高4K分辨率成片,并可参考3秒视频片段保持角色一致性。该模型按分辨率阶梯定价,最低每秒0.03美元,面向快速原型验证和高清成片等多元化创作需求。
百余科技巨头联名警示AI网络攻击威胁
OpenAI、Anthropic、微软、谷歌母公司Alphabet与亚马逊等116家企业及机构联合签署公开信,呼吁企业与政策制定者将网络安全列为最高优先级,以应对即将泛滥的AI赋能网络攻击。信中建议推行“可信访问计划”,并要求政府为关键基础设施提供专项防御资金。
Hugging Face开源机器人Microduck助力具身智能
Hugging Face推出售价399美元的开源鸭子机器人Microduck,高25厘米,集成摄像头、激光雷达和双IMU,支持强化学习训练后直接部署,SDK与仿真环境已开源,加速具身智能在开发者社区的落地与创新。
《时代》公布全球AI百大人物榜,业界领袖登封面
《时代》杂志发布2026年全球AI百大人物榜,为第四年评选。OpenAI CEO奥尔特曼、马斯克、阿里CEO吴泳铭、李飞飞等登上封面,字节跳动梁汝波、华为何庭波、中芯国际梁孟松等多位国内AI人物入选,彰显全球AI领域的影响力格局。
蚂蚁百灵发布金融增强模型Ling-3.0-flash-Fin
蚂蚁百灵推出金融增强模型Ling-3.0-flash-Fin,延续Ling-3.0-flash架构,保持124B总参数与5.1B激活参数,通过金融语料训练强化复杂金融内容处理能力。模型权重下周开源,并在OpenRouter开启一个月限时免费API调用,通用能力与专业能力协同提升。
谷歌推出Gemini Omni视频模型支持4K生成
谷歌发布视频生成AI模型Gemini Omni 1.1 Flash,最高支持4K超高清输出,并在场景扩展、运镜控制与生成效率上全面升级。该模型面向开发者和专业创作者,推动多模态视频生成向更高清、更长时方向演进。
116家企业联名呼吁强化AI时代网络安全
OpenAI、微软、谷歌等116家机构联名签署公开信,呼吁将网络安全置于首位,强调AI赋能的网络攻击将加剧,敦促政府与行业采取果断行动,包括推进可信访问计划、提升安全门槛,并为关键基础设施提供专项支持。
大语言模型与代理管道解释ICU死亡率对比
一项可行性研究在eICU Demo数据集上对比独立大语言模型与预设四步代理管道解释ICU死亡率预测的效果。XGBoost模型AUROC为0.855。结果显示,代理管道在指南依据和数值特异性上更优,但SHAP对齐度低于独立大语言模型,研究建议高风险场景需结合归因校验。
大模型赋能电池健康管理综述
这篇综述首次系统梳理大型模型在电池预测与健康管理领域的最新进展,涵盖Transformer架构、自监督预训练、参数高效微调等核心技术,并从缓解数据稀缺、增强泛化、提升可解释性、实现系统级自动化四个维度总结突破,同时提出未来研究路线图,为下一代电池管理系统研发提供重要参考。
CIFQA框架提升金融问答数值准确性
CIFQA是一种确定性工具支撑的多智能体LLM框架,专为计算密集型金融问答设计。它将语言理解与数值执行分离,在定期存款问答基准上取得95.54%的计算密集型准确率和90.87%总体准确率,显著优于直接使用大型语言模型,并证明架构设计比模型规模更关键。
AI框架PICasso实现硅光子器件自动优化
研究人员提出AI辅助设计框架PICasso,可从自然语言规范自动生成、验证并优化光子集成电路。配套基准PIC-Set包含36项设计任务。实验显示,PICasso将结构规格满足率提升至92.7%,功能满足率达52%,并将平均插入损耗从4.98dB降至3.25dB,展示了AI驱动光电设计的潜力。