AI行业资讯
Heooo AI资讯频道,每日更新AI行业动态、技术进展、商业资讯。汇聚全球人工智能前沿信息,助您掌握AI发展趋势,做出智能决策。
腾讯QQ Bot接入DeepSeek Harness支持单聊群聊
腾讯QQ宣布QQ Bot机器人接入DeepSeek Harness及官方插件,支持单聊和群聊,拥有独立对话记忆、随时切换模型等能力。接入仅需三步:安装插件、启动、扫码绑定。DeepSeek Harness是开源AI Agent基础设施框架,强调“一切皆插件”。
Meta开源Glimmer模型,扎克伯格力推AI普惠
Meta本周发布开源AI模型Glimmer,允许用户在本地硬件运行,与闭源的Muse Spark形成对比。扎克伯格发表6500字长文,主张AI应“为所有人服务”,但其开放愿景仍存在限制条件。
DeepSeek Harness开放测试,插件化架构引关注
DeepSeek Harness开发者预览版v0.1面向全球开放测试并以MIT协议开源。其采用“一切皆插件”架构,基于Cordis插件系统,模型、工具、会话等均以插件形式组合,支持独立替换与灵活重组,并提供标准、PTC、极简和创造四种运行模式。
DeepSeek开源Agent框架Harness,一切皆插件
DeepSeek于8月13日晚间发布首款Agent产品DeepSeek Harness v0.1开发者预览版,以MIT协议开源。该框架采用“一切皆插件”的开放架构,基于Cordis插件元框架,预置四种运行模式,定位为Model+Harness=Agent,旨在降低开发者构建专属Agent的门槛。
DeepSeek Harness公测,全面对标Claude Cowork
DeepSeek开源代码智能体框架Harness预览版,发布V4-Pro-0813模型,采用“一切皆插件”设计,提供四种运行模式,模型权重MIT许可开放,性能大幅提升,瞄准编程与办公场景。
DeepSeek发布Harness开源项目
DeepSeek在GitHub上发布了名为DeepSeek Harness的开源项目,项目地址为deepseek-ai/deepseek-harness。该消息来自Hacker News社区,目前项目详情尚未公开。此举延续了DeepSeek在开源AI领域的投入,开发者可前往仓库页面获取最新信息,值得关注。
阿里开源2.4万亿参数大模型,性能比肩国际主流
阿里千问团队首次开源Max级别旗舰模型Qwen3.8-2.4T-A95B,总参数达2.4万亿,每Token激活950亿参数,原生支持26万Token超长上下文。该模型在PaperBench、OSWorld-Verified等基准测试中表现亮眼,多项指标超越国际主流模型,并支持多引擎高效部署与量化压缩,极大丰富全球开源AI生态。
阿里开源Qwen3.8-2.4T-A95B模型权重
阿里云魔搭社区宣布开放Qwen3.8-2.4T-A95B模型权重,总参数2.4T,每Token激活95B,原生支持262144 Token上下文,可扩展至超百万Token。这是Qwen-Max级别模型首次开源,在编程、办公、科研和长周期Agent任务上表现突出。
Woxi开源实现Mathematica语言内核
开源项目Woxi重新实现了Mathematica和Wolfram语言,以Jupyter内核形式交付,支持本地安装及浏览器端JupyterLite运行,无需安装即可体验完整笔记本功能,为数学计算与数据科学提供新的免费选择。
llama.cpp让前沿AI完全本地运行
llama.cpp推出全新本地AI运行方案,支持在个人电脑上直接运行前沿模型,无需API密钥和遥测。该方案兼容Qwen3.6、Gemma4、GPT-OSS等最新开源模型,并可通过Pi插件实现本地编码代理,数据全程留在设备中,极大提升了隐私性与可控性。
蚂蚁百灵发布Ling-3.0-tiny开源模型
蚂蚁百灵今日在Hugging Face平台开源Ling-3.0-tiny模型,总参数7.9B,每Token仅激活1.3B参数。该模型采用KDA与MLA按3比1交替堆叠的混合架构,配合128路由专家的稀疏MoE,支持多种量化版本,已在苹果M4 Pro MacBook上实现约86到90 Token每秒的推理速度,峰值内存约8.34GiB。
腾讯开源BrowserSkill赋能AI智能体
腾讯近日开源专为AI智能体设计的浏览器自动化工具BrowserSkill,支持复用登录状态、独立窗口运行及多Agent兼容,显著提升智能体处理网页任务的效率与稳定性。
Meta发布开源Glimmer模型,推动本地化AI智能体
Meta推出300亿参数的开源模型Muse Glimmer,可在消费级硬件上本地运行多模态AI智能体,支持文本与图像处理、跨语言任务执行,并强调隐私保护与离线可用性,体现扎克伯格对‘个人超级智能’的愿景。
Meta开源30B模型Muse Glimmer支持4bit量化
Meta发布开源AI模型Muse Glimmer,拥有300亿参数,采用4bit量化后可在24GB显存GPU上本地运行。该模型专为常驻本地智能体优化,在MacBook M4 Max、M5 Max及RTX 5090平台测试流畅,性能优于多款同尺寸竞品,权重已通过Apache 2.0协议开源。
AI工具致Linux候选版代码膨胀
Linux 7.2-rc7候选版因开发者大量使用AI工具提交代码,导致体积异常庞大。创始人Linus Torvalds坦言对趋势不兴奋但尚可接受,目前未发现严重隐患。本次候选版包含多项底层修复,AI辅助开发对内核社区代码审查与质量一致性带来新挑战。
AI爬虫过载致Gentoo缺陷追踪系统关闭
近日,Gentoo Linux 社区的缺陷追踪系统 Bugzilla 因遭遇大量 AI 机器人爬虫的过度访问而被迫关闭。这一事件凸显了 AI 数据采集对开源基础设施的冲击,引发了开发者对如何平衡技术进步与资源保护的广泛讨论。
甲骨文禁止OpenJDK采用AI生成代码
甲骨文公司宣布禁止在OpenJDK项目中提交AI生成的代码,尽管其创始人埃里森曾声称公司自身不编写代码。该决定引发开源社区对AI辅助编程工具使用边界与代码质量责任的广泛讨论,影响开发者提交规范。
Neon开源4B模型实现高效文档搜索
Neon与Castform联合推出基于强化学习训练的4B参数开源模型,在文档搜索任务中性能超越GPT-5.6 Sol,推理成本仅为后者的1/100,显著提升智能体式搜索的效率与经济性。
蚂蚁开源Avernet破解多智能体协作难题
蚂蚁集团正式开源多智能体协作基础设施Avernet,社区版本已上线,重点开放智能体协作网络能力,解决“找不到、对不齐、跑不快、留不住”四类问题,支持智能体发现、共识、跨团队协作与治理,已覆盖内部12个核心业务板块。
深入vLLM:高吞吐大模型推理系统解析
本文系统解析vLLM高吞吐大语言模型推理引擎的核心架构,涵盖分页注意力、连续批处理、前缀缓存、推测解码等关键技术,并介绍其从单GPU到多节点动态服务的扩展能力。