戴尔科技峰会2026:AI的未来在本地部署
戴尔科技世界大会2026聚焦企业AI落地实践,核心趋势指向本地化部署。随着云端大模型调用成本激增,戴尔COO透露AI令牌用量已增长320倍,预计2030年将增长3400%。数据主权需求、智能体治理要求以及对关键系统的直接...
我放弃ChatGPT,转用免费、私密的本地AI工具Ollama
Ollama是一款可在本地安装的免费开源AI工具,支持Linux、MacOS和Windows系统。用户可直接在本地运行大语言模型,无需付费且完全私密。相比ChatGPT等云端AI服务,Ollama不会收集用户查询数据,能...
谷歌发布Gemma 4模型,为低功耗设备带来复杂推理能力
谷歌发布最先进开放权重AI模型Gemma 4,基于Gemini 3架构,专为复杂推理任务和本地自主AI代理设计。该系列包含四个版本,从2B到31B参数不等,可在智能手机、工作站等低功耗设备上运行。模型支持原生函数调用、图...
谷歌Gemma 4开源模型正式发布,手机也能运行强大本地AI
谷歌DeepMind发布Gemma 4开源大语言模型,采用Apache 2.0许可证,实现真正开源。该模型包含四个版本:高端服务器用的26B和31B参数版本,以及专为移动设备和物联网设备设计的2B和4B参数轻量版。用户可...
NVIDIA加速Gemma 4本地智能体AI:从RTX到Spark全面优化
谷歌发布Gemma 4系列开放模型新成员,包括E2B、E4B、26B和31B变体,专为从边缘设备到高性能GPU的高效部署而设计。NVIDIA与谷歌合作优化该模型,支持从RTX PC到DGX Spark个人AI超级计算机等...
Perplexity推出"Personal Computer"桌面智能体工具
Perplexity发布名为"Personal Computer"的桌面版AI智能体工具,目前仅限邀请制早期体验。该工具基于Mac Mini运行,可直接访问用户本地文件和应用程序,通过自然语言描述完成复杂任务。系统提供安...
本地免费AI代码工具:Goose + Qwen3-coder实测体验
本文介绍了如何搭建完全免费的本地AI编程助手,通过整合Goose开源代理框架、Ollama本地LLM服务器和Qwen3-coder编程模型,实现类似Claude Code的功能。作者详细演示了在Mac上的安装配置过程,并...
我在M1 Mac上测试本地AI的残酷体验
科技记者在配备16GB内存的2021款M1 MacBook Pro上测试Ollama本地AI工具,结果显示运行大语言模型极其困难。测试中的300亿参数GLM-4.7模型响应一个简单问题耗时超过1小时,系统明显变慢。专家建...
NVIDIA RTX PC上视觉生成式AI入门指南
AI内容生成技术已融入Adobe和Canva等日常工具,创作者越来越多地在本地PC上运行这些工作流程以保持资产控制权并降低云服务成本。NVIDIA RTX PC凭借高性能优势成为创意AI的首选系统。本文介绍如何使用Com...
Lightricks-2 AI视频模型实现设备端运行突破
Lightricks与英伟达合作推出Lightricks-2 AI视频模型,可在本地设备运行而非依赖云服务。该模型支持生成20秒长、50帧每秒的4K视频片段,并包含原生音频。作为开放权重模型,它为专业创作者提供更安全的选...
本地大语言模型崛起:为何用户开始选择自主部署AI
随着AI服务成本上升和数据隐私担忧加剧,越来越多用户开始尝试本地部署大语言模型。硬件性能提升和软件工具优化使得在个人设备上运行AI模型变得可行。通过量化技术降低模型精度要求,配合llama.cpp等开源工具,用户可在消费...
谷歌发布可在机器人本地运行的新Gemini模型
谷歌DeepMind发布了名为Gemini Robotics On-Device的新语言模型,可在机器人上本地运行任务而无需互联网连接。该模型基于3月发布的Gemini Robotics模型构建,能够控制机器人动作,开发...













