Revolutionieren Sie Ihr Unternehmen mit Agentischer KI

Agentische KI erzielt realen ROI
Bau-SaaS
Lösungsfokus:
Autonome Multi-Agenten-Berichterstattung (Unterstützung in 23 Sprachen)
Wichtigstes Ergebnis:
68 % schnellere Aufgabenberichterstattung. 86 % weniger manuelle Fehler.
Sicherheit.

Digital Marketing
Lösungsfokus:
Gemini-gestützte Konversation
Wichtigstes Ergebnis:
80 % automatisierte Antworten. 60 % Rückgang bei der Abbrecherquote komplexer Prozesse.

Sustainable Construction
Lösungsfokus:
6-Agenten-Wissensassistent Autonome Multi-Agenten-Berichterstattung (Unterstützung in 23 Sprachen)
Wichtigstes Ergebnis:
Wissenszugriff in Sekunden. Keine Halluzinationen mit garantierten Dokumentenzitaten.

.png)
.png)
Nutzen Sie Agentische KI, um komplexe Erkenntnisse in autonome, selbstverwaltende Unternehmens-Workflows umzuwandeln.
Umfassende KI-Expertise für
transformative Wirkung
Bei Ankercloud liefern wir produktionsreife agentische KI-Lösungen, die Entscheidungen automatisieren, Inhalte erstellen und eine umfassende Unternehmenstransformation mit minimalem menschlichen Eingriff vorantreiben.
Maßgeschneiderte KI für Ihr Unternehmen
Maßgeschneiderte KI-Lösungen zerlegen komplexe Herausforderungen in strukturierte, überschaubare Aufgaben, unter Nutzung historischer Daten, Kontextbewusstsein und Echtzeit-Erkenntnissen. Diese maßgeschneiderten KI-Systeme planen intelligent, passen sich dynamisch an und liefern präzise, kreative, geschäftsorientierte Ergebnisse, die eine intelligentere Entscheidungsfindung im gesamten Unternehmen ermöglichen.


KI, die wie ein Teammitglied arbeitet, nicht wie ein Werkzeug
Maßgeschneiderte KI-Workflows kommunizieren natürlich und arbeiten nahtlos zusammen und ermöglichen menschenähnliche Interaktionen, die Aufgaben optimieren. Sie automatisieren den Informationsfluss, reduzieren den manuellen Aufwand und antizipieren Benutzerbedürfnisse durch proaktive Unterstützung, was die Produktivität steigert, ohne ständige Überwachung zu erfordern.
Automatisierung, die manuelle Aufgaben in den Autopilot-Modus versetzt
Integriert mit Live-Daten, Unternehmenssystemen und APIs führt maßgeschneiderte KI-Automatisierung Aufgaben autonom aus, von der Datenbeschaffung bis zur Ausführung. Mit integrierten Schutzmechanismen gewährleistet sie Genauigkeit, Zuverlässigkeit und Betriebsintegrität und liefert Echtzeit-Erkenntnisse und Ergebnisse, die das Geschäft voranbringen.

Technische Kernkompetenzen
Bei Ankercloud liefern wir produktionsreife Agenten-KI-Lösungen, die Entscheidungen automatisieren, Inhalte erstellen und umfassende Unternehmenstransformationen mit minimalem menschlichem Eingriff vorantreiben.
Die Stärke der Partnerschaft: Ankercloud + Cloud-Leader
Wir integrieren native KI- und GenAI-Dienste von AWS, Google Cloud und Microsoft Azure mit der proprietären Expertise von Ankercloud, um Folgendes zu liefern:


Sichere und konforme KI-Architekturen: Full-Stack-Verschlüsselung, IAM und Compliance-Frameworks für DSGVO, HIPAA, ISO 27001.
Skalierbare Cloud-native Infrastruktur: Autoscaling-GPU-Cluster, Hochverfügbarkeit, Disaster Recovery und kostenoptimierte Verbrauchsmodelle.
Innovative GenAI-Plattformen: Lösungen wie VisionForge, die GenAI mit AWS-Infrastruktur für die groß angelegte Generierung von Unternehmensinhalten kombinieren.
Erprobte und bewährte Branchen-Anwendungsfälle
Unsere Lösungen werden in realen Umgebungen getestet und schaffen messbaren Mehrwert in verschiedenen Branchen.
Fertigung
Automatisierte Auftragserfassung, -validierung und -verarbeitung durch Multi-Agenten-Workflows, integriert mit OCR- und ERP-Systemen für Echtzeit-Genauigkeit.

Kundensupport
Multi-Agenten-KI-Systeme übernehmen die Ticket-Triage, beantworten häufige Anfragen und leiten komplexe Probleme an die richtigen Teams weiter, wodurch Reaktionszeiten verkürzt und die Servicequalität gesteigert werden.

Healthcare & InsurTech
Das System nutzt drei synchron arbeitende Agenten: Einer extrahiert strukturierte Daten aus medizinischen Berichten und Schadensdokumenten, ein anderer automatisiert Schadensprüfungen durch Anwendung von Regeln und Kennzeichnung von Problemen, und ein dritter validiert klinische Begriffe, Codes und Diagnosen auf Richtlinienkonformität.

SaaS & EdTech
Empfehlungssysteme, NLP-gesteuerte Konversations-Bots und personalisierte Content-Bereitstellung.

Schauen Sie sich Fallstudien an
Besuchen Sie unseren Blog
Die Zukunft autonomer Workflows: Agentic AI von Ankercloud
Das Automatisierungsparadoxon: Warum traditionelles ML an seine Grenzen stößt
Unternehmen stehen heute vor einem Paradoxon: Sie müssen schneller innovieren als je zuvor, doch ihre Kernmodelle für maschinelles Lernen erfordern manuelle Eingriffe, was zu Verzögerungen, inkonsistenten Ergebnissen und Skalierbarkeitsproblemen führt. Traditionelle KI ist leistungsstark, erfordert aber oft fragmentierte Prozesse und ständiges „Babysitting“, jemanden, der die Datenvorbereitung, Bereitstellung und Überwachung manuell steuert. Diese operativen Reibungsverluste verwandeln vielversprechende KI-Projekte in Engpässe.
Deshalb Agentic AI stellt eine strategische Notwendigkeit dar. Es ist die Entwicklung von reaktiver Datenmodellierung hin zu proaktiver, zielgerichteter Automatisierung. Agentic AI verschiebt das Paradigma, indem es autonom agiert, komplexe Arbeitsabläufe durchgängig orchestriert, um Ergebnisse ohne ständige menschliche Aufsicht zu liefern. Dies ermöglicht Unternehmen, Innovationen zu beschleunigen und neue Wertquellen zu erschließen, die zuvor unerreichbar waren.
Agentic AI: Das neue Paradigma der zielgerichteten Autonomie
Agentic AI ist eine neue Klasse intelligenter Systeme, die nicht nur Daten verarbeiten, sondern auch Initiative ergreifen und übergeordnete Ziele erreichen. Das Hauptunterscheidungsmerkmal ist Autonomie:
- Autonomie in Aktion: Agentic AI kann den gesamten ML-Lebenszyklus orchestrieren, von der Identifizierung und Vorbereitung von Daten über das Training von Modellen bis hin zu deren Bereitstellung und der Sicherstellung einer kontinuierlichen Überwachung, wodurch ML-Projekte wirklich durchgängig und wiederholbar werden.
- Schnellere Bereitstellung mit Konsistenz: Diese Automatisierung ermöglicht es unseren Kunden, ihre KI-Initiativen ohne die üblichen Engpässe zu skalieren und dabei eine beschleunigte Wertschöpfung und kontinuierliche Verbesserung mit überragender Zuverlässigkeit zu erzielen.
Dieser Wandel bedeutet, dass Ihr Unternehmen nicht mehr statischen Code bereitstellt; Sie setzen intelligente Systeme ein, die lernen, sich anpassen und Geschäftsziele vorantreiben.
Die kollaborative Zukunft: Agenten, Protokolle und Geschwindigkeit
Die wahre Stärke von Agentic AI liegt in ihrer Fähigkeit, Silos aufzubrechen und eine reibungslose Zusammenarbeit zu ermöglichen, nicht nur zwischen Menschen und KI, sondern auch zwischen mehreren KI-Agenten selbst.
- Nahtlose Konnektivität: Agentic AI integriert Daten und APIs aus unterschiedlichen Quellen, unabhängig von ihrem Speicherort oder Format, in kohärente, orchestrierte Workflows.
- Die Kollaborationsschicht: Ankercloud nutzt aufkommende Technologien wie Model Context Protocol (MCP) und Agent to Agent Protocol (A2A) Frameworks. Diese Protokolle ermöglichen es mehreren Agenten und Sub-Agenten, ähnlich einem realen Problemlösungsteam zusammenzuarbeiten und intelligentere, vollständig automatisierte Workflows zu liefern, die komplexe Branchenherausforderungen präzise lösen.
Diese Konnektivität verbessert die Integration über alle Ihre Unternehmenssysteme hinweg, wodurch wir Angebote bereitstellen können, die zuvor unerreichbar waren, wie intelligente Chatbots, komplexe Datenverarbeitungspipelines und dynamische, auf Kundenbedürfnisse zugeschnittene Inhaltserstellung.
Ankercloud: Ihr Architekt für das autonome Unternehmen
Der Übergang zu autonomen Workflows erfordert mehr als nur den Zugang zu leistungsstarken Modellen; er erfordert spezialisiertes Fachwissen in Cloud-Architektur, Sicherheit und kontinuierlicher Governance.
- Sichere Cloud-Expertise: Als führender Partner von Google Cloud Platform (GCP) und AWS, bringt Ankercloud unübertroffene Expertise mit. Wir integrieren sichere, zuverlässige Cloud-native Managed Services wie Google Vertex AI Agents und AWS Bedrock Agents in unsere Lösungen. Dieser Ansatz gewährleistet hohe Genauigkeit, robuste Leistung und die Einhaltung gesetzlicher Vorschriften, während er gleichzeitig den Betriebsaufwand für unsere Kunden minimiert.
- Methodik und Vertrauen: Agentic AI ist ein strategischer Wegbereiter, der zu erheblichen, messbaren Geschäftsergebnissen führt. In Kombination mit Ankerclouds tiefgreifenden Erkenntnissen im Bereich Cloud-Sicherheit und der Beherrschung des gesamten ML-Lebenszyklus gewinnen Kunden Vertrauen in die Einführung autonomer Workflows, die die Effizienz transformieren, die Qualität steigern und die Agilität in ihren gesamten Abläufen erhöhen.
Fazit: Die Zukunft der Arbeit ist autonom
Die Wettbewerbslandschaft der Zukunft gehört Unternehmen, die eine zielgerichtete Automatisierung erfolgreich implementieren können. Agentic AI ist nicht nur Technologie; es ist eine neue strategische Methodik, die Ihr Unternehmen von manuellen, sich wiederholenden Aufgaben befreit und es Ihren menschlichen Talenten ermöglicht, sich auf Innovationen und hochwertige strategische Initiativen zu konzentrieren.
Sind Sie bereit, das Potenzial von Agentic AI?
Arbeiten Sie mit Ankercloud zusammen, um Ihre Reise in eine autonome Zukunft zu beginnen, in der KI intelligenter, schneller und sicherer für Ihr Unternehmen arbeitet.
Der Aufstieg der Solo-KI: Verstehen, wie intelligente Agenten eigenständig agieren
The world of Artificial Intelligence is evolving at breakneck speed, and if you thought Generative AI was a game-changer, prepare yourself for the next frontier: Agentic AI. This isn't just about AI creating content or making predictions; it's about AI taking initiative, making decisions, and autonomously acting to achieve defined goals, all without constant human oversight. Welcome to a future where your digital workforce is not just smart, but truly agentic…
What exactly is Agentic AI? The Future of Autonomous Action
Think of traditional AI as a highly intelligent assistant waiting for your commands. Generative AI then empowered this assistant to create original content based on your prompts. Now, with Agentic AI, this assistant becomes a proactive, self-managing colleague or robot.
Agentic AI systems are characterized by their ability to:
- Autonomy: They can perform tasks independently, making decisions and executing actions without constant human intervention.
- Adaptability: They learn from interactions, feedback, and new data, continuously refining their strategies and decisions.
- Goal-Orientation: They are designed to achieve specific objectives, breaking down complex problems into manageable steps and seeing them through.
- Tool Integration: They can seamlessly interact with various software tools, databases, and APIs to gather information and execute tasks, much like a human would.
- Reasoning and Planning: Beyond simple rule-following, Agentic AI can reason about its environment, plan multi-step processes, and even recover from errors.
This evolution from reactive to proactive AI is not just a technological leap; it's a paradigm shift that promises to redefine how businesses operate. Gartner projects that by 2028, 33% of enterprise software applications will have integrated Agentic AI, a dramatic increase from less than 1% in 2024, highlighting its rapid adoption.
The Impact is Real: Why Agentic AI is a Trending Imperative
Businesses are no longer just experimenting with AI; they are investing heavily in it. A recent IBM study revealed that executives expect AI-enabled workflows to surge eightfold by the end of 2025, with Agentic AI at the core of this transformation. Why the urgency? Because the benefits are profound:
- Boosted Productivity & Efficiency: Imagine repetitive, time-consuming tasks being handled entirely by AI agents, freeing up your human workforce to focus on strategic initiatives and creative problem-solving.
- Enhanced Decision-Making: Agentic AI can analyze vast datasets in real-time, identify patterns, and provide actionable insights, leading to more informed and proactive business decisions.
- Cost Reduction: Automating complex processes and optimizing resource allocation directly translates into significant cost savings.
- Unlocking New Revenue Streams: By automating customer interactions, personalizing experiences, and optimizing operations, Agentic AI can directly contribute to increased sales and market expansion.
- Improved Employee and Customer Experience: From streamlined internal workflows to hyper-personalized customer service, Agentic AI elevates interactions across the board.
- Competitive Advantage: Early adopters of Agentic AI are already seeing a distinct edge in their respective markets, setting new standards for innovation and operational excellence.
Top Use Cases: Where Agentic AI Shines Brightest
The applications of Agentic AI are vast and growing across every industry. Here are some of the top use cases where it's already making a significant impact:
- Smart Manufacturing
- Predictive Maintenance & Quality Control: Agentic AI monitors equipment in real time, predicts failures, and schedules maintenance to prevent unplanned downtime while also using computer vision to detect product defects and reduce waste by up to 60%.
- Autonomous Inventory & Supply Chain Optimization: AI agents track inventory levels, forecast demand, and optimize supply chain logistics to avoid stockouts or overstocking, dynamically adjusting to market changes and disruptions for cost efficiency and seamless operations.
- Smart Robots
- Dynamic Task Allocation & Autonomous Assembly: Agentic AI enables robots to adapt to new tasks and environments in real time, optimizing assembly processes and resource usage for faster, more flexible production with minimal human intervention.
- Collaborative Robotics (Cobots) & Real-Time Monitoring: AI-powered robots work safely alongside humans, adjusting behaviors based on real-time conditions, and continuously monitor production lines to detect anomalies and ensure quality and safety.
- Customer Service & Engagement:
- Autonomous Support Agents: Beyond traditional chatbots, agentic AI can independently resolve complex customer inquiries, access and analyze live data, offer tailored solutions (e.g., refunds, expedited orders), and update records.
- Personalized Customer Journeys: Anticipating customer needs and preferences, agentic AI can proactively offer relevant products, services, and support, enhancing satisfaction and loyalty.
- Finance & Fraud Detection:
- Automated Trading: Analyzing market data and executing trades autonomously to optimize investment decisions.
- Enhanced Fraud Detection: Proactively identifying and flagging suspicious patterns in transactions and user behavior to mitigate financial risks.
- Software Development & IT Operations (DevOps):
- Automated Code Generation & Testing: AI agents can generate code segments, provide real-time suggestions, and automate software testing, accelerating development cycles.
- Proactive System Monitoring & Maintenance: Continuously scanning for anomalies, triggering automated responses to contain threats, and scheduling predictive maintenance.
- Human Resources (HR):
- Automated Recruitment: From screening resumes and scheduling interviews to simulating interview experiences for candidates.
- Personalized Onboarding: Tailoring onboarding sessions and providing relevant information to new hires.
Ankercloud's Agentic AI Solutions: Your Partner in the Autonomous Future
At Ankercloud, we don't just talk about Agentic AI; we build and deploy real-world solutions that deliver tangible business value. We combine cutting-edge technology with our deep industry expertise to help you navigate the complexities of this new frontier.
Our approach to Agentic AI is rooted in a fundamental understanding of your business needs. We work closely with you to:
- Analyze Existing Workflows: We identify opportunities where Agentic AI can significantly enhance efficiency and outcomes.
- Integrate Human-in-the-Loop Solutions: Our solutions are designed to augment, not replace, your human workforce, ensuring critical oversight and collaboration.
- Seamless Integration: We design AI agents that integrate effortlessly with your existing systems (ERPs, CRMs, finance tools) to enhance workflows without disruption.
- Custom GenAI Models: We develop bespoke Agentic AI models tailored to your specific business goals, leveraging the power of Generative AI for advanced reasoning and content generation.
- Industry-Specific Expertise: Our experience spans diverse industries, allowing us to build solutions that address your unique challenges and opportunities.
- Robust Governance and Security: We embed ethical guardrails, robust security protocols, and explainable AI capabilities from the outset, ensuring responsible and trustworthy autonomous operations.
The future of business is autonomous, adaptive, and intelligent. Agentic AI is no longer a concept; it's a tangible reality that is reshaping industries and creating new opportunities for growth.
Are you ready to unlock the full potential of Agentic AI for your business?
Contact Ankercloud today um zu erfahren, wie unsere Agentic AI-Lösungen Ihre Abläufe transformieren und Sie in die autonome Zukunft voranbringen können.
Optimieren Sie Ihre KI-Systeme mit Gemini 1.5: Erweiterte Funktionen & Techniken
Im ständig härter werdenden Wettbewerb um die Entwicklung schnellerer, intelligenterer und bewussterer LLMs bringt jeder neue Monat eine wichtige Ankündigung einer neuen Modellfamilie mit sich. Und da die Gemini 1.5-Familie, bestehend aus Nano, Flash, Pro und Ultra, seit Mai 2024 verfügbar ist, hatten viele Entwickler bereits die Gelegenheit, damit zu arbeiten. Und jeder dieser Entwickler kann Ihnen eines sagen: Gemini 1.5 ist nicht nur einen Schritt voraus. Es ist ein großer Sprung nach vorn.
Gemini ist ein äußerst vielseitiges und funktionales Modell, es ist ausgestattet mit einem 2 Millionen Eingabe- Kontextfenster. Das bedeutet, dass Prompts riesig sein können. Man könnte meinen, dass dies zu Leistungsproblemen bei den Modellausgaben führen würde, aber Gemini liefert stets präzise, konforme und kontextbezogene Antworten, unabhängig von der Länge des Prompts. Und die Länge der Prompts bedeutet, dass Benutzer große Datendateien zusammen mit dem Prompt übermitteln können. Das 2 Millionen Token umfassende Eingabefenster entspricht 1 Stunde Videos, 11 Stunden Audio und 30.000 Zeilen Code, die gleichzeitig über Gemini 1.5 Pro analysiert werden können.

Angesichts dessen variiert die Entscheidung, welchen Ansatz man für den Aufbau eines Konversationssystems mit Gemini 1.5 wählt, stark, je nachdem, was der Entwickler erreichen möchte.
Alle Methoden erfordern ein allgemeines Einrichtungsverfahren:
1. Google Cloud-Projekt: Ein GCP-Projekt mit aktivierter Vertex AI API, um auf das Gemini-Modell zugreifen zu können.
2. Python-Umgebung: Eine Python-Umgebung, in der die erforderlichen Bibliotheken (vertexai, google-cloud-aiplatform) installiert sind.
3. Authentifizierung: Eine ordnungsgemäße Authentifizierungseinrichtung, die das Erstellen eines Dienstkontos mit Zugriff auf die VertexAI-Plattform umfasst: Rollen wie VertexAI User. Anschließend muss ein Schlüssel in die Anwendungsumgebung heruntergeladen werden. Dieses Dienstkonto muss als Standard-Anmeldeinformationen für die Anwendung in der Umgebung festgelegt werden:
Python
import os
os.environ["GOOGLE_APPLICATION_CREDENTIALS"] = "path/to/service/account/key"
4. Modellauswahl: Auswahl der geeigneten Gemini-Modellvariante (Nano, Flash, Pro, Ultra) basierend auf Ihren spezifischen Anforderungen.
Gemini-Modelle können über das Python SDK, VertexAI oder über LLM-Frameworks wie Langchain aufgerufen werden. Für diesen Artikel werden wir uns jedoch auf die Verwendung des Python SDK beschränken, das installiert werden kann mit:
Nicht festgelegt
pip install vertexai
pip install google-cloud-aiplatform
Um Gemini über diese Methode aufzurufen, muss die VertexAI API in einem Google Cloud Projekt aktiviert sein. Die Details dieses Projekts müssen instanziiert werden, damit Gemini über das Client SDK aufgerufen werden kann.
Python
vertexai.init(project="project_id", location="project_location")
Um von hier aus auf das Modell zuzugreifen und mit dem Prompting zu beginnen, muss eine Instanz des Modells aus dem GenerativeModel-Modul in VertexAI importiert werden. Dies kann geschehen durch:
Python
from vertexai.generative_models import GenerativeModel, ChatSession, Part model_object = GenerativeModel(model_name="gemini-1.5-flash-001", system_instruction="You are a helpful assistant who
reads documents and answers questions.")
Von hier aus sind wir bereit, unser Konversationssystem zu prompten. Da Gemini jedoch so vielseitig ist, gibt es viele Methoden, um mit dem Modell zu interagieren, je nach Anwendungsfall. In diesem Beitrag werde ich die drei Hauptmethoden behandeln und diejenigen, die ich für den Aufbau von Architekturen am praktischsten halte:
Interaktion in einer Chat-Sitzung
Generative Modelle von VertexAI können ihren eigenen Verlauf speichern, solange die Instanz geöffnet ist. Das bedeutet, dass kein externer Dienst zum Speichern des Konversationsverlaufs benötigt wird. Dieser Verlauf kann gespeichert, exportiert und weiter modifiziert werden. Das Verlaufsobjekt ist nun ein Attribut des ChatSession-Objekts, das wir zuvor importiert haben. Dieses ChatSession-Objekt kann instanziiert werden durch:
Python
chat = ChatSession(model=model_object)
Weitere Attribute können hinzugefügt werden, einschließlich des bereits erwähnten Chat-Verlaufs, der es dem Modell ermöglicht, einen simulierten Verlauf zu haben, um die Konversation fortzusetzen. Dieses Chat-Sitzungsobjekt ist die Schnittstelle zwischen dem Benutzer und dem Modell. Wenn ein neuer Prompt an die ChatSession gesendet werden muss, kann dies durch die Verwendung von:
Python
chat.send_message(prompt, stream=False )
Diese Methode simuliert eine mehrstufige Chat-Sitzung, wobei der Kontext während der gesamten Konversation erhalten bleibt, solange die Instanz der Chatsitzung aktiv ist. Der Verlauf wird vom Chatsitzungsobjekt verwaltet, was es dem Benutzer ermöglicht, weitere auf Vorhergehendem basierende Fragen zu stellen, wie z.B. „Was meintest du damit?“, „Wie kann ich das verbessern?“, wenn das Objekt nicht klar ist. Diese Chatsitzungsmethode ist ideal für Chat-Interface-Szenarien wie Chatbots, persönliche Assistenten und mehr.
Der vom Modell erstellte Verlauf kann später gespeichert und während der Instanziierung des Chatsitzungsmodells wie folgt neu geladen werden:
Python
messages = chat.history
chat = ChatSession(model=model, history=history)
Von hier aus kann die Chatsitzung im Multiturn-Chat-Format fortgesetzt werden. Diese Methode ist sehr unkompliziert und macht externe Frameworks wie Langchain zur Verwaltung von Konversationen und deren Rückladen in das Modell überflüssig. Diese Methode bewahrt die volle Funktionalität der Gemini-Modelle und minimiert gleichzeitig den Aufwand für eine vollständige Chat-Oberfläche.
Single-Turn-Chat-Methode
Wenn die erforderliche Funktionalität keine Multiturn-Chat-Methodik erfordert oder kein Verlauf gespeichert werden muss, enthält das Gemini SDK Methoden, die als Single-Turn-Chat-Methode funktionieren, ähnlich wie Schnittstellen zur Bildgenerierung. Jeder
Aufruf an das Modell fungiert als unabhängige Sitzung ohne Sitzungsverfolgung oder Kenntnis früherer Konversationen. Dies reduziert den Aufwand, der zur Erstellung der Schnittstelle erforderlich ist, während immer noch eine voll funktionsfähige Lösung vorhanden ist.
Für diese Methode kann das Modellobjekt direkt verwendet werden, wie folgt:
Python
model = genai.GenerativeModel("gemini-1.5-flash")
response = model.generate_content("What is the capital of Karnataka?") print(response.text)
Hier wird eine Nachricht direkt an das Modell gesendet, ohne dass Verlauf oder Kontext zum Prompt hinzugefügt werden. Diese Methode ist vorteilhaft für jeden Anwendungsfall, der nur eine Single-Turn-Nachrichtenübermittlung erfordert, zum Beispiel Grammatikkorrektur, einige grundlegende Vorschläge und mehr.
Kontext-Caching
Typischerweise werden LLMs nicht eigenständig verwendet, sondern mit einer Wahrheitsquelle geerdet. Dies ermöglicht es ihnen, bei der Beantwortung von Fragen auf eine Wissensbasis zurückzugreifen, was die Wahrscheinlichkeit verringert, dass sie halluzinieren oder Informationen falsch wiedergeben. Dies wird durch die Verwendung eines RAG-Systems erreicht. Gemini 1.5 macht diesen Prozess jedoch überflüssig. Natürlich könnte man den extrahierten Text eines Dokuments vollständig in den Prompt einfügen, aber wenn ein Dokumentencache zu groß ist – 33.000 Token oder mehr – hat VertexAI eine Methode dafür: Kontext-Caching.
Kontext-Caching funktioniert, indem eine ganze Reihe von Dokumenten zusammen mit dem Modell in eine Variable übertragen und eine Chatsitzung aus diesem Cache initiiert wird. Dies macht die Erstellung einer RAG-Pipeline überflüssig, da das Modell bei Bedarf auf die Dokumentation zugreifen kann.
Python
contents = [
Part.from_uri(
"gs://cloud-samples-data/generative-ai/pdf/2312.11805v3.pdf",
mime_type="application/pdf",
),
Part.from_uri(
"gs://cloud-samples-data/generative-ai/pdf/2403.05530.pdf",
mime_type="application/pdf",
),
]
cached_content = caching.CachedContent.create(
model_name="gemini-1.5-pro-001",
system_instruction=system_instruction,
contents=contents,
ttl=datetime.timedelta(minutes=60),
)
Die zwischengespeicherten Dokumente können von jedem GCP-Speicherort bezogen und in ein Part-Objekt formatiert werden. Diese Part-Objekte sind im Wesentlichen ein Datentyp, der die Multi-Turn-Chat-Formate bildet. Diese Objekte werden zusammen mit dem Prompt in einer Liste gesammelt und an das Cache-Objekt übergeben. Neben den Inhalten wird auch ein Time-to-Live-Parameter erwartet. Dieser legt eine Ablaufzeit für den Cache fest, was zur Sicherheit und Speicherverwaltung beiträgt.
Um diesen Cache nun zu verwenden, muss ein Modell aus der Cache-Variable erstellt werden. Dies kann wie folgt geschehen:
Python
model = GenerativeModel.from_cached_content(cached_content=cached_content) response = model.generate_content("What are the papers about?")
#alternativ kann ein ChatSession-Objekt mit diesem Modell verwendet werden, um eine mehrstufige Chat-Schnittstelle zu erstellen.
Der entscheidende Vorteil der Gemini 1.5 Modellfamilie ist ihre unübertroffene Unterstützung für multimodale Prompts. Die Part-Objekte können verwendet werden, um alle Arten von Eingaben zu kodieren. Durch Anpassen des mime-type-Parameters kann das Part-Objekt jede Art von Eingabe darstellen, einschließlich Audio, Video und Bildern. Unabhängig vom Eingabetyp kann das Objekt der Eingabeliste hinzugefügt werden, und das Modell wird es genau so interpretieren, wie Sie es benötigen.

Und voilà! Sie haben Ihren ganz eigenen multimodalen KI-Assistenten mit Gemini 1.5 erstellt. Beachten Sie, dass dies nur ein Ausgangspunkt ist. Das VertexAI SDK bietet Funktionen, die den Aufbau komplexer Agentic-Systeme, Bildgenerierung, Modelloptimierung und vieles mehr unterstützen. Der Umfang der grundlegenden Modelle von Google und die umgebende Unterstützungsstruktur wachsen stetig und verleihen erfahrenen Entwicklern und Neulingen gleichermaßen eine beispiellose Leistungsfähigkeit, um bahnbrechende, äußerst effektive und verantwortungsvolle Anwendungen zu entwickeln.
Ankercloud: Partner von AWS, Google Cloud, Azure, STACKIT und OpenAI
Durch strategische Partnerschaften mit AWS, Google Cloud, Azure, STACKIT, and OpenAI, ermöglichen wir Unternehmen den Einsatz von fortschrittlicher KI, GenAI, Sovereign Cloud und modernen Cloud-Technologien, um Innovation, Sicherheit und skalierbares Wachstum voranzutreiben.






.png)
The Ankercloud Team loves to listen















.png)





.jpg)